ollama操作
https://ollama.com/library/qwen3
1)查看本地模型
ollama list
2)删除指定模型
ollama rm llama3
如果模型带版本号,也可以这样删:
ollama rm llama3:latest
3)下载模型
ollama run qwen3:4b
4)调用案例:
# 下载依赖 pip install langchain-ollama
from langchain_ollama import ChatOllama def get_llm() -> ChatOllama: """ 调用大模型 """ return ChatOllama( model="qwen3:4b", base_url="http://localhost:11434", # temperature=1, ) print(get_llm().invoke("你能做什么?"))
5)ollama启动:
Ollama 的核心是一个本地服务,默认监听:
http://localhost:11434
1、启动命令
ollama serve
2、启动后直接运行某个模型
ollama run qwen3:4b
3、后台启动(让服务一直在后台跑)
nohup ollama serve > ollama.log 2>&1 &
或者
ollama serve &
说明
&:放到后台nohup:即使关闭终端也继续运行- 输出会写入
ollama.log
4、验证 Ollama 是否已经启动
启动后,可以访问默认接口:
curl http://localhost:11434
或者查看模型列表:
ollama list
如果服务正常,一般会有响应。
或者如果有输出,说明 Ollama 服务在运行。
lsof -i :11434
5)停止ollama
1、Ollama 是后台运行的
先找进程:
ps aux | grep ollama
然后用 kill 停掉对应 PID,比如:
kill 12345
如果没停掉,再强制:
kill -9 12345
2、Windows
如果是命令行启动的,直接关闭那个窗口即可。
如果是后台进程,可以在任务管理器里结束:
- 打开 任务管理器
- 找到
ollama.exe - 结束任务
3、如果你是 Ollama 桌面版/系统服务
macOS
如果 Ollama 是作为应用运行的:
- 退出菜单栏里的 Ollama
- 或者在 活动监视器 里搜索
ollama,然后结束进程
Linux(如果是服务)
如果你是通过 systemd 启动的,可以尝试:
sudo systemctl stop ollama

浙公网安备 33010602011771号