ollama操作

https://ollama.com/library/qwen3

1)查看本地模型

ollama list

2)删除指定模型

ollama rm llama3

如果模型带版本号,也可以这样删:

ollama rm llama3:latest

3)下载模型

ollama run qwen3:4b

4)调用案例:

# 下载依赖
pip install langchain-ollama
from langchain_ollama import ChatOllama

def get_llm() -> ChatOllama:
    """
    调用大模型
    """
    return ChatOllama(
        model="qwen3:4b",
        base_url="http://localhost:11434",
        # temperature=1,
    )

print(get_llm().invoke("你能做什么?"))

5)ollama启动:

Ollama 的核心是一个本地服务,默认监听:

http://localhost:11434

1、启动命令

ollama serve

2、启动后直接运行某个模型

ollama run qwen3:4b

3、后台启动(让服务一直在后台跑)

nohup ollama serve > ollama.log 2>&1 &

或者

ollama serve &

说明

  • &:放到后台
  • nohup:即使关闭终端也继续运行
  • 输出会写入 ollama.log

4、验证 Ollama 是否已经启动

启动后,可以访问默认接口:

curl http://localhost:11434

或者查看模型列表:

ollama list
如果服务正常,一般会有响应。

或者如果有输出,说明 Ollama 服务在运行。

lsof -i :11434

5)停止ollama

1、Ollama 是后台运行的

先找进程:

ps aux | grep ollama

然后用 kill 停掉对应 PID,比如:

kill 12345

如果没停掉,再强制:

kill -9 12345

2、Windows

如果是命令行启动的,直接关闭那个窗口即可。
如果是后台进程,可以在任务管理器里结束:

    • 打开 任务管理器
    • 找到 ollama.exe
    • 结束任务

3、如果你是 Ollama 桌面版/系统服务 

macOS

如果 Ollama 是作为应用运行的:

  • 退出菜单栏里的 Ollama
  • 或者在 活动监视器 里搜索 ollama,然后结束进程

Linux(如果是服务)

如果你是通过 systemd 启动的,可以尝试:

sudo systemctl stop ollama

 

 

posted @ 2026-04-29 17:32  Delta.Farce  阅读(133)  评论(0)    收藏  举报