我为什么放弃ollama 转到 llama.cpp ?
我为什么放弃ollama 转到 llama.cpp ?
我最早安装部署本地大模型其实就是用的ollama,ollama操作比较简单,直接安装windows基本ok了,增加点环境变量之类的。
1、因为ollama底层用过的也是llama.cpp,性能貌似还差一点。
2、ollama现在作者,没有提及基于llama.cpp的,这在开源界,不是很标准的做法。
3、ollama 下载的大模型文件,文件名是uuid,不直观。
4、我安装的是llama.cpp编译好版本,免去了编译的环节。
5、llama.cpp使用的大模型文件名是gguf后缀名,网上有专门的下载地址https://www.modelscope.cn/models 输入gguf即可搜索到。
6、给大家一个我运行llama.cpp的一个脚本,可以自定义key,以方便其他应用调用:
d: cd \llama.cpp llama-server.exe -m .\Qwen3.5-4B-Q4_K_M.gguf -ngl 75 --port 7777 --host 0.0.0.0 --api-key "asdfadfdfdfwe"
posted on 2026-05-05 07:38 handsome12345 阅读(65) 评论(0) 收藏 举报
浙公网安备 33010602011771号