CSGLite v0.9.19 版本更新
CSGLite本周更新,从v0.9.11到v0.9.19,共发布九个版本。
主要集中在本地推理稳定性、模型库体验、跨平台兼容和新应用集成。其中Windows gpu 优化以及csghub glm-5.1 saas部署 到 lite 端集成到zcode 是亮点, 形成了csghub云端+lite 本地联动的效果。
具体内容如下:
主要功能更新
ZCode 桌面应用集成(v0.9.19,最新)
- 支持 macOS / Linux / Windows 一键安装与启动,使用官方国内 CDN
- 自动识别用户自行安装的 ZCode,不接管、不提供卸载
- 启动前自动配置 CSGLite 模型,保留用户已有 provider 与设置
模型库下载队列(v0.9.13)
- 最多同时 3 个模型/数据集下载,队列状态可见
- 下载进行中时,筛选、运行、详情、删除等操作保持可用
- 修复加载状态文案与日期/操作列重叠问题
Dashboard GPU 监控增强(v0.9.15)
- Windows:AMD / Intel GPU(含核显如 Radeon 780M)现可显示显存,不再一律 N/A
- macOS:GPU 显存改为实时用量,而非仅显示总量
Codex App 自定义路径检测(v0.9.16)
- Windows 上可检测非默认安装位置的 Codex App(注册表 + 常见目录扫描)
- 详情抽屉新增「指定安装位置」,对应 POST /api/apps/path 接口
大文件上传与流式配置(v0.9.18)
- 本地大模型文件支持 32 MiB 分块上传,带重试与偏移校验
- 新增 --openai-stream-default / CSGHUBLITEOPENAISTREAMDEFAULT,请求未指定 stream 时也可默认流式输出
稳定性与兼容性修复
本地推理稳定性(v0.9.11 ~ v0.9.12)
- 修复 llama-server 流式响应无 [DONE] 时被误判为成功的问题
- 流式中途失败会驱逐引擎,避免下次请求重复输出
- ROCm iGPU:快速切换模型时崩溃 → 限制同时仅一个 text engine
- 增加自愈熔断,后端反复崩溃时停止无限重启并返回明确错误
- 默认 GGMLCUDADISABLE_GRAPHS=1 加固 ROCm,不影响 macOS / NVIDIA / Windows / CPU
Windows 嵌入运行时(v0.9.14)
- 启动前校验 worker import,提前发现损坏依赖
- 缺少 Visual C++ 运行库时给出更清晰提示
第三方 API 流式延迟(v0.9.17)
- 修复经 DeepSeek 等第三方 provider 代理时 SSE 块延迟转发的问题
主题预览
- 本地推理更稳:流式完整性、ROCm 兼容、引擎自愈
- 模型库更好用:下载队列、UI 布局修复
- 跨平台补齐:Windows 嵌入运行时、GPU 监控、Codex 自定义路径
- 生态扩展:ZCode 一键集成(本周最大功能向更新)



关于CSGLite
CSGLite是OpenCSG推出的轻量化本地大模型运行底座,以单二进制文件集成了模型下载、本地推理、交互对话与标准API服务,支持一键自动完成模型加载与推理启动,并提供包含资源监控、模型市场、数据集管理、聊天室及AI应用管理等七大模块的统一Web工作台。它支持从CSGHub社区或私有仓库获取模型及数据集,也可无缝对接OpenAI、DeepSeek等第三方API;同时可通过launch命令一键配置主流编程Agent(如Claude Code、Codex等)直接调用本地模型,或一键拉起OpenClaw、Dify等AI应用,从而为开发者和企业提供从模型管理到本地推理、再到应用生态接入的全流程基础设施能力。
OpenCSG社区:
开源链接:

浙公网安备 33010602011771号