CSGLite v0.9.19 版本更新

CSGLite本周更新,从v0.9.11到v0.9.19,共发布九个版本。

主要集中在本地推理稳定性、模型库体验、跨平台兼容和新应用集成其中Windows gpu 优化以及csghub glm-5.1 saas部署 到 lite 端集成到zcode 是亮点, 形成了csghub云端+lite 本地联动的效果。

具体内容如下:

主要功能更新

ZCode 桌面应用集成(v0.9.19,最新)

  • 支持 macOS / Linux / Windows 一键安装与启动,使用官方国内 CDN
  • 自动识别用户自行安装的 ZCode,不接管、不提供卸载
  • 启动前自动配置 CSGLite 模型,保留用户已有 provider 与设置

模型库下载队列(v0.9.13)

  • 最多同时 3 个模型/数据集下载,队列状态可见
  • 下载进行中时,筛选、运行、详情、删除等操作保持可用
  • 修复加载状态文案与日期/操作列重叠问题

Dashboard GPU 监控增强(v0.9.15)

  • Windows:AMD / Intel GPU(含核显如 Radeon 780M)现可显示显存,不再一律 N/A
  • macOS:GPU 显存改为实时用量,而非仅显示总量

Codex App 自定义路径检测(v0.9.16)

  • Windows 上可检测非默认安装位置的 Codex App(注册表 + 常见目录扫描)
  • 详情抽屉新增「指定安装位置」,对应 POST /api/apps/path 接口

大文件上传与流式配置(v0.9.18)

  • 本地大模型文件支持 32 MiB 分块上传,带重试与偏移校验
  • 新增 --openai-stream-default / CSGHUBLITEOPENAISTREAMDEFAULT,请求未指定 stream 时也可默认流式输出

稳定性与兼容性修复

本地推理稳定性(v0.9.11 ~ v0.9.12)

  • 修复 llama-server 流式响应无 [DONE] 时被误判为成功的问题
  • 流式中途失败会驱逐引擎,避免下次请求重复输出
  • ROCm iGPU:快速切换模型时崩溃 → 限制同时仅一个 text engine
  • 增加自愈熔断,后端反复崩溃时停止无限重启并返回明确错误
  • 默认 GGMLCUDADISABLE_GRAPHS=1 加固 ROCm,不影响 macOS / NVIDIA / Windows / CPU

Windows 嵌入运行时(v0.9.14)

  • 启动前校验 worker import,提前发现损坏依赖
  • 缺少 Visual C++ 运行库时给出更清晰提示

第三方 API 流式延迟(v0.9.17)

  • 修复经 DeepSeek 等第三方 provider 代理时 SSE 块延迟转发的问题

主题预览

  • 本地推理更稳:流式完整性、ROCm 兼容、引擎自愈
  • 模型库更好用:下载队列、UI 布局修复
  • 跨平台补齐:Windows 嵌入运行时、GPU 监控、Codex 自定义路径
  • 生态扩展:ZCode 一键集成(本周最大功能向更新)

关于CSGLite

CSGLite是OpenCSG推出的轻量化本地大模型运行底座,以单二进制文件集成了模型下载、本地推理、交互对话与标准API服务,支持一键自动完成模型加载与推理启动,并提供包含资源监控、模型市场、数据集管理、聊天室及AI应用管理等七大模块的统一Web工作台。它支持从CSGHub社区或私有仓库获取模型及数据集,也可无缝对接OpenAI、DeepSeek等第三方API;同时可通过launch命令一键配置主流编程Agent(如Claude Code、Codex等)直接调用本地模型,或一键拉起OpenClaw、Dify等AI应用,从而为开发者和企业提供从模型管理到本地推理、再到应用生态接入的全流程基础设施能力。

OpenCSG社区:

opencsg.com

开源链接:

github.com/OpenCSGs/csg

posted @ 2026-07-25 21:37  OpenCSG  阅读(6)  评论(0)    收藏  举报