CSGLite v0.9.37 开源版本更新

本周 CSGLite 多次更新迭代至 v0.9.37,其中推理引擎优化速度提升提速约1.26 倍, 重复请求命中 n-gram 缓存时可从 4.639 秒降至 0.336 秒,约 13.8 倍。

具体内容如下:

主要更新与修复

  • 模型库增加「停止」已加载模型
  • AI 应用按 Provider 稳定路由,支持区分同名模型
  • 模型选择器统一显示 Provider 标签,恢复 Opus 4.7
  • /api/tags?provider=local 优化,避免因云端网关超时导致请求卡住
  • Codex Provider 漂移修复,仅校验 CSGLite 管理字段
  • Anthropic 兼容代理支持实时流式转发,长请求不再出现约 60 秒空闲超时
  • GGUF 权重选择优化,自动跳过 MTP 伴生文件(如 Gemma 4)
  • 加权 Provider 模型池:支持优先级/权重、限流、自动 Fallback,并提供 UI / CLI / 统计能力
  • 转换器资产版本化内置,修复 SafeTensors 转换失败问题
  • 本地 GGUF Speculative Decoding:支持 N-gram、MTP、EAGLE-3、DFlash、DSpark
  • 本地导入多模态 GGUF 支持视觉 Projector 识别
  • CSGClaw 桌面应用支持 macOS / Windows 的安装、检测与启动
  • 核心推理引擎升级至 llama.cpp b10326

Desktop client 更新

  • 启动页支持英 / 简中 / 繁中本地化
  • Windows 安装改为带许可协议与快捷方式的品牌化向导,并修正启动品牌文案
  • 窗口品牌统一为 CSGLite;Windows 安装/卸载界面支持中英文
  • 修复 Windows CUDA 运行时打包:安装时有 NVIDIA 驱动则装 CUDA,否则保留 CPU 回退
  • macOS 包不再打进平台无关的 CUDA 资源;补充统一桌面 API 策略说明
  • 多次 pin 最新 lite / CSGClaw 合并后的桌面后端,保证原生构建一致

关于CSGLite

CSGLite是OpenCSG推出的轻量化本地大模型运行底座,以单二进制文件集成了模型下载、本地推理、交互对话与标准API服务,支持一键自动完成模型加载与推理启动,并提供包含资源监控、模型市场、数据集管理、聊天室及AI应用管理等七大模块的统一Web工作台。它支持从CSGHub社区或私有仓库获取模型及数据集,也可无缝对接OpenAI、DeepSeek等第三方API;同时可通过launch命令一键配置主流编程Agent(如Claude Code、Codex等)直接调用本地模型,或一键拉起OpenClaw、Dify等AI应用,从而为开发者和企业提供从模型管理到本地推理、再到应用生态接入的全流程基础设施能力。

OpenCSG社区:

opencsg.com/products/cs

开源链接:

github.com/OpenCSGs/csg

posted @ 2026-08-30 18:34  OpenCSG  阅读(14)  评论(0)    收藏  举报