摘要:
本文基于 AI Max 395(搭载 AMD Ryzen AI Max+ 395 处理器)硬件平台,完整记录了通过 GPUStack 开源集群管理平台,本地部署 AgentCPM 系列模型并接入 DeepResearch 能力的全流程实践。 阅读全文
posted @ 2026-03-04 10:53
GPUStack
阅读(1851)
评论(0)
推荐(0)
关注🌟⌈GPUStack⌋ 💻一起学习 AI、GPU 管理与大模型相关技术实践。 这两年,越来越多团队把 AI 接入了日常工作流。 但很快,一个现实问题摆在了面前: 模型用得越多,Token 花得越快,成本和心理压力也随之上涨。 很多人一边依赖 AI 提效,一边又不得不「省着用」「少让它多想」。 阅读全文
通过 n8n 接入 GPUStack 本地模型,构建一个自动抓取 RSS、生成摘要并邮件推送的 AI 资讯助手。全流程本地运行,零 API 成本,数据不出域,快速体验私有化 AI 自动化。 阅读全文
GPUStack v2 自定义后端功能实战!本文以 MinerU 为例,手把手教你快速接入并运行超强 PDF 解析工具,轻松构建私有化文档提取服务。 阅读全文
相比于未优化的 vLLM 基线,经过针对性调优的 DeepSeek-V3.2 在 NVIDIA H200 集群上实现了 57.8% 至 153.6% 的吞吐量提升。 阅读全文
在 WSL2(Windows Subsystem for Linux) 中配置 NVIDIA GPU 并部署 GPUStack。 阅读全文
在大模型推理的下半场,GPUStack v2 不再是简单的模型服务平台,而是高性能推理生态的协调者与赋能者。 阅读全文
一键跑通 PaddleOCR-VL,极速体验行业顶尖的文档解析实力。 阅读全文
昇腾多机推理太复杂?易出错?试试 GPUStack 阅读全文