• 博客园logo
  • 会员
  • 周边
  • 新闻
  • 博问
  • 闪存
  • 赞助商
  • Chat2DB
    • 搜索
      所有博客
    • 搜索
      当前博客
  • 写随笔 我的博客 短消息 简洁模式
    用户头像
    我的博客 我的园子 账号设置 会员中心 简洁模式 ... 退出登录
    注册 登录

security-hyacinth

  • 博客园
  • 联系
  • 订阅
  • 管理

公告

上一页 1 ··· 19 20 21 22 23 24 25 26 27 ··· 36 下一页

2026年2月1日

46. vLLM API Server 架构:高性能推理服务的设计与实现

摘要: 作者:HOS(安全风信子) 日期:2026-01-21 来源平台:GitHub 摘要: 本文深入剖析了vLLM API Server的架构设计与实现细节,包括REST/gRPC双协议支持、OpenAI API兼容性、认证授权机制、负载均衡策略和Docker部署方案。通过Mermaid图表和代码示例, 阅读全文

posted @ 2026-02-01 10:52 安全风信子 阅读(59) 评论(0) 推荐(0)

2026年1月29日

45. Async Engine 设计:构建高并发推理服务的核心

摘要: 作者:HOS(安全风信子) 日期:2026-01-19 来源平台:GitHub 摘要: 本文深入剖析vLLM Async Engine的设计原理与实现细节,揭示其如何通过异步编程模型、协程调度和高效IO管理实现高并发推理服务。从Aiohttp集成到协程调度器,从背压处理到异步模型加载,全面覆盖异步引 阅读全文

posted @ 2026-01-29 11:27 安全风信子 阅读(22) 评论(0) 推荐(0)

44. 多进程 vs 多线程:vLLM中的并发选择

摘要: 作者:HOS(安全风信子) 日期:2026-01-19 来源平台:GitHub 摘要: 本文深入探讨vLLM框架中多进程与多线程的并发实现方案,通过分析两种并发模型的设计原理、实现细节、性能特征以及适用场景,结合真实源码示例和性能测试数据,揭示vLLM如何在不同场景下选择最优的并发策略。文章还对比了 阅读全文

posted @ 2026-01-29 11:27 安全风信子 阅读(26) 评论(0) 推荐(0)

43. Ray 在 vLLM 中的角色:分布式推理的强力引擎

摘要: 作者:HOS(安全风信子) 日期:2026-01-19 来源平台:GitHub 摘要: 本文深入剖析Ray在vLLM框架中的核心角色,作为分布式推理的强力引擎,Ray为vLLM提供了高效的Actor通信、智能资源调度、故障容错和动态扩缩容能力。通过分析Ray与vLLM的深度集成机制、Ray Acto 阅读全文

posted @ 2026-01-29 11:26 安全风信子 阅读(32) 评论(0) 推荐(0)

42. Worker / Driver 架构:vLLM的分布式推理核心

摘要: 作者:HOS(安全风信子) 日期:2026-01-19 来源平台:GitHub 摘要: 本文深入剖析vLLM框架中的Worker / Driver架构,作为分布式推理的核心,它实现了高效的任务协调与执行机制。通过分析Driver的协调逻辑、Worker的执行流程、Ray Actor通信机制以及故障恢 阅读全文

posted @ 2026-01-29 11:25 安全风信子 阅读(33) 评论(0) 推荐(0)

41. ModelRunner 解析:vLLM的模型执行核心

摘要: 作者:HOS(安全风信子) 日期:2026-01-19 来源平台:GitHub 摘要: 本文深入剖析vLLM框架中的ModelRunner组件,作为模型执行的核心,它负责处理模型的前向传播、Torch集成、编译优化等关键功能。通过分析ModelRunner的设计架构、实现原理和优化策略,结合真实源码 阅读全文

posted @ 2026-01-29 11:24 安全风信子 阅读(36) 评论(0) 推荐(0)

AI Skills的皇帝新衣:当套皮Prompt被包装成革命性技术

摘要: 作者: HOS(安全风信子) 日期: 2026-01-29 主要来源平台: GitHub 摘要: 当AI Skills成为行业热点,我们需要冷静审视其本质:它不过是套皮的Agent Prompt,无实质性技术进展。Skill的流行反映了大部分用户缺乏系统化、程序化思维,催生了一场技术包装的盛宴。本文 阅读全文

posted @ 2026-01-29 11:18 安全风信子 阅读(21) 评论(0) 推荐(0)

2026年1月27日

Prompt Engineering 进阶:用 JSON 构建可控、稳定、可管理的提示词系统

摘要: 作者:HOS(安全风信子) 日期:2026-01-27 来源平台:GitHub 摘要: Prompt Engineering 正从简单的文本提示演变为复杂的系统设计。本文探讨了 JSON 与 Markdown 两种 Prompt 格式的本质差异,提出了从"格式选择"到"系统设计"的认知转变,并构建了 阅读全文

posted @ 2026-01-27 22:52 安全风信子 阅读(39) 评论(0) 推荐(0)

固定提示词用 JSON 还是 Markdown?当 Prompt 工程走向「理性 × 感性」的系统设计

摘要: 作者:HOS(安全风信子) 日期:2026-01-27 来源平台:GitHub 摘要: 本文深入探讨了 Prompt 工程中的格式选择问题,从简单的「JSON vs Markdown」对比上升到「理性 × 感性」的系统设计高度。通过分析两种格式的本质差异、适用场景以及混合结构的优势,本文提出了「对人 阅读全文

posted @ 2026-01-27 15:30 安全风信子 阅读(33) 评论(0) 推荐(0)

2026年1月25日

40. vLLM 启动流程源码精读:从配置加载到 Worker 初始化

摘要: 作者:HOS(安全风信子) 日期:2026-01-19 来源平台:GitHub 摘要: 本文深入剖析vLLM框架的启动流程,从配置加载到Worker初始化的完整过程,重点探讨核心函数__init__的实现细节、启动参数调优策略和常见错误处理机制。通过分析vLLM如何实现配置解析、模型加载、分布式Wo 阅读全文

posted @ 2026-01-25 15:35 安全风信子 阅读(82) 评论(0) 推荐(0)

上一页 1 ··· 19 20 21 22 23 24 25 26 27 ··· 36 下一页
 
博客园  ©  2004-2026
浙公网安备 33010602011771号 浙ICP备2021040463号-3