长上下文时代的思考:从 1M Context Window 看 AI 基础设施的演进
引子
最近看到群友讨论 DeepSeek v4 的 1M 上下文会用于什么场景,联想到近一年常见的"RAG已死"说法,有感而发。
DeepSeek 官方宣布:"从现在开始,1M(一百万)上下文将是 DeepSeek 所有官方服务的标配。"
一个有趣的讨论
在技术群里,有人提出了这样的疑问:
"DeepSeek 这种普惠的 1M 上下文……怎么用呢……写小说?"
有群友回应:
"无脑用就行了,基于上下文的快速检索。不用 RAG 了。"
我的看法
RAG 不会消失
数据库存在,RAG 就存在。
让我们做个简单的计算:1M context window 换算下来也才 3-10M 的磁盘空间。这意味着什么?
长上下文的价值不在于替代数据库,而在于为辅助信息留出了更多空间。它本质上是一种基础设施(infra)。
基础设施决定上层应用
当基础设施起来了,后边的工程才有腾挪手脚的空间。
举个例子:
- 2024年时,窗口普遍才 4k,Anthropic 再牛逼也做不出来 Claude Code
- 就像 2G 时代诞生不了短视频一样
这背后的逻辑,正是经典的「安迪-比尔定律」。
长上下文解锁的新场景
有了 1M 上下文,一些之前不可能或很困难的场景变得可行:
1. 全代码库理解
- 中小型项目可以一次性加载整个代码库
- AI 能够理解跨文件的依赖关系和架构设计
- 重构和迁移变得更加智能和安全
2. 长文档处理
- 法律合同、学术论文、技术文档的深度分析
- 不再需要分段处理后再拼接结果
- 保持完整的上下文连贯性
3. 多轮对话的质变
- 可以保留完整的对话历史
- AI 能够引用几十轮之前的细节
- 真正的"记忆"而非"遗忘"
4. 实时协作助手
- 跟踪整个工作会话的所有操作
- 理解用户的工作流程和意图演变
- 提供更精准的上下文感知建议
安迪-比尔定律的启示
「安迪-比尔定律」会指导各个领域。模型 & 应用 会不严谨地重演 软件 & 硬件 发展周期中的各个环节。
这正是工程视角给我们带来的启示:
- 硬件性能提升 → 软件功能扩展
- 模型能力增强 → 应用场景爆发
当上下文窗口从 4k 扩展到 1M,我们看到的不仅是数量级的提升,更是质的飞跃——它为新一代 AI 应用提供了施展拳脚的舞台。
范式转变:从"检索-生成"到"理解-推理"
长上下文带来的不仅是容量的提升,更是交互范式的转变。
传统 RAG 的困境
在短上下文时代,我们不得不采用"检索-生成"的模式:
- 将知识切片存入向量数据库
- 根据查询检索相关片段
- 将片段塞入有限的上下文窗口
- 生成答案
这个过程存在明显的问题:
- 信息碎片化:切片破坏了知识的完整性
- 检索精度:相关性判断可能不准确
- 上下文丢失:无法保留完整的语义关系
- 多跳推理困难:跨文档的逻辑链条容易断裂
长上下文的新范式
有了 1M 上下文,我们可以:
- 直接加载:把整个知识库或文档集放入上下文
- 全局理解:AI 能够看到完整的信息全貌
- 深度推理:支持复杂的多步骤逻辑推导
- 动态关联:自动发现不同部分之间的隐含联系
这不是 RAG 的消失,而是 RAG 的升维。
成本与效率的新平衡
计算成本的考量
1M 上下文虽然强大,但也带来了新的挑战:
Token 消耗
- 每次调用都要处理大量 token
- 成本随上下文长度线性增长
- 需要更智能的上下文管理策略
延迟问题
- 处理时间随上下文增加
- 实时交互场景需要权衡
- 可能需要异步处理模式
工程上的最佳实践
聪明的做法是分层使用:
- 热数据层:频繁访问的信息放入长上下文
- 温数据层:按需检索的内容用 RAG
- 冷数据层:归档数据保留在数据库
这样既能享受长上下文的便利,又能控制成本。
对开发者的启示
重新思考架构设计
长上下文时代,我们需要重新审视应用架构:
1. 状态管理
- 更多状态可以保留在上下文中
- 减少对外部存储的依赖
- 简化状态同步逻辑
2. 提示工程
- 从"精简提示"转向"丰富上下文"
- 可以提供更多示例和背景信息
- Few-shot 变成 Many-shot
3. 错误处理
- AI 能够看到完整的错误历史
- 自动学习和避免重复错误
- 更智能的调试和修复
新的能力边界
长上下文让一些之前"不可能"的事情变成"可能":
- 代码审查:理解整个 PR 的上下文和影响范围
- 文档生成:基于完整代码库生成准确的文档
- 测试生成:理解业务逻辑后生成全面的测试用例
- 技术债务分析:全局视角识别架构问题
未来展望:10M、100M 之后
如果说 1M 上下文是基础设施的升级,那么 10M、100M 会带来什么?
可能的演进方向
1. 多模态融合
- 同时处理代码、文档、图表、视频
- 真正的"全栈"理解能力
- 跨模态的推理和生成
2. 实时知识更新
- 上下文中包含实时数据流
- 动态适应变化的环境
- 持续学习和优化
3. 协作智能
- 多个 AI 共享超大上下文
- 分工协作完成复杂任务
- 集体智慧的涌现
不变的本质
无论上下文窗口如何扩展,有些原则不会改变:
- 数据质量:垃圾进,垃圾出
- 提示设计:清晰的指令仍然重要
- 人机协作:AI 是工具,人是主导
- 成本意识:资源永远是有限的
结语
1M 上下文不是终点,而是起点。它标志着 AI 基础设施进入了新的阶段。
真正的问题不是"1M 上下文用来干什么",而是"有了 1M 上下文,我们能创造出什么样的应用"。
技术的进步总是超出我们的想象。 就像当年没人能预测到智能手机会如何改变世界,现在我们也很难完全预见长上下文会催生出什么样的创新应用。
但有一点是确定的:那些能够充分利用长上下文能力的应用,将会在下一个时代占据先机。
作为开发者,我们需要做的是:
- 保持开放的心态
- 大胆尝试新的可能性
- 在实践中探索最佳实践
- 与社区分享经验和洞察
长上下文时代,才刚刚开始。
写于 2026 年 4 月

浙公网安备 33010602011771号