摘要:
Harness 自进化真的在变好么? 阅读全文
posted @ 2026-08-04 16:29
小七-七牛开发者
阅读(13)
评论(0)
推荐(0)
摘要:
先做代码切片和行为图,证据不足再查文档、进沙箱 阅读全文
posted @ 2026-08-04 16:20
小七-七牛开发者
阅读(6)
评论(0)
推荐(0)
摘要:
本期「周一上线」聚焦AI两大演进方向:模型加速迈向多模态与机器人,Agent则从“写代码”升级为长期协作、端到端交付与自我改进。DeepSeek V4-Flash、MiniMax H3、Gemini Robotics 2等密集发布,OpenAI Astra、Lilian Weng的RSI团队、贾扬清Intent Lab齐探AI自主进化;行业层面,AlphaFold团队拆分、字节整合飞书/豆包/火山引擎,技术与组织同步重构。 阅读全文
posted @ 2026-08-03 14:29
小七-七牛开发者
阅读(786)
评论(0)
推荐(1)
小七精选七月AI开发干货:涵盖Claude Code/Codex高效用法、Agent图编排与自我改进、Harness成本优化、多模型评审、Living-Harness持续学习及OO Agents面向对象设计等前沿实践与论文,助你高效进阶。
Anthropic提出“上下文工程”(Context Engineering)新范式:Claude Opus 5/Fable 5删减超80%系统提示词,性能未降。核心转向“瘦提示-厚工件-瘦技能”,强调模型自主判断、渐进披露与高保真参考,告别冗余规则堆砌。
本文用人类学习类比AI训练,通俗解析大模型如何通过预训练、监督微调与强化学习掌握新技能;详解Model Spec、宪法等行为规范如何引导AI成为可靠协作者,并介绍评测与持续对齐的关键作用。
本文详解Agent工具调用的输入输出契约:输入契约规范工具名称、描述、参数Schema与使用边界,确保模型准确调用;输出契约定义结构化结果、状态码与错误反馈,支撑模型可靠决策。二者共同保障Agent“思考→行动→判断”闭环的稳定性与可解释性。
本文深度解析Kimi K3技术演进路径:从GPT-2出发,历经Linear Attention、DeltaNet、Gated DeltaNet、Kimi Linear,最终抵达2.8万亿参数的Kimi K3。全文以“状态管理”为主线,揭示架构迭代本质
Anthropic团队近期利用Claude系列模型,将Bun等百万行级项目从Zig、Python等语言高效迁至Rust/TypeScript:Jarred 11天完成Bun百万行迁移,Mike一个周末重构16.5万行Python为TS。AI驱动六步流程大幅压缩周期与成本,同时保障功能一致性和性能提升。
写在前面:如果你做过 RAG,大概率遇到过这样一个问题:同一批文档,系统回答第 10 个问题时,并不比回答第 1 个问题时更聪明。每次查询都从原始分块重新推导一遍,前 9 次积累的理解,没有沉淀下来。 近一年中,几个团队从不同方向给出了相似的答案——不要在查询时重新推导,而要在资料导入时完成编译。这
浙公网安备 33010602011771号