随笔分类 - 020_Agent
摘要:[Agent Memory / 强化学习] MemPO源码学习笔记 (4) Rollout实现细节 目录[Agent Memory / 强化学习] MemPO源码学习笔记 (4) Rollout实现细节0x00 概要0x01 回顾0x02 mem_sys_prompt_ids2.1 mem_sys_
阅读全文
摘要:机器人 / 物理 Agent Harness 综合分析与对比:从「更强的模型」到「更好的系统」 目录机器人 / 物理 Agent Harness 综合分析与对比:从「更强的模型」到「更好的系统」0x00 概要0x01 面对的难点与核心冲突1.1 核心冲突的一句话版本1.2 深挖:难点的四个层次0x0
阅读全文
摘要:[Agent Memory / 强化学习] MemPO源码学习笔记 (3) Rollout思路 目录[Agent Memory / 强化学习] MemPO源码学习笔记 (3) Rollout思路0x00 概要0x01 Rollout 主要内容1.1 时间线1.2 纯 RolloutRollout 阶
阅读全文
摘要:[Agent Memory / 强化学习] MemPO源码学习笔记 (2) 训练 目录[Agent Memory / 强化学习] MemPO源码学习笔记 (2) 训练0x00 概要0x01 原理1.1 为什么MemPO必须用RL而不是SFT?SFT 的劣势RL解决方式MemPO的实际路径小结1.2
阅读全文
摘要:[Agent Memory / 强化学习] MemPO源码学习笔记 (1) 总体 目录[Agent Memory / 强化学习] MemPO源码学习笔记 (1) 总体0x00 概要0x01 基础 & 背景1.1 用RL训练记忆系统的要点1.2 主要难点1.3 主要思路1.4 RL训练方案1.4.1
阅读全文
摘要:【OpenClaw具身硬件】ZeroClaw 源码阅读笔记(4) 代码执行 目录【OpenClaw具身硬件】ZeroClaw 源码阅读笔记(4) 代码执行0x00 概要0x01 代码合成1.1 核心思想1.2 业务逻辑具体应用场景能力体现1.3 实现细节生成种类Rust 代码Arduino CLI的
阅读全文
摘要:【OpenClaw具身硬件】ZeroClaw 源码阅读笔记(3) RAG 目录【OpenClaw具身硬件】ZeroClaw 源码阅读笔记(3) RAG0x00 概要0x01 两套RAG1.1 关键差异1.2 工程取舍0x02 HardwarRag 基础2.1 基本功能2.2 使用原因2.3 具体应用
阅读全文
摘要:【Agentic RL / 强化学习框架】Molt 设计解读 目录【Agentic RL / 强化学习框架】Molt 设计解读0x00 概要0x01 从 RL 流程到 Molt 代码:一次完整映射1.1 第一层:标准 RL 训练流程1.2 第二层:Molt 模块对应关系1.3 第三层:类定义 + 角
阅读全文
摘要:【OpenClaw具身硬件】ZeroClaw 源码阅读笔记(2) 机器人 目录【OpenClaw具身硬件】ZeroClaw 源码阅读笔记(2) 机器人0x00 概要0x03 机器人设计理念3.1 愿景3.2 总体特性三层架构模块特点3.3 人格SOUL.mdAIEOS[identity]实现示例3.
阅读全文
摘要:【OpenClaw具身硬件】ZeroClaw 源码阅读笔记(1) 总体 目录【OpenClaw具身硬件】ZeroClaw 源码阅读笔记(1) 总体0x00 概要0x01 基础知识1.1 主要功能1.2 系统架构1.2.1 层级关系1.2.2 模块图1.2.3 依赖关系1.3 CLI1.4 消息流程1
阅读全文
摘要:【Agentic RL / 强化学习框架 / VERL】Uni-Agent Gateway 深度解析 目录【Agentic RL / 强化学习框架 / VERL】Uni-Agent Gateway 深度解析0x00 概要0x01. Gateway 是为了解决什么问题?1.1 VERL 原有架构的困境
阅读全文
摘要:【OpenClaw具身硬件】MiniClaw 阅读笔记 (4) 文件读写 目录【OpenClaw具身硬件】MiniClaw 阅读笔记 (4) 文件读写0x00 概要0x01 Read file & RAG1.1 经典RAG的工作方式1.2 MimiClaw反过来:LLM是检索的发起者1.3 为什么这
阅读全文
摘要:【OpenClaw具身硬件】MiniClaw 阅读笔记 (3) 接口 & 混合智能 目录【OpenClaw具身硬件】MiniClaw 阅读笔记 (3) 接口 & 混合智能0x00 概要0x01 MimiClaw的感知接口与执行接口分析1.1 接口全景图1.2 设计哲学浓缩1.3 感知接口的两种范式:
阅读全文
摘要:# 【Agent OS / AIOS】AOHP 深度解读:当 OS 开始为 Agent 而设计 目录0x00 摘要0x01 问题:Agent 为什么在传统 OS 上"水土不服"1.1 传统 OS 的根本假设1.2 Agent 的工作模式与 传统OS 的错配1.3 核心矛盾1.4 设计原则0x02 总
阅读全文
摘要:【OpenClaw具身硬件】MiniClaw 阅读笔记 (2)钉核 & 上下文 目录【OpenClaw具身硬件】MiniClaw 阅读笔记 (2)钉核 & 上下文0x00 概要0x01 双核配置1.1 ESP32-S3 核1.2 MimiClaw实际的钉核决策1.3 钉核原因引力1:WiFi/lwI
阅读全文
摘要:【OpenClaw具身硬件】MiniClaw 阅读笔记 (1)基础 目录【OpenClaw具身硬件】MiniClaw 阅读笔记 (1)基础0x00 概要0x01 基本知识1.1 MimiClaw 核心特色1.2 核心定位1.3 应用场景0x02 设计理念2.1 核心设计哲学2.2 设计取舍总结0x0
阅读全文
摘要:【Agentic RL / 强化学习 / OPD】Hermes & OPD 源码阅读笔记 目录【Agentic RL / 强化学习 / OPD】Hermes & OPD 源码阅读笔记0x00 概要0x01 OPD 机制原理 —— "OPD 是什么,怎么工作"1.1 OPD 的完整数据流1.2 vLL
阅读全文
摘要:VelesDB 深度解读 —— 融合向量、图与列存的端侧 AI 记忆引擎 目录VelesDB 深度解读 —— 融合向量、图与列存的端侧 AI 记忆引擎0x00 概要:VelesDB 是什么0x01 总论1.1 面对的难点与核心冲突1.2 如何解决这些难点1.3 本项目的特色1.4 三种视角解读给 1
阅读全文
摘要:【Agentic RL / 强化学习 / OPD】OpenClaw-RL 源码阅读笔记 (16) AReal 目录【Agentic RL / 强化学习 / OPD】OpenClaw-RL 源码阅读笔记 (16) AReal0x00 概要0x01 基础背景1.1 AReaL1.2 工作1.3 训练架构
阅读全文
摘要:【Agentic RL / 强化学习 / OPD】OpenClaw-RL 源码阅读笔记 (15) Combine模式 目录【Agentic RL / 强化学习 / OPD】OpenClaw-RL 源码阅读笔记 (15) Combine模式0x00 概要0x01 架构1.1 架构:继承而非重写1.2
阅读全文
浙公网安备 33010602011771号