随笔分类 -  020_Agent

摘要:[Agent Memory / 强化学习] MemPO源码学习笔记 (4) Rollout实现细节 目录[Agent Memory / 强化学习] MemPO源码学习笔记 (4) Rollout实现细节0x00 概要0x01 回顾0x02 mem_sys_prompt_ids2.1 mem_sys_ 阅读全文
posted @ 2026-09-23 20:43 罗西的思考 阅读(72) 评论(2) 推荐(1)
摘要:机器人 / 物理 Agent Harness 综合分析与对比:从「更强的模型」到「更好的系统」 目录机器人 / 物理 Agent Harness 综合分析与对比:从「更强的模型」到「更好的系统」0x00 概要0x01 面对的难点与核心冲突1.1 核心冲突的一句话版本1.2 深挖:难点的四个层次0x0 阅读全文
posted @ 2026-09-22 20:11 罗西的思考 阅读(143) 评论(0) 推荐(3)
摘要:[Agent Memory / 强化学习] MemPO源码学习笔记 (3) Rollout思路 目录[Agent Memory / 强化学习] MemPO源码学习笔记 (3) Rollout思路0x00 概要0x01 Rollout 主要内容1.1 时间线1.2 纯 RolloutRollout 阶 阅读全文
posted @ 2026-09-17 20:51 罗西的思考 阅读(106) 评论(1) 推荐(1)
摘要:[Agent Memory / 强化学习] MemPO源码学习笔记 (2) 训练 目录[Agent Memory / 强化学习] MemPO源码学习笔记 (2) 训练0x00 概要0x01 原理1.1 为什么MemPO必须用RL而不是SFT?SFT 的劣势RL解决方式MemPO的实际路径小结1.2 阅读全文
posted @ 2026-09-15 20:45 罗西的思考 阅读(46) 评论(0) 推荐(0)
摘要:[Agent Memory / 强化学习] MemPO源码学习笔记 (1) 总体 目录[Agent Memory / 强化学习] MemPO源码学习笔记 (1) 总体0x00 概要0x01 基础 & 背景1.1 用RL训练记忆系统的要点1.2 主要难点1.3 主要思路1.4 RL训练方案1.4.1 阅读全文
posted @ 2026-09-10 21:00 罗西的思考 阅读(173) 评论(0) 推荐(0)
摘要:【OpenClaw具身硬件】ZeroClaw 源码阅读笔记(4) 代码执行 目录【OpenClaw具身硬件】ZeroClaw 源码阅读笔记(4) 代码执行0x00 概要0x01 代码合成1.1 核心思想1.2 业务逻辑具体应用场景能力体现1.3 实现细节生成种类Rust 代码Arduino CLI的 阅读全文
posted @ 2026-09-08 21:17 罗西的思考 阅读(121) 评论(0) 推荐(0)
摘要:【OpenClaw具身硬件】ZeroClaw 源码阅读笔记(3) RAG 目录【OpenClaw具身硬件】ZeroClaw 源码阅读笔记(3) RAG0x00 概要0x01 两套RAG1.1 关键差异1.2 工程取舍0x02 HardwarRag 基础2.1 基本功能2.2 使用原因2.3 具体应用 阅读全文
posted @ 2026-09-02 21:35 罗西的思考 阅读(161) 评论(0) 推荐(0)
摘要:【Agentic RL / 强化学习框架】Molt 设计解读 目录【Agentic RL / 强化学习框架】Molt 设计解读0x00 概要0x01 从 RL 流程到 Molt 代码:一次完整映射1.1 第一层:标准 RL 训练流程1.2 第二层:Molt 模块对应关系1.3 第三层:类定义 + 角 阅读全文
posted @ 2026-08-31 20:55 罗西的思考 阅读(109) 评论(0) 推荐(0)
摘要:【OpenClaw具身硬件】ZeroClaw 源码阅读笔记(2) 机器人 目录【OpenClaw具身硬件】ZeroClaw 源码阅读笔记(2) 机器人0x00 概要0x03 机器人设计理念3.1 愿景3.2 总体特性三层架构模块特点3.3 人格SOUL.mdAIEOS[identity]实现示例3. 阅读全文
posted @ 2026-08-26 22:09 罗西的思考 阅读(172) 评论(0) 推荐(0)
摘要:【OpenClaw具身硬件】ZeroClaw 源码阅读笔记(1) 总体 目录【OpenClaw具身硬件】ZeroClaw 源码阅读笔记(1) 总体0x00 概要0x01 基础知识1.1 主要功能1.2 系统架构1.2.1 层级关系1.2.2 模块图1.2.3 依赖关系1.3 CLI1.4 消息流程1 阅读全文
posted @ 2026-08-25 20:56 罗西的思考 阅读(143) 评论(0) 推荐(1)
摘要:【Agentic RL / 强化学习框架 / VERL】Uni-Agent Gateway 深度解析 目录【Agentic RL / 强化学习框架 / VERL】Uni-Agent Gateway 深度解析0x00 概要0x01. Gateway 是为了解决什么问题?1.1 VERL 原有架构的困境 阅读全文
posted @ 2026-08-24 20:44 罗西的思考 阅读(127) 评论(0) 推荐(0)
摘要:【OpenClaw具身硬件】MiniClaw 阅读笔记 (4) 文件读写 目录【OpenClaw具身硬件】MiniClaw 阅读笔记 (4) 文件读写0x00 概要0x01 Read file & RAG1.1 经典RAG的工作方式1.2 MimiClaw反过来:LLM是检索的发起者1.3 为什么这 阅读全文
posted @ 2026-08-19 21:36 罗西的思考 阅读(106) 评论(0) 推荐(0)
摘要:【OpenClaw具身硬件】MiniClaw 阅读笔记 (3) 接口 & 混合智能 目录【OpenClaw具身硬件】MiniClaw 阅读笔记 (3) 接口 & 混合智能0x00 概要0x01 MimiClaw的感知接口与执行接口分析1.1 接口全景图1.2 设计哲学浓缩1.3 感知接口的两种范式: 阅读全文
posted @ 2026-08-18 21:23 罗西的思考 阅读(118) 评论(0) 推荐(0)
摘要:# 【Agent OS / AIOS】AOHP 深度解读:当 OS 开始为 Agent 而设计 目录0x00 摘要0x01 问题:Agent 为什么在传统 OS 上"水土不服"1.1 传统 OS 的根本假设1.2 Agent 的工作模式与 传统OS 的错配1.3 核心矛盾1.4 设计原则0x02 总 阅读全文
posted @ 2026-08-17 20:44 罗西的思考 阅读(130) 评论(0) 推荐(0)
摘要:【OpenClaw具身硬件】MiniClaw 阅读笔记 (2)钉核 & 上下文 目录【OpenClaw具身硬件】MiniClaw 阅读笔记 (2)钉核 & 上下文0x00 概要0x01 双核配置1.1 ESP32-S3 核1.2 MimiClaw实际的钉核决策1.3 钉核原因引力1:WiFi/lwI 阅读全文
posted @ 2026-08-12 20:42 罗西的思考 阅读(143) 评论(0) 推荐(0)
摘要:【OpenClaw具身硬件】MiniClaw 阅读笔记 (1)基础 目录【OpenClaw具身硬件】MiniClaw 阅读笔记 (1)基础0x00 概要0x01 基本知识1.1 MimiClaw 核心特色1.2 核心定位1.3 应用场景0x02 设计理念2.1 核心设计哲学2.2 设计取舍总结0x0 阅读全文
posted @ 2026-08-11 20:53 罗西的思考 阅读(200) 评论(0) 推荐(0)
摘要:【Agentic RL / 强化学习 / OPD】Hermes & OPD 源码阅读笔记 目录【Agentic RL / 强化学习 / OPD】Hermes & OPD 源码阅读笔记0x00 概要0x01 OPD 机制原理 —— "OPD 是什么,怎么工作"1.1 OPD 的完整数据流1.2 vLL 阅读全文
posted @ 2026-08-10 20:53 罗西的思考 阅读(148) 评论(0) 推荐(0)
摘要:VelesDB 深度解读 —— 融合向量、图与列存的端侧 AI 记忆引擎 目录VelesDB 深度解读 —— 融合向量、图与列存的端侧 AI 记忆引擎0x00 概要:VelesDB 是什么0x01 总论1.1 面对的难点与核心冲突1.2 如何解决这些难点1.3 本项目的特色1.4 三种视角解读给 1 阅读全文
posted @ 2026-08-06 21:14 罗西的思考 阅读(116) 评论(0) 推荐(1)
摘要:【Agentic RL / 强化学习 / OPD】OpenClaw-RL 源码阅读笔记 (16) AReal 目录【Agentic RL / 强化学习 / OPD】OpenClaw-RL 源码阅读笔记 (16) AReal0x00 概要0x01 基础背景1.1 AReaL1.2 工作1.3 训练架构 阅读全文
posted @ 2026-08-04 19:53 罗西的思考 阅读(105) 评论(0) 推荐(0)
摘要:【Agentic RL / 强化学习 / OPD】OpenClaw-RL 源码阅读笔记 (15) Combine模式 目录【Agentic RL / 强化学习 / OPD】OpenClaw-RL 源码阅读笔记 (15) Combine模式0x00 概要0x01 架构1.1 架构:继承而非重写1.2 阅读全文
posted @ 2026-08-03 20:49 罗西的思考 阅读(102) 评论(0) 推荐(0)