随笔分类 -  025_机器人

摘要:【OpenClaw具身硬件】ZeroClaw 源码阅读笔记(1) 总体 目录【OpenClaw具身硬件】ZeroClaw 源码阅读笔记(1) 总体0x00 概要0x01 基础知识1.1 主要功能1.2 系统架构1.2.1 层级关系1.2.2 模块图1.2.3 依赖关系1.3 CLI1.4 消息流程1 阅读全文
posted @ 2026-08-25 20:56 罗西的思考 阅读(58) 评论(0) 推荐(1)
摘要:【OpenClaw具身硬件】MiniClaw 阅读笔记 (4) 文件读写 目录【OpenClaw具身硬件】MiniClaw 阅读笔记 (4) 文件读写0x00 概要0x01 Read file & RAG1.1 经典RAG的工作方式1.2 MimiClaw反过来:LLM是检索的发起者1.3 为什么这 阅读全文
posted @ 2026-08-19 21:36 罗西的思考 阅读(93) 评论(0) 推荐(0)
摘要:【OpenClaw具身硬件】MiniClaw 阅读笔记 (3) 接口 & 混合智能 目录【OpenClaw具身硬件】MiniClaw 阅读笔记 (3) 接口 & 混合智能0x00 概要0x01 MimiClaw的感知接口与执行接口分析1.1 接口全景图1.2 设计哲学浓缩1.3 感知接口的两种范式: 阅读全文
posted @ 2026-08-18 21:23 罗西的思考 阅读(95) 评论(0) 推荐(0)
摘要:# 【Agent OS / AIOS】AOHP 深度解读:当 OS 开始为 Agent 而设计 目录0x00 摘要0x01 问题:Agent 为什么在传统 OS 上"水土不服"1.1 传统 OS 的根本假设1.2 Agent 的工作模式与 传统OS 的错配1.3 核心矛盾1.4 设计原则0x02 总 阅读全文
posted @ 2026-08-17 20:44 罗西的思考 阅读(77) 评论(0) 推荐(0)
摘要:【OpenClaw具身硬件】MiniClaw 阅读笔记 (2)钉核 & 上下文 目录【OpenClaw具身硬件】MiniClaw 阅读笔记 (2)钉核 & 上下文0x00 概要0x01 双核配置1.1 ESP32-S3 核1.2 MimiClaw实际的钉核决策1.3 钉核原因引力1:WiFi/lwI 阅读全文
posted @ 2026-08-12 20:42 罗西的思考 阅读(110) 评论(0) 推荐(0)
摘要:【OpenClaw具身硬件】MiniClaw 阅读笔记 (1)基础 目录【OpenClaw具身硬件】MiniClaw 阅读笔记 (1)基础0x00 概要0x01 基本知识1.1 MimiClaw 核心特色1.2 核心定位1.3 应用场景0x02 设计理念2.1 核心设计哲学2.2 设计取舍总结0x0 阅读全文
posted @ 2026-08-11 20:53 罗西的思考 阅读(171) 评论(0) 推荐(0)
摘要:VelesDB 深度解读 —— 融合向量、图与列存的端侧 AI 记忆引擎 目录VelesDB 深度解读 —— 融合向量、图与列存的端侧 AI 记忆引擎0x00 概要:VelesDB 是什么0x01 总论1.1 面对的难点与核心冲突1.2 如何解决这些难点1.3 本项目的特色1.4 三种视角解读给 1 阅读全文
posted @ 2026-08-06 21:14 罗西的思考 阅读(97) 评论(0) 推荐(1)
摘要:【Agentic RL / 强化学习 / OPD】OpenClaw-RL 源码阅读笔记 (11) 算法总体实现 目录【Agentic RL / 强化学习 / OPD】OpenClaw-RL 源码阅读笔记 (11) 算法总体实现0x00 概要0x01 基础背景1.1 架构1.2 算法三种训练方法核心设 阅读全文
posted @ 2026-07-23 20:48 罗西的思考 阅读(112) 评论(0) 推荐(0)
摘要:【Agentic RL / 强化学习 / OPD】OpenClaw-RL 源码阅读笔记 (9) Reward Judging 目录【Agentic RL / 强化学习 / OPD】OpenClaw-RL 源码阅读笔记 (9) Reward Judging0x00 概要0x01 Reward 基础1. 阅读全文
posted @ 2026-07-20 20:35 罗西的思考 阅读(88) 评论(0) 推荐(0)
摘要:【Agentic RL / 强化学习 / OPD】OpenClaw-RL 源码阅读笔记 (7) Policy Serving 目录【Agentic RL / 强化学习 / OPD】OpenClaw-RL 源码阅读笔记 (7) Policy Serving0x00 概要0x01 基础1.1 架构1.2 阅读全文
posted @ 2026-07-14 20:19 罗西的思考 阅读(91) 评论(0) 推荐(0)
摘要:【机器人 / 强化学习】QAM 与 DIVL:评价-执行闭环的完美配合 目录【机器人 / 强化学习】QAM 与 DIVL:评价-执行闭环的完美配合0x00 概要0x01 为什么需要两个算法?1.1 先想清楚要解决什么问题1.2 闭环总览1.3 三阶段逻辑链条0x02 LWD 论文算法2.1 算法图例 阅读全文
posted @ 2026-07-13 20:28 罗西的思考 阅读(95) 评论(0) 推荐(0)
摘要:【机器人 / 强化学习】QAM:基于伴随匹配的 Q-learning 流策略优化 目录【机器人 / 强化学习】QAM:基于伴随匹配的 Q-learning 流策略优化0x00 概要1.1 核心问题:Flow 策略的优化困境1.1 为什么 Flow 策略难以用 RL 优化?1.2 三种候选方案0x02 阅读全文
posted @ 2026-07-11 19:06 罗西的思考 阅读(115) 评论(0) 推荐(0)
摘要:【机器人 / 强化学习】DIVL:分布隐式价值学习 目录【机器人 / 强化学习】DIVL:分布隐式价值学习0x00 概要0x01 从 IQL 到 DIVL:为什么标量不够用?1.1 IQL 的遗产:在已知数据中"沙里淘金"1.2 为什么平均数会骗人?1.3 从"给平均分"到"看清各种可能性"0x02 阅读全文
posted @ 2026-07-09 19:30 罗西的思考 阅读(97) 评论(0) 推荐(1)
摘要:【机器人 / 强化学习】IQL(Implicit Q-Learning):离线强化学习的隐式价值提取 目录【机器人 / 强化学习】IQL(Implicit Q-Learning):离线强化学习的隐式价值提取0x00 概要1.1 核心哲学:在已知数据中"沙里淘金"1.1 离线学习的"贪婪陷阱"1.2 阅读全文
posted @ 2026-07-07 19:27 罗西的思考 阅读(135) 评论(0) 推荐(0)
摘要:【机器人 / 强化学习】LWD(Learning while Deploying)机器人持续进化的强化学习框架 目录【机器人 / 强化学习】LWD(Learning while Deploying)机器人持续进化的强化学习框架0x00 概要0x01 背景:为什么需要 LWD?1.1 真实世界不是一个 阅读全文
posted @ 2026-07-06 19:35 罗西的思考 阅读(116) 评论(0) 推荐(0)
摘要:【机器人 / 强化学习】HIL-SERL 工程篇:人类在环的工程架构与物理设计 目录【机器人 / 强化学习】HIL-SERL 工程篇:人类在环的工程架构与物理设计0x00 概要0x01 系统架构总览1.1 逻辑架构1.2 物理拓扑1.3 部署拓扑与启动顺序1.4 独立运行的组件清单1.5 单步交互时 阅读全文
posted @ 2026-07-03 20:09 罗西的思考 阅读(155) 评论(1) 推荐(0)
摘要:【机器人 / 强化学习】HIL-SERL 算法篇:HG-DAgger 与 RLPD —— 从模仿到超越的训练双阶段 目录【机器人 / 强化学习】HIL-SERL 算法篇:HG-DAgger 与 RLPD —— 从模仿到超越的训练双阶段0x00 概要0x01 HG-DAgger 的核心思想:人类门控的 阅读全文
posted @ 2026-07-01 20:14 罗西的思考 阅读(253) 评论(0) 推荐(0)
摘要:【机器人 / 强化学习】HIL-SERL 算法篇:DQN + SAC 混合架构的实现哲学 目录【机器人 / 强化学习】HIL-SERL 算法篇:DQN + SAC 混合架构的实现哲学0x00 概要0x01 HIL-SERL 的总体算法思路1.1 HIL-SERL 的算法基因图谱1.2 三类预训练/先 阅读全文
posted @ 2026-06-30 19:57 罗西的思考 阅读(138) 评论(0) 推荐(0)
摘要:【机器人 / 强化学习】HIL-SERL:人类在环驱动的具身智能进化框架 目录【机器人 / 强化学习】HIL-SERL:人类在环驱动的具身智能进化框架0x00 概要0x01 真机 RL 的"最后一公里"1.1 为什么需要人类在环?1.2 HIL-SERL 的解决方案:四条腿的凳子1.3 论文的核心成 阅读全文
posted @ 2026-06-29 20:09 罗西的思考 阅读(177) 评论(0) 推荐(0)
摘要:【机器人 / 强化学习】SERL:让真机强化学习从“难用”走向“可复现”的强化学习框架 (5)工程篇 目录【机器人 / 强化学习】SERL:让真机强化学习从“难用”走向“可复现”的强化学习框架 (5)工程篇0x00 概要0x01 SERL 要解决什么核心问题?0x02 系统架构:三层解耦的通用适配器 阅读全文
posted @ 2026-06-28 10:22 罗西的思考 阅读(128) 评论(2) 推荐(0)