随笔分类 - 020_Agent
摘要:【OpenClaw具身硬件】ZeroClaw 源码阅读笔记(1) 总体 目录【OpenClaw具身硬件】ZeroClaw 源码阅读笔记(1) 总体0x00 概要0x01 基础知识1.1 主要功能1.2 系统架构1.2.1 层级关系1.2.2 模块图1.2.3 依赖关系1.3 CLI1.4 消息流程1
阅读全文
摘要:【Agentic RL / 强化学习框架 / VERL】Uni-Agent Gateway 深度解析 目录【Agentic RL / 强化学习框架 / VERL】Uni-Agent Gateway 深度解析0x00 概要0x01. Gateway 是为了解决什么问题?1.1 VERL 原有架构的困境
阅读全文
摘要:【OpenClaw具身硬件】MiniClaw 阅读笔记 (4) 文件读写 目录【OpenClaw具身硬件】MiniClaw 阅读笔记 (4) 文件读写0x00 概要0x01 Read file & RAG1.1 经典RAG的工作方式1.2 MimiClaw反过来:LLM是检索的发起者1.3 为什么这
阅读全文
摘要:【OpenClaw具身硬件】MiniClaw 阅读笔记 (3) 接口 & 混合智能 目录【OpenClaw具身硬件】MiniClaw 阅读笔记 (3) 接口 & 混合智能0x00 概要0x01 MimiClaw的感知接口与执行接口分析1.1 接口全景图1.2 设计哲学浓缩1.3 感知接口的两种范式:
阅读全文
摘要:# 【Agent OS / AIOS】AOHP 深度解读:当 OS 开始为 Agent 而设计 目录0x00 摘要0x01 问题:Agent 为什么在传统 OS 上"水土不服"1.1 传统 OS 的根本假设1.2 Agent 的工作模式与 传统OS 的错配1.3 核心矛盾1.4 设计原则0x02 总
阅读全文
摘要:【OpenClaw具身硬件】MiniClaw 阅读笔记 (2)钉核 & 上下文 目录【OpenClaw具身硬件】MiniClaw 阅读笔记 (2)钉核 & 上下文0x00 概要0x01 双核配置1.1 ESP32-S3 核1.2 MimiClaw实际的钉核决策1.3 钉核原因引力1:WiFi/lwI
阅读全文
摘要:【OpenClaw具身硬件】MiniClaw 阅读笔记 (1)基础 目录【OpenClaw具身硬件】MiniClaw 阅读笔记 (1)基础0x00 概要0x01 基本知识1.1 MimiClaw 核心特色1.2 核心定位1.3 应用场景0x02 设计理念2.1 核心设计哲学2.2 设计取舍总结0x0
阅读全文
摘要:【Agentic RL / 强化学习 / OPD】Hermes & OPD 源码阅读笔记 目录【Agentic RL / 强化学习 / OPD】Hermes & OPD 源码阅读笔记0x00 概要0x01 OPD 机制原理 —— "OPD 是什么,怎么工作"1.1 OPD 的完整数据流1.2 vLL
阅读全文
摘要:VelesDB 深度解读 —— 融合向量、图与列存的端侧 AI 记忆引擎 目录VelesDB 深度解读 —— 融合向量、图与列存的端侧 AI 记忆引擎0x00 概要:VelesDB 是什么0x01 总论1.1 面对的难点与核心冲突1.2 如何解决这些难点1.3 本项目的特色1.4 三种视角解读给 1
阅读全文
摘要:【Agentic RL / 强化学习 / OPD】OpenClaw-RL 源码阅读笔记 (16) AReal 目录【Agentic RL / 强化学习 / OPD】OpenClaw-RL 源码阅读笔记 (16) AReal0x00 概要0x01 基础背景1.1 AReaL1.2 工作1.3 训练架构
阅读全文
摘要:【Agentic RL / 强化学习 / OPD】OpenClaw-RL 源码阅读笔记 (15) Combine模式 目录【Agentic RL / 强化学习 / OPD】OpenClaw-RL 源码阅读笔记 (15) Combine模式0x00 概要0x01 架构1.1 架构:继承而非重写1.2
阅读全文
摘要:【Agentic RL / 强化学习 / OPD】OpenClaw-RL 源码阅读笔记 (14) Teacher 目录【Agentic RL / 强化学习 / OPD】OpenClaw-RL 源码阅读笔记 (14) Teacher0x00 概要0x01 基础背景1.1 完整数据流1.2 关键点公式代
阅读全文
摘要:【Agentic RL / 强化学习 / OPD】OpenClaw-RL 源码阅读笔记 (13) OPD实现 目录【Agentic RL / 强化学习 / OPD】OpenClaw-RL 源码阅读笔记 (13) OPD实现0x00 概要0x01 基础背景1.1 通俗讲解1.2 数学形式1.3 OPD
阅读全文
摘要:【Agentic RL / 强化学习 / OPD】OpenClaw-RL 源码阅读笔记 (12) GRPO 目录【Agentic RL / 强化学习 / OPD】OpenClaw-RL 源码阅读笔记 (12) GRPO0x00 概要0x01 GRPO基础1.1 GRPO 解读PPOGRPOGroup
阅读全文
摘要:【Agentic RL / 强化学习 / OPD】OpenClaw-RL 源码阅读笔记 (10) PRM 目录【Agentic RL / 强化学习 / OPD】OpenClaw-RL 源码阅读笔记 (10) PRM0x00 概要0x01 基础知识1.1 PRM如何解决Agentic RL的稀疏梯度问
阅读全文
摘要:【Agentic RL / 强化学习 / OPD】OpenClaw-RL 源码阅读笔记 (8) Environment 目录【Agentic RL / 强化学习 / OPD】OpenClaw-RL 源码阅读笔记 (8) Environment0x00 概要0x01 环境建模基础1.1 标准 RL 系
阅读全文
摘要:【Agentic RL / 强化学习 / OPD】OpenClaw-RL 源码阅读笔记 (6) Rollout 目录【Agentic RL / 强化学习 / OPD】OpenClaw-RL 源码阅读笔记 (6) Rollout0x00 概要0x01 Rollout基础1.1 概念1.1.1 标准 R
阅读全文
摘要:【Agentic RL / 强化学习框架】Miles 项目技术分析 (2) 关键技术 目录【Agentic RL / 强化学习框架】Miles 项目技术分析 (2) 关键技术0x00 概要0x01 agentic_tool_call1.1 问题1.2 解决方案1.3 框架自动化的主要流水线1.4 深
阅读全文
摘要:【Agentic RL / 强化学习框架】Miles 项目技术分析 (1) 总体 目录【Agentic RL / 强化学习框架】Miles 项目技术分析 (1) 总体0x00 概要0x01 基础1.1 Agentic RL 的需求与难点1.1.1 传统 RLHF vs Agentic RL 范式对比
阅读全文
摘要:【强化学习框架】Uni-Agent 深度技术分析(2) 关键技术 目录【强化学习框架】Uni-Agent 深度技术分析(2) 关键技术0x00 概要0x01 修改扩展点1.1 verl 扩展点全景1.2 关键扩展点详解E1: AgentLoopBase——继承契约E3: 注册机制——外部注入 vs
阅读全文
浙公网安备 33010602011771号