[置顶] OpenClaw imageModel 配置指南

摘要: imageModel 是 OpenClaw 中专门用于视觉理解的模型配置,独立于主对话模型(model)。当对话涉及图片或视觉内容时,OpenClaw 会自动切换到 imageModel 指定的模型来处理。 阅读全文
posted @ 2026-03-08 11:08 见路非道 阅读(5170) 评论(0) 推荐(0)

[置顶] 基于 A2A 协议的 LlamaIndex 文件聊天工作流

摘要: 基于 A2A 协议的 LlamaIndex 文件聊天工作流 使用 LlamaIndex Workflows 和 A2A 协议构建文件聊天代理的综合指南。包括文件上传和解析、多轮对话、实时流式传输、内联引用、LlamaParse 和 OpenRouter 集成以及 webhook 通知系统的详细实现。非常适合希望构建高级对话式 AI 代理服务的开发者。 阅读全文
posted @ 2025-06-03 08:54 见路非道 阅读(451) 评论(0) 推荐(0)

理解 Prism:面向视频与音频生成的动态稀疏注意力

摘要: Prism 是一种动态稀疏注意力框架,用于高分辨率联合视频与音频生成模型的训练。它会根据视频内容和声音关联程度调整注意力范围,减少不必要的计算。 高分辨率视频包含大量画面片段。若每个片段都与所有其他片段计算注意力,计算量会很快变大。再加上音频,模型还要找出声音对应哪些画面区域。 本文结合 Huggi 阅读全文
posted @ 2026-10-06 17:13 见路非道 阅读(8) 评论(0) 推荐(0)

理解 OpenAI Decisions API:它与 Jev 有什么不同,如何上手

摘要: 理解 OpenAI Decisions API:它与 Jev 有什么不同,如何上手 OpenAI Decisions API 是一个用于有限选项决策的限量预览 API。开发者提供上下文,定义问题和候选答案,模型直接返回决策,供程序继续处理。 很多软件流程并不需要模型再写一段解释。客服系统需要一个负责团队,Agent 需要下一步工具,工作流需要一个风险等级。决策接口的目标,就是直接给 阅读全文
posted @ 2026-09-30 10:15 见路非道 阅读(321) 评论(0) 推荐(0)

理解 Qwen Image 2.1 GGUF:本地运行、量化选择与组件说明

摘要: Qwen Image 2.1 是一款支持文生图和图像编辑的模型。GGUF 版本是社区将其生成权重转换后的量化文件,可供兼容的本地推理工具加载。 只下载一个 GGUF 文件还不能开始生成。完整流程还需要推理运行时、文本编码器,以及负责把图像表示解码成像素的 VAE。 本文说明 GGUF 改变了什么、怎 阅读全文
posted @ 2026-09-29 10:59 见路非道 阅读(135) 评论(0) 推荐(0)

Laya Model 是什么?Python 上手与 Jev AI 对比

摘要: 介绍开放权重决策模型 Laya 的模型版本、Python SDK 与自建 HTTP API,并结合公开评测比较 Jev AI 的托管方式。 阅读全文
posted @ 2026-09-24 21:04 见路非道 阅读(127) 评论(0) 推荐(0)

Jev AI Model 是什么?不是聊天、只返回「判断」的决策模型完全指南(2026)

摘要: 核心要点(TL;DR) Jev AI Model 不是聊天机器人,也不生成文本:它是「决策模型」——你传入一个状态(工单、消息、JSON 对象)加若干类型化问题,它返回带概率的结构化答案,代码可以直接拿去做分支判断,完全不需要解析自然语言。 三种问题类型覆盖了软件决策层的大部分场景:Choice(分 阅读全文
posted @ 2026-09-23 17:47 见路非道 阅读(94) 评论(0) 推荐(0)

2026年完整指南:什么是 Jev?TypeSafe「系统一模型」如何让 AI 决策快 200 倍、便宜 400 倍

摘要: 核心要点 (TL;DR) Jev 不是聊天模型,不生成文本:它是 TypeSafe AI 推出的首个「系统一模型」(System One Model),输入一个 state(状态数据)+ 一组类型化问题,直接输出带校准概率的结构化决策,软件可以拿来就用。 官方基准:快两个数量级、便宜两个数量级——在 阅读全文
posted @ 2026-09-19 22:13 见路非道 阅读(14814) 评论(0) 推荐(0)

Lumera 深度解读(2026):从一张图片到 Blender 可编辑 3D 场景——image to 3d 与 image to blender 全解析

摘要: 你只要给它一张照片,它就还你一个可以在 Blender 里打开的场景:可以单独选中、移动的物体实例,可以在属性面板里调颜色和强度的参数化灯光,还有一盏全局 HDR 环境光——不是烘焙好的网格,不是一段视频,而是真正可编辑的 3D 场景。这就是 Lumera 的承诺。Lumera(Engine-Nat 阅读全文
posted @ 2026-08-31 09:14 见路非道 阅读(70) 评论(0) 推荐(0)

Qwen3.8-Flash-Next(2026):Qwen Qwen4 预览版架构模型完整指南

摘要: Qwen3.8-Flash-Next(2026):Qwen Qwen4 预览版架构模型完整指南 核心要点 (TL;DR) Qwen3.8-Flash-Next 是阿里 Qwen 开源的支撑 Qwen4 的架构预览版——一个 125B 参数的 MoE 模型,每次 token 只激活6B 参数(外加 5 阅读全文
posted @ 2026-08-26 22:10 见路非道 阅读(712) 评论(0) 推荐(0)

Qwen3.8-27B(2026):Qwen 新 27B 视觉语言模型完整指南

摘要: Qwen3.8-27B(2026):Qwen 新 27B 视觉语言模型完整指南 核心要点 (TL;DR) Qwen3.8-27B 是阿里 Qwen 团队新推出的 270 亿参数稠密模型——原生视觉语言模型,支持图像和视频理解,具备灵活的思考控制,采用 Apache 2.0 开源权重。 最大看点是本地 阅读全文
posted @ 2026-08-15 20:20 见路非道 阅读(12965) 评论(0) 推荐(0)

DeepSeek Harness Agent Loop 2026:驱动每一轮对话的可替换插件内部解析

摘要: DeepSeek Harness Agent Loop 2026:驱动每一轮对话的可替换插件内部解析 核心要点 (TL;DR) DeepSeek Harness agent loop 本身就是一个可替换插件:packages/core/agent-loop 中的 ReactLoopAgent 是默认 阅读全文
posted @ 2026-08-14 19:28 见路非道 阅读(290) 评论(0) 推荐(0)