摘要: 具身智能中的视觉-语言-动作模型 1.VLA模型的发展历程+技术突破+主流模型对比 2.具身智能VLA模型关键技术 3.未来:泛化能力提升/人机交互增强/实际应用拓展 2 视觉多模态技术核心 1.视觉多模态的定义与应用场景 2.融合方法分类及实现逻辑与适用场景 3.KITTI、Waymo、Multi 阅读全文
posted @ 2026-01-20 09:37 txwtech 阅读(54) 评论(4) 推荐(0)