Page 2 - Showing 10 of 51 posts View all posts →
- AuraVLA VLM 任务契约:把自然语言输出限制在可执行边界
从 JSON Schema、动作去重、运动指令禁用字段到 VLM 失败重试,拆解 AuraVLA 的任务规划安全边界。
2 min read - ACT 双臂操作的数据闭环:从 Expert 可达性到 16 维训练契约
将双臂 Expert 的可达性、接触几何和放置一致性,与 ACT 的状态动作和多相机数据契约统一到同一条可审计链路。
3 min read - AuraVLA 轨迹规划实践:稀疏关键姿态与抓取姿态保持
解析 AuraVLA 的 SparseKeyposeDiffuser、minimum-jerk 采样、双臂同步和固定抓取姿态策略。
2 min read - AuraVLA 闭环架构:让 VLM 只决定任务,让确定性模块负责执行
基于 AuraVLA 的 ROS 2 模块划分、语义任务契约、Isaac Sim 执行桥接和几何验收,分析一个可审计的视觉语言机器人闭环应该如何落地。
2 min read - Paper Reading: Embodied AI 2 - 具身推理、跨本体预训练与生成式控制
以 ECoT、RoboPoint、GR-1、HPT、GR-2 和 GR00T N1 为案例,追踪具身中间表示如何连接推理、视频先验与实时控制。
5 min read - Paper Reading: VLA / VLM 2 - 潜动作、分层推理与高效策略
围绕数据利用率、策略分层与在线延迟,评估 UniVLA、GraspVLA、A0、OneTwoVLA、Magma、CoT-VLA、Interleave-VLA 和 SmolVLA。
6 min read - Paper Reading: Embodied AI 1 - 主流模型与具身学习架构
聚焦具身智能中高影响力和高热度的代表论文,覆盖模仿学习、VLA、语言规划、空间推理、大规模数据、生成式策略与抓取感知。
13 min read - RCIA-vision 全景:一套 RoboMaster 自瞄系统的三年
从相机出图到扣下扳机,再到 UE5 虚实闭环——RCIA-vision 十个 ROS2 包的分工、关键设计取舍与量化结果,兼作全系列文章的索引。
5 min read - 低延迟标记配准:让实体与虚拟场景对齐到同一个原点
跨场景坐标对齐的三段变换链、用装甲板本身当配准标记的思路,以及为什么配准误差必须和同步延迟一起看。
4 min read - VLM 机器人代理审计:语义权限、JSON 契约与有界重规划
结合现有 Planner-Executor-Checker 实现,分析 VLM 在机器人系统中应该拥有什么权限,以及结构化输出、场景 grounding 和重规划怎样形成可验证闭环。
3 min read