arXiv · Robotics· Weizhe Xu, Jialiang Fan, Mengyu Liu, Fanxin Kong·· 4 hr agoAI score36
SafeInferCom:面向机器人任务规划的验证器引导生成中干预式安全推理计算
SafeInferCom: Safe Inference-Time Compute via Verifier-Guided Mid-Generation Intervention for Robotic Task Planning
AI brief
SafeInferCom 是一个面向机器人任务规划的推理时框架,通过不干扰原始解码轨迹的监控器暴露并验证中间计划,保留有效中间结果并在生成过程中引导纠错。实验在多个大型推理语言模型与规划域上显示其相比一次性推理提升规划成功率、加速纠错,并与迭代精炼结合时在提高成功率的同时降低 token 用量。研究还在 VirtualHome 中评估并在真实机械臂上完成演示。
Source: arXiv · Robotics · arxiv.org