Skip to content

#arXiv

152 today
Oct 5Mon
  1. arXiv · Neural and Evolutionary Computing27

    边端 SNN 如何在推理中学习:跨感知模态的局部并行学习

    研究提出双向脉冲蒸馏(BSD),让边端 SNN 在推理过程中持续学习。BSD 耦合刺激驱动的前向网络与目标驱动的反向网络,通过局部目标对齐中间表示,使前向推理、反向推理与分阶段更新并行执行;在 SOUL 五种感知模态的 25 个基准上,平均与匹配 BP 基线相差 3.8 个百分点,部署仅需前向分支,训练延迟降至 BP 的 $0.72\times$、训练能耗降至 $0.36\times$。

  2. arXiv · Audio and Speech18

    评测语义声景分割的推理时算法

    研究构建多通道检测-提取模型,并评测推理时算法以改进多阶段架构中的类别检测与目标声音提取。评估了二元交叉熵与混合一致性两种适应度函数、朴素与条件混淆矩阵重标注两种策略,以及多标签分类器、微调单源分类器和现成音频评判三种源估计评估模型。在 DCASE 2025 Task 4 数据集上验证设计选择影响,并在留出评估集上验证基于熵的推理时更新门控机制。

  3. arXiv · Machine Learning Theory37

    SCOUT:通过分解价值梯度流实现测试时多智能体协同

    论文提出 SCOUT,首个在测试时通过动作精炼将生成式基础模型与学习价值函数结合的离线 MARL 框架。SCOUT 训练流匹配行为先验与分解价值函数两个解耦组件,在测试时用 Stein 变分梯度下降把行为样本输运到高价值区域,输运步数控制自适应测试时缩放。论文在 IGM 原则下证明联合软价值差的单一项 KL 界,并在离散与连续离线 MARL 基准上取得最佳平均性能,在所有离线到在线配置中均有提升。

  4. arXiv · Machine Learning Theory29

    Threshold-Aware Conformal Routing:按阈值感知的保形路由减少仿真调用

    论文提出 Threshold-Aware Conformal Routing(TACR),在标量指标是否越过固定阈值的判定场景中,用保形区间完全落在阈值一侧时采用学习型代理模型、区间与阈值相交时回退全仿真。TACR 通过阈值感知目标学习输入相关尺度,在保持无分布边际覆盖率的同时,在多个科学与工程数据集上将仿真回退减少 14-75%,相比无阈值局部加权的变体进一步减少 10-24%。

  5. arXiv · Machine Learning Theory32

    用加性量化表示做 Bandits

    论文提出将残差量化(RQ)作为表示层,用离线训练的 RQ 码本把连续上下文映射为多层离散质心分配,以严格有界内存实现非线性表达。在 13 个数据集上,RQ 变体在 11 个数据集上胜过非 RQ 对应算法,同时以最高 1000 倍更少内存匹配 doubling-retrain XGBoost 与神经基线。论文已被 NeurIPS 2026 接收。

  6. arXiv · Machine Learning Theory34

    用 Graphons 与神经逆算子构建复杂网络生成模型

    该研究提出一种基于多重分步 graphon 与神经逆算子的生成图模型,在函数空间中同时完成生成建模与参数恢复,可对训练时未见过的图规模进行推理。仅用合成多重分步 graphon 样本训练,模型在零样本图生成基准的四项指标中三项平均表现最佳,优于在真实网络上预训练的图基础模型;在单观测网络与多被试 EEG 案例中,参数恢复效果可比拟逐图优化方法,并对脑状态可逆变化更敏感。

  7. arXiv · Machine Learning Theory30

    用于 Flow-Map 蒸馏的几何感知时间重参数化

    论文提出一种几何感知时间重参数化方法,为 Flow-Map 蒸馏中学生模型分配更多时间以学习教师生成 ODE 中法向加速度较大的轨迹段,同时保留教师几何路径与终端分布。该方法在蒸馏前一次性估计共享时钟,无需重新训练教师模型,也不增加学生参数或推理时的网络评估开销。在合成数据、CIFAR-10 和 CelebA-64 上,该方法在相同推理预算下优于恒等时间蒸馏,包括一步和两步图像生成质量提升。

  8. arXiv · Machine Learning Theory41

    VisAudit:评测多模态智能体的视觉诊断与修复能力

    VisAudit 是一个评测可视化诊断、修复与验证的基准,覆盖 21 种图表类型、10 类缺陷,含 1,900 个有缺陷实例和 300 个初始正确图表,并设诊断修复、自主修复与开放世界验证三条赛道。基准通过受控扰动构建,注入缺陷可定义且可恢复。实验显示,最强评测模型在自主修复设定下仅完全恢复 47.4% 的有缺陷图表。

  9. arXiv · Machine Learning Theory26

    Co-design Gym:面向具身与策略协同优化的统一基准

    研究者推出 Co-design Gym,一个用于联合优化智能体具身(设计)与策略的基准环境套件。套件覆盖机器人操作与运动、多机器人协作、可变形与柔性动力学、电子游戏、电网、无线网络、F1 赛车、多智能体仓库与最优控制等领域,共 20 个环境族、85 个以上协同设计预设。论文还对代表性协同设计算法做了系统评测,刻画当前 SOTA 水平。

  10. arXiv · Computers and Society46

    异构 AI 模型之间的同伴影响研究

    研究以单次异议交流后决策的概率偏移衡量说服力,在三项语言理解任务上测试七个开源模型,发现模型意见不合时接收方常放弃原有判断。独立确定性与模型规模都无法可靠预测说服动态,小模型可与大模型同样有说服力并同样抗影响,偏移大小更多取决于听者易受影响程度。说服模式因具体模型配对而异,交互模型的行为必须在其组合中评估。

  11. arXiv · Computers and Society24

    ChatGPT 时代的社交机器人检测:挑战与机遇

    文章综述 ChatGPT 等高级 AI 聊天机器人兴起背景下社交机器人检测的挑战与机遇,梳理现有技术与真实应用,指出 AI 生成对话与行为带来的独特难题。研究提出四个方向:用生成式智能体做合成数据生成、测试与评估;基于网络与行为特征的多模态跨平台检测;扩展到非英语与低资源语言;发展协作式联邦学习检测模型以在保护用户隐私的同时促进机构与平台合作。

  12. arXiv · Robotics48

    KungfuAthleteBot:从视频学习高动态人形运动并实现统一鲁棒恢复

    KungfuAthleteBot(KAB)提出从视频学习高动态人形运动的框架,依次解决视频运动物理不一致、无驱动信息、缺失败恢复数据三类问题。框架构建 KungfuAthlete 数据集,引入物理引导抛物线轨迹校正与物理驱动伪低动能(LKE)采样,并在同一策略内学习扰动抑制与跌倒恢复。在人形机器人上,KAB 可从任意跌倒约 0.7 s 恢复,为统一策略下已报道最快恢复速度。

  13. arXiv · Robotics36

    超越奖励黑客:分阶段人形机器人学习流水线四层代理偏差

    论文提出,分阶段人形机器人 RL 流水线中奖励、课程门、评测统计与参考动作四类代理各有偏差机制,并给出对应重构方案,包括一阶 L1 代价、峰值与结果统计、门可达性与信息检查、确定性且相位去同步评测、课程状态纳入模型、可行性优先参考设计与残差前馈、以及函数保持输入扩展。

  14. arXiv · Robotics27

    GeoScaffold:通过重建学习紧凑几何潜变量,提升视觉语言导航效率

    GeoScaffold 是一种几何监督框架,把深度、连通性、可通行性等几何信息在训练时内化到策略中,避免推理时依赖深度传感器、3D 编码器或逐步感知工具调用。它先学习并冻结一个紧凑深度 tokenizer,再用少量可学习几何 query token 的隐藏状态重建导航关键几何,训练后 tokenizer、目标生成器和重建头全部丢弃,仅保留主干与动作接口。

  15. arXiv · Robotics17

    MoRoOp:AMR 物流作业、调度事件与机器人状态数据集

    研究者发布 MoRoOp 数据集,记录自主移动机器人(AMR)在实验室套件准备与供应场景中九个八小时班次的作业与运行状态。数据集包含 1,382 个作业、4,815 个操作、19,352 条调度事件和 140,386 条机器人状态观测,并保留延迟、导航受阻与失败操作等有效观测。可用于评估 AI 智能体的运营决策记录、扰动检测、操作预测、数据驱动仿真与事件日志分析。