跳到正文

#论文/研究

今日 43 条
今天9月30日周三
9月29日周二
  1. Hugging Face Blog51

    ProvenanceGuard:面向 MCP Agent 的来源感知事实核查

    Multiverse Computing 提出 ProvenanceGuard,在 MCP agent 回答后逐条核查 claim 与来源是否匹配,而非把所有证据混合后判断。测试中它从 139 条应被拦截的 claim 中拦下 138 条,并对来源识别正确的比例约 86%。该方法可对接 RARR 修复循环,在本地配置下每条回答约增加半秒开销。

  2. The Decoder74

    Atria Dawn Preview 研究:AI 在模型开发中承担更多工作,但人类仍做关键决策

    Atria 团队发布基于 7440 亿参数 MoE 架构的 Atria Dawn Preview,在 16 项基准中 5 项领先,整体仍落后于竞争对手。AI 参与了 96.5% 的任务,但人类在方法与参数决策中占比 85.5%,在目标与范围决策中占比 93.4%。约三分之一的任务若无 AI 将无法完成,且人类干预多以补充上下文和诊断问题为主,而非亲自执行。

  3. MIT News · AI39

    算法单一文化的影响取决于具体细节

    MIT研究者系统评估了算法单一文化的主要质疑,发现系统排斥等论点并不成立,并证明单一文化会形成信息回声室、抑制探索。在招聘场景中,将多种算法捆绑成集成模型可克服此局限,有时表现甚至优于多元算法环境。

  4. Nature · Machine Learning62

    AI 可拓宽科学——但前提是机构停止奖励已可衡量的成果

    Nature 评论指出,AI 使学者论文产出约为同行 3 倍、引用近 5 倍,但 AI 辅助研究覆盖的主题范围比非 AI 研究少 4.6%,70% 以上子领域均如此。问题不在技术,而在制度:现有激励让研究者集中于机构易评估的问题,而非开辟新方向。文中建议资助方补贴数据基础设施建设,并停止惩罚利用 AI 跨领域转型的研究者。

    推荐理由:AI 提升个体产出却收窄探索范围,制度激励不匹配是根因,呼吁资助方补贴数据基础设施并停止惩罚跨领域转型。

  5. Apple Machine Learning Research62

    通信瓶颈:语言模型中树结构表达式序列化的往返研究

    Apple ML 团队提出往返协议评估 16 个模型对树结构算术表达式的序列化与恢复,发现通道失真且不对称,最佳模型对组合可达 92.9%,约 73.6% 失败源自生成端,结构难度主导而非模型族,约 3600 条微调样本即可让开放权重模型超越未训练 Gemini-3.1-Pro。

    推荐理由:通过生成与提取的往返协议揭示模型间序列化树结构的失真瓶颈,为改进模型通信提供可量化依据。

9月28日周一
  1. MIT News · AI66

    MIT新配方帮助RNA疫苗耐高温

    MIT研究人员借助AI算法优化脂质纳米颗粒辅料,使RNA疫苗在室温下可稳定保存一年,或在约37°C下稳定保存两个月。新冠mRNA疫苗在小鼠中产生的免疫应答与Moderna疫苗相当,且该方法同样适用于Pfizer配方和微针贴片递送。

    推荐理由:AI算法用极少实验预测最佳辅料比例,显著加速了耐热RNA疫苗配方筛选。

9月26日周六
9月25日周五
  1. Amazon Science60

    Reactor 与 Amazon Neuron Science 合作实现 Trainium 上的实时视频生成

    Reactor 与 Amazon Neuron Science 团队合作,在 Trainium 上实现了基于 Rolling Forcing 的实时视频生成。团队采用以 NKI 为中心的底层优化,将 3D-RoPE 从 5 秒降至 1.8 毫秒,缓存拷贝从 23 毫秒降至 1.9 毫秒,并采用混合分片策略与模型代码合并,使管道仅用 11 GB 高带宽内存即达成 16 fps 以上的实时生成。

    推荐理由:原文给出了具体优化路径与实测数据,读者可据此判断 Trainium 在实时视频生成上的可行性边界。

  2. ScienceDaily · AI74

    量子计算“非阿贝尔任意子”实现通用门集

    芝加哥大学、哈佛、Stony Brook 和 Quantinuum 团队在 Quantinuum H2 离子阱处理器上,用 54 个纠缠量子比特实现 S3 对称性下的非阿贝尔任意子,并结合编织与融合操作首次演示通用门集。研究显示该方法原则上可无需魔法态蒸馏即可完成容错计算,但尚未加入主动纠错。

  3. Nature · Machine Learning67

    Anthropic AI 生物实验室在病毒中发现类 CRISPR DNA,后续如何发展

    Anthropic 发布预印本,称其 AI 代理在巨型病毒基因组中发现了类似 CRISPR 系统的重复 DNA 序列。实验调用约 950 个 AI 代理自主探索数十亿蛋白质,耗时逾 21 小时,但目前尚未确定这些序列的功能,也未发现配套的 DNA 切割酶。

    推荐理由:AI 代理在基因组数据中发现类 CRISPR 重复序列,展示了自动化挖掘分子工具的潜力,但功能尚未验证。

  4. MIT News · AI62

    MIT McGovern 团队基于文本估计自杀风险

    MIT McGovern Institute 团队在 Journal of Psychopathology and Clinical Science 报告了一种基于自定义自杀风险词典与机器学习模型的文本风险评估工具。

    推荐理由:基于危机文本训练的轻量可解释模型,为高风险信号识别提供了可审计的替代方案。

  5. Google Research60

    Google Research 推出自动化一致长形式视频生成框架

    Google Research 推出 Co-Director、CANVAS、A²RD 和 VQQA 等框架,自动化长形式视频生成,缓解语义漂移并提升多镜头叙事一致性。

    推荐理由:Google Research 推出 Co-Director、CANVAS、A²RD 和 VQQA 等多代理框架,自动化一致的长形式视频生成,有效缓解语义漂移和特征漂移,提升多镜头叙事一致性。

9月24日周四
  1. Nature · Machine Learning41

    ResolVI:解决空间转录组学中的噪声与偏差问题

    summary_zh: ResolVI 是一个基于自动编码变分贝叶斯的概率框架,用于校正空间转录组数据中的分割与量化误差。它将观测计数建模为真实表达、邻近细胞扩散信号和背景噪声三部分,使用负二项分布和泊松分布分别建模,并通过高斯混合分布表示细胞状态的不确定性。

  2. Apple Machine Learning Research28

    Apple 压缩流式神经音频编码器:基于潜在空间蒸馏的端侧语音分词器方案

    Apple 研究提出通过潜在空间蒸馏压缩流式神经音频编码器,以预量化潜在表示作为监督目标,仅训练学生编码器回归教师逐帧潜在值。2.8× 压缩下,蒸馏学生在五个教师-学生对上相对 WER 保持在 1.9% 以内,且同等容量独立训练分词器提升 3.9%。该方案覆盖两种分词接口,无需微调。

  3. Nature · Machine Learning35

    DR-GEM 实现单细胞嵌入与注释的自监督机器学习

    DR-GEM 是一种自监督元算法,通过重构误差重新引导模型关注初始遗漏的模式,并利用平衡共识学习提升鲁棒性、过滤低质量数据。在合成与真实单细胞、空间转录组和 Perturb-seq 数据集上,DR-GEM 在获取可靠嵌入、恢复稀有细胞类型、过滤噪声、缓解细胞与患者层面代表性不足以及发现未见的遗传和空间特征方面优于现有方法。

  4. Apple Machine Learning Research34

    半监督联邦 ASR 的实用方案:在线伪标签与服务器更新稳定化

    Apple Machine Learning Research 提出半监督联邦 ASR 方案,通过在线伪标签与服务器端标注数据更新稳定化缩小与全监督联邦学习的差距。在 11 组对比中 9 组超越最强先验方法,域内平均提升 20.8%、跨域 10.0%。教师模型与锚定更新两条轴线相互耦合,锚定更新对数据增强和批量大小高度敏感。

9月23日周三
9月22日周二
  1. ScienceDaily · AI62

    MIT微型飞行机器人借助AI提速450%

    MIT研究人员开发了一种两阶段AI控制器,让昆虫级飞行机器人速度提升约447%、加速度提升约255%,并能在11秒内完成10个连续空翻,同时保持约4-5厘米的路径偏差。该控制器结合模型预测规划与深度学习策略,通过模仿学习实现实时决策,研究已发表于Science Advances。

  2. Nature · Machine Learning25

    大语言模型时代的研究可复现性

    summary_zh: 大语言模型的输出具有概率性,相同提示词可能产生不同结果,且模型权重与训练数据不公开,导致基于旧版闭源模型的研究难以精确复现。文章建议研究者记录所用模型与版本、完整提示词、硬件与软件配置及超参数等细节,并优先测试开源模型,以提升透明度与可复现性。

  3. Amazon Science62

    Amazon Bio Discovery推进AI生物学:训练模型设计并表征抗体

    Amazon Bio Discovery团队发表三篇论文,分别提出MochiBind结合力预测、CA-MAP可开发性预测和基于智能体的纳米抗体设计流程。MochiBind在跨抗原验证中比结构基线平均提升近10%配对准确率,并在CPU上约13秒完成20万对抗体评分。

    推荐理由:三篇论文分别针对抗体设计中的结合力排序、可开发性预测和全流程设计验证,给出了可复现的评估框架与实验结果。

9月21日周一
  1. Microsoft Research47

    RetroChimera 规模化改进小分子合成预测

    RetroChimera用学习排序融合R-SMILES 2与NeuralLoc的互补预测,改进小分子逆合成预测。10个高难度目标中,其完整路线被接受9条,de novo、editing与NeuralSym分别为5、4、2条。模型发表于Nature并开源实现与权重,能召回稀有反应,也能在专有数据集上零样本迁移和微调。

  2. Hugging Face Blog62

    像物理学家一样剪枝大语言模型:块移除作为约束二元优化问题

    Multiverse Computing 将 LLM 深度剪枝重构为约束二元优化问题,等价于全耦合伊辛自旋玻璃,用 Hessian 能量作为下游质量代理,避免逐条评测。

    推荐理由:把深度剪枝重新表述为伊辛自旋玻璃优化问题,可用廉价能量代理替代逐条评测,且与量化、低秩压缩等手段堆叠。