跳到正文

全部动态

今日 609 条
5月16日周六
  1. Google DeepMind64

    Co-Scientist 辅助发现可对抗肝纤维化的已上市药物

    斯坦福遗传学家 Gary Peltz 使用 Co-Scientist 从现有药物文献中筛选肝纤维化候选药,Co-Scientist 提出的三种候选药中有两种在人体肝细胞实验中阻断纤维化并促进肝细胞再生,其中抗癌药 vorinostat 阻断了 91% 的损伤应答。

    推荐理由:原文给出 Co-Scientist 在肝纤维化药物筛选中的对比结果,读者可据此评估 AI 科研助手在真实实验中的辅助价值。

  2. Google DeepMind83

    Gemini 3.5 Flash 发布:前沿智能与智能体能力

    Google DeepMind 发布 Gemini 3.5 Flash,在 Terminal-Bench 2.1(76.2%)、GDPval-AA(1656 Elo)、MCP Atlas(83.6%)和 CharXiv Reasoning(84.2%)上表现领先,输出速度比其他前沿模型快 4 倍。

    推荐理由:原文给出 Flash 在多个基准上的具体分数与速度倍数,读者可据此对比其与上一代 Pro 的能力变化。

5月15日周五
5月14日周四
  1. Kubernetes AI73

    Kubernetes v1.36 推进工作负载感知调度

    Kubernetes v1.36 将 Workload API 改为静态模板,并引入独立的 PodGroup API 与专用的 PodGroup 调度周期,实现原子级工作负载调度。同时推出拓扑感知调度、工作负载感知抢占、PodGroup 的 DRA ResourceClaim 支持,以及 Job 控制器与新一代 API 的首批集成。所有功能均以 Alpha 特性提供,需启用对应的功能开关。

    推荐理由:原文给出了架构升级和多项新功能,读者可以据此评估它对大规模 AI 训练与批处理工作流的实际影响。

5月13日周三
  1. Kubernetes AI60

    Kubernetes v1.36:PSI 指标正式毕业至 GA

    Kubernetes v1.36 将节点、Pod 和容器层级的 PSI 压力指标升级为稳定可用(GA),不再需要功能门控。Kubelet 会先检测内核是否支持 PSI 再上报,避免旧版本在内核未启用时输出误导性零值。

    推荐理由:原文给出资源占用实测数据,读者可据此判断在生产集群启用 PSI 监控的额外开销是否在可接受范围内。

5月12日周二
  1. Google DeepMind77

    Co-Scientist:加速科研的多智能体 AI 合作伙伴

    Google DeepMind 在 Nature 发表 Co-Scientist 研究,推出基于 Gemini 的多智能体系统,通过生成、辩论与演化假设来加速生命科学等领域的科研突破。

    推荐理由:原文给出多智能体协作与假设生成引擎的具体阶段,读者可据此评估它对现有科研工作流的实际改变。

  2. Vector Institute12

    Vector Institute 颁发 100 份奖学金给安大略省顶尖 AI 研究生

    Vector Institute 为 2026-27 学年颁发 100 份 merit-based 奖学金,每份 $17,500,总额 $1.75 million,获奖者来自安大略省 13 所大学的 30 个 Vector 认可 AI 硕士项目。该奖学金已连续第九年颁发,自 2018 年以来累计支持超过 900 名学生。安大略省大学连续第五年超过每年 1,000 名 AI 硕士毕业生的省定目标。

5月11日周一
5月8日周五
  1. Berkeley AI Research73

    自适应并行推理:高效推理扩展的新范式

    伯克利研究团队综述了自适应并行推理(APR)范式,提出模型可自主决定何时分解任务、生成多少并行线程以及如何协调。APR 通过特殊控制标记在推理时动态分配串行与并行计算,相比固定并行和多数投票等方法能减少冗余并避免上下文膨胀。文中对比了 Multiverse 等修改推理引擎与 ThreadWeaver 等保持引擎不变的系统设计,并讨论了基于关键路径的并行效率奖励和当前开放问题。

    推荐理由:原文梳理了自适应并行推理的范式与推理系统实现差异,读者可据此理解不同并行策略在延迟和准确率上的权衡。

5月7日周四
5月6日周三
  1. Vector Institute74

    Agentic AI evaluation strategies

    Vector Institute 发布两部分Agent评估策略研究,第一部分提出混合评估框架,结合机器可验证结果与LLM-as-judge,并给出NYC Airbnb分析Agent的三种失败模式案例;第二部分通过ICL实验发现系统提示中的

    推荐理由:文章给出了多模型ICL实验的误对齐率数据,读者可据此评估自身系统提示中模式跟随类指令的潜在风险。

  2. Google DeepMind82

    AlphaEvolve:Gemini 驱动的编程智能体跨领域规模化影响

    Google DeepMind 发布 AlphaEvolve,一款由 Gemini 驱动的编程智能体,用于设计高级算法并已在数学、计算机科学和 Google 基础设施中部署。

    推荐理由:原文展示了 AlphaEvolve 在数学、量子物理、基础设施和商业场景中的具体提升,读者可据此评估它作为通用算法设计智能体的实际边界。

  3. Weaviate Blog50

    Your LLM Is Only as Good as What It Retrieves

    检索质量是RAG系统中预测输出退化最可靠的单一指标,模型规模无法弥补检索缺陷。实验在HaluEval、TruthfulQA和FaithDial上发现检索层故障占幻觉的很大比例,与HELM和FaithDial分析结论一致。五种常见检索失败模式包括检索漂移、上下文截断、过期索引污染、低相关性top-k检索和多智能体间通信错误,且这些失败通常不可见,需要专用评估层才能检测。

5月5日周二
  1. Kubernetes AI67

    Kubernetes v1.36 引入基于清单的准入控制

    Kubernetes v1.36 引入 manifest-based admission control alpha 特性,允许通过 API server 启动时加载磁盘上的策略文件,在集群引导阶段即生效并防止被删除。

    推荐理由:原文给出了 manifest-based admission control 的启动加载机制和保护边界,读者可以据此评估它对集群引导阶段安全策略可用性的实际改善。

5月4日周一
5月2日周六
5月1日周五
4月30日周四
  1. Google DeepMind72

    Google DeepMind 发布 AI co-clinician 研究倡议

    Google DeepMind 在 Science 发表 AI co-clinician 研究,提出三方照护框架,由医生监督下的 AI 代理辅助患者。在 98 个初级保健查询中系统仅 1 例出现关键错误,并在 OpenFDA RxQA 开放问答中超越前沿模型。

    推荐理由:双盲评估与随机模拟实验为医疗AI协作提供了可复现的验证框架,读者可借此理解多模态能力边界与安全架构的设计取舍。

  2. Google Research67

    Google Research 科学家使用 Empirical Research Assistance 的四种方式

    Google 发布 ERA 辅助科研的预印本,展示其在流行病学、宇宙学、气候与神经科学四个领域的应用。在流感、COVID-19 和 RSV 预测中,ERA 达到或接近 CDC 顶级预测水平;与 Gemini Deep Think 结合推导出宇宙弦引力辐射的统一公式;利用 GOES East 卫星数据以 10 分钟间隔反演柱平均 CO2;在斑马鱼神经回路中发现可泛化的机制性解。

    推荐理由:四类科学场景展示了 ERA 与 LLM 协作解决开放问题的潜力,为 AI 辅助科研提供可迁移方法。

4月29日周三
  1. Together AI72

    DeepSeek-V4 Pro 现已在 Together AI 上可用

    DeepSeek-V4 Pro 已在 Together AI 提供 Serverless Inference,模型级支持 1M 上下文,当前部署窗口为 512K,采用 1.6T 参数 MoE 架构,激活 49B 参数。提供 Non-Think、Think High、Think Max 三档推理模式,并针对重复长上下文给出缓存输入定价($0.20 / 1M tokens)。

    推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。

4月28日周二
  1. Vector Institute25

    Hassan Ashtiani:通过数学基础构建可信赖的 AI

    Hassan Ashtiani 的研究针对隐私保护机器学习中的效率问题,提出"黑盒归约"框架,可将任意现有机器学习方法封装进隐私保证框架,无需重新设计算法本身。该工作获得 NeurIPS 2018 最佳论文奖,引入样本压缩方案等新理论概念。作为 Vector Institute 成员和 McMaster 大学教授,他致力于为 AI 系统提供可证明的隐私、鲁棒性和可信性保障。

  2. Together AI60

    Together AI 在 Day 0 推出 NVIDIA Nemotron 3 Nano Omni

    NVIDIA Nemotron 3 Nano Omni 现已上线 Together AI 平台,这是一款支持视频、图像、音频和语言的多模态开放模型。其 30B A3B MoE 架构每次激活约 3B 参数,支持最多 256K tokens 的共享多模态上下文,并在单一推理循环中完成跨模态推理。

    推荐理由:单一模型统一多模态推理降低了多模型拼接的复杂度,对构建多模态智能体系统的开发者具有直接参考价值。

4月27日周一
  1. Google DeepMind31

    Google DeepMind 与韩国政府达成 AI 合作

    summary_zh: Google DeepMind 与韩国科学技术信息通信部(MSIT)宣布建立合作关系,支持韩国 AI 国家战略。合作将设立首尔 AI 校园,与首尔大学、KAIST 及三个 AI 生物创新中心合作,引入 AlphaEvolve、AlphaGenome、AlphaFold、AI co-scientist、WeatherNext 等模型与项目。