MIT 团队用 AI 筛选溶剂分子,研制出更快更稳定的钠金属电池
summary_zh: MIT 团队在 Joule 发表钠金属电池新电解质研究,通过 AI 辅助筛选 10 万个候选分子,最终确定最小溶剂 DMFSA,在保持电极稳定的同时加快离子传输,提升快充快放性能。
summary_zh: MIT 团队在 Joule 发表钠金属电池新电解质研究,通过 AI 辅助筛选 10 万个候选分子,最终确定最小溶剂 DMFSA,在保持电极稳定的同时加快离子传输,提升快充快放性能。
Interconnects 推出 Artifacts Hub 与 Adoption Dashboard 两项免费数据工具,覆盖 Hugging Face 近两年发布的 792 个开源模型。
Together AI 与 Moonshot AI 达成战略合作,成为 Kimi 模型的首发平台,首发模型为 Kimi K3。Kimi K3 是迄今最大开源模型,参数规模达 2.8T 的稀疏 MoE 架构,支持原生视觉与 1M token 上下文窗口。
NVIDIA 发布 Cosmos-H-Dreams,一款基于单张 RTX PRO 6000 GPU 运行的手术机器人实时生成式仿真器。该模型从 Cosmos-H-Surgical-Simulator 蒸馏而来,通过 FlashDreams 推理库实现约 160 fps 的交互式操作,每潜在帧仅需 2 步去噪,支持 dVRK 桌面缝合任务,并可连接学习型手术策略形成闭环。
推荐理由:NVIDIA将手术世界模型压缩至单卡实时推理,使外科机器人策略的闭环评估与合成数据生成不再依赖稀缺物理硬件。
Nunchaku Lite 现已原生集成到 Diffusers,用户可通过 from_pretrained() 直接加载 4-bit 量化扩散模型,无需单独推理引擎或本地 CUDA 编译。
推荐理由:Nunchaku Lite 现已原生接入 Diffusers,无需额外引擎即可通过 from_pretrained() 加载 4-bit 量化模型,在 RTX 5090 上 VRAM 从 24GB 降至约 12GB,推理加速约 30%。
Together AI 发布 Dedicated Model Inference 平台,支持部署自有或开源权重模型,并提供部署配置、预热加速、Canary/蓝绿/滚动发布、A/B 与影子流量测试及 Prometheus 可观测性。平台覆盖从实验到生产的全生命周期,并同步开启自定义训练(含 LoRA 与强化学习)封闭测试。
推荐理由:原文给出部署预热、流量切换与可观测性等具体能力,读者可以据此判断它能否降低自研推理栈的运维成本。
summary_zh: MIT 研究人员开发出一种基于硅光子学的 lidar 芯片,通过集成天线阵列大幅降低串扰,实现更宽视野和更低噪声。该设计采用三种不同几何形状的天线,使其在紧密排列时仍能保持一致的发光特性。
summary_zh: 首尔国立大学与首尔大学的研究团队开发了一种可编程光子集成电路,通过耦合谐振器诱导透明(CRIT)结构按需减缓光速。该芯片利用两个可控环路耦合器统一处理亮模与暗模,可动态调整信号延迟、带宽和形状,且无需额外专用组件。
Grabette 是 Pollen Robotics 发布的开源手持采集设备,配合 Gripette 机械爪端,能用普通相机、IMU 和深度相机记录操作演示,并自动生成 LeRobot 格式的机器人就绪数据集。
推荐理由:原文给出了低成本的采集方案与开放数据集入口,读者可以据此判断它能否降低机器人学习的数据门槛。
Together AI 与 Y Combinator 合作推出首个 YC 专属 GPU 集群,为 YC 旗下 AI 原生初创公司提供按需 GPU 资源。创业公司可通过 Together 自助门户直接预订、配置和管理 GPU,享受长期价格而无需长期承诺,集群当前已满载运行。该集群覆盖从单节点到大规模扩展的需求,创始人还可获得 Together 团队在推理与训练方面的最佳实践支持。
summary_zh: Together AI 解释推理服务可靠性的分层含义:99% 需快速检测并调度故障节点,99.9% 要求双设施持续部署与权重冗余,99.99% 需预留跨区域容量以应对整区宕机。
Meta 提出分层兴趣表征(Hierarchical Interest Representation),作为广告系统的上游表征层,基于数十亿交互数据端到端训练。
Together GPU Clusters 推出被动健康检查、自动节点修复、Slinky 1.0 等功能,覆盖 GPU 总线故障、热节流、Xid 错误等场景。配合集群详情页、外部 OIDC、启动脚本和验收测试选项,提升多团队场景下的可观测性、访问控制与自定义能力。
推荐理由:原文给出了平台健康与运维控制两方面的具体能力变化,读者可以据此评估它对现有训练与推理工作流的影响。
summary_zh: Ikigai 基于表格与时间序列数据构建基础模型,可持续接入企业多源数据,通过预测真实结果进行自我学习。该模型将企业流程数字化,提供大规模实时规划与模拟不同选项的能力。
summary_zh: MIT 开设 JARVIS Challenge,要求本科生在四周内用 AI 设计、加工、组装并测试一台 50–100 磅推力的单转子喷气发动机。
summary_zh: MIT 城市研究与规划系于 2019 年推出网络安全诊所课程(Cybersecurity Clinic),由 Jungwoo Chun 与 Lawrence Susskind 授课。
Google 在印度启动 ATL Saathi 试点,这款由 Gemini 驱动的 web 应用为 Tinkering Lab 教育者提供 24/7 规划与培训助手。
summary_zh: Mistral Studio 现已上线,为企业的 Prompts 和 Skills 提供集中化的版本管理、归属权与审计追踪。每条指令不可变版本、可回滚、可标注(如 Production/Staging),并通过 Observability 将生产输出追溯至具体资产版本。
Hugging Face 更新 vLLM 的 transformers 建模后端,在 Qwen3-4B、Qwen3-32B、Qwen3-235B-A22B-FP8 三种模型上达到或超越原生 vLLM 吞吐。模型作者只需添加 --model-impl transformers 标志即可自动获得优化推理,无需手写自定义实现。
推荐理由:transformers 后端现已达到原生 vLLM 实现同等吞吐,模型作者无需重写代码即可在 vLLM 中获得优化推理性能。
Hugging Face 与 Amazon SageMaker AI 推出深度链接集成,支持一键进入 SageMaker Studio。
微软在 Build 2026 发布 Foundry Managed Compute,Hugging Face 模型现可通过一键部署在 Azure 上运行。模型目录每周更新,仅包含 SafeTensors 格式的安全筛选模型,支持 vLLM、SGLang、TensorRT-LLM、NIM、TEI、llama.cpp 等运行时,并提供统一端点、Azure Monitor 指标和每部署计费标签。
推荐理由:Hugging Face 模型现可通过 Foundry Managed Compute 一键部署,微软承担了从运行时构建、安全扫描到 CVE 补丁的运维层,让企业能在自有租户中运行开源模型。
Hugging Face 与 SkyPilot 联合推出 store: hf 存储后端,用 hf:// URL 将 HF Bucket 或 Hub repo 挂载到 SkyPilot 任务,实现跨云 GPU 任务零 egress 读取。
推荐理由:Hugging Face Storage 成为 SkyPilot 官方存储后端,团队可在任意云上运行 GPU 任务并免费读取 Hub 数据,无需跨云拷贝或承担 egress 费用。
LeRobot v0.6.0 发布,引入世界模型策略(VLA-JEPA、FastWAM、LingBot-VA)、新 VLA 模型(GR00T N1.7、MolmoAct2、EO-1、Multitask DiT、EVO1)和奖励模型 API(Robometer、TOPReward)。
推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。
summary_zh: PRX 团队公开了其预训练数据策略:从公开与内部数据集混合采集图像数据,用 VLM 重新标注,并以长caption 保证描述完整。流程上使用 Lance 做特征工程与数据集构建、MDS 格式流式读取;文本编码器切换至 Qwen3-VL 后改为训练时实时计算 latent,仅带来约 3–4% 吞吐量开销;图像统一以质量 92 的 JPEG 编码。
Hugging Face 推出 Hub 上的新仓库类型 kernel,并重构 CLI 与安全机制,包括可信发布者、代码签名与 manylinux_2_28 动态链接支持。
Hugging Face 与 Cerebras 联合展示了基于 Gemma 4 31B 的实时语音对话流水线,将语音输入、Parakeet 语音识别、Gemma 4 VLM 推理和 Qwen3TTS 语音合成串联为端到端开放架构。该流水线已在 Hugging Face Space 开放演示,代码仓库为 huggingface/speech-to-speech。
Every Eval Ever 与 Hugging Face 社区评测现已实现互操作,官方提供了转换器工具,可自动将 EEE 评测记录同步为模型仓库中的 YAML 文件。数据存储已收录约 22.9 万条评测结果,覆盖 2.2 万个模型和 2200 个基准。该工具支持 MMLU-Pro、GPQA、HLE 和 GSM8K 四项基准,并在写入前自动审核冲突。
推荐理由:EEE与Hugging Face社区评测现在可互操作,转换器自动将EEE记录写入YAML文件并审核冲突,解决评测结果分散难以对比的长期问题。
Zyphra 发布 ZAYA1-74B-preview 与 8B-A0.6B MoE,在 AMD GPU 上训练。CohereLabs 发布 command-a-plus-05-2026-bf16,旗舰 Command A+ 改为 Apache 2.0 许可。Poolside 将 Laguna-M.1 置于 Apache 2.0 下,并承诺开放权重为默认。
Gemini 3.5 Flash 内置计算机使用能力,开发者可通过 Gemini API 和企业平台构建跨浏览器、移动端与桌面的自定义智能体。该功能此前仅作为独立的 Gemini 2.5 计算机使用模型提供,现原生集成至 Flash 模型,并配备提示注入对抗训练及可选的企业安全防护系统。
推荐理由:计算机使用功能从独立模型整合进3.5 Flash,开发者可通过API和企业平台构建跨浏览器、移动端与桌面的自定义智能体,并配备提示注入防护与企业级安全机制。
Mistral 为 Connectors 新增多项管理与安全能力:按 workspace 或组织分配连接器访问权限、带 connector scope 的 API key、单个连接器绑定多账号,三项均已 GA。
summary_zh: Google DeepMind 与英国政府合作开发基于 Gemini 的 AI 规划原型工具,旨在将家庭规划申请处理时间缩短 50%。该工具可整合数据、提取关键信息、识别本地政策、总结反馈并起草评估报告,规划官保留最终决策权。
Google Earth AI 发布 Farmscapes 向量化数据集,将英国 130,000 km² 高分辨率卫星影像中的树篱、石墙和林地转为可操作矢量清单。基于 RSF ViT 骨干(预训练于 3 亿+全球卫星图)微调,结合亚米影像与 1 米 LiDAR 双层标注,用 Polsby–Popper 紧凑度得分区分林地(≥30 米直径)、树丛与线性植被。
Google Research 发布 JAMA Dermatology 论文,2,345 名参与者测试 AI 皮肤状况辅助工具。AI 组命名准确率 23%,较对照组 8% 提升近三倍;Wizard of Oz 组达 36%。但下一步医疗决策准确率提升有限,AI 组略更倾向建议非紧急处理。
AWS 宣布 EC2 M9g 和 M9gd 实例正式可用,首次搭载 Graviton5 处理器并配备 Nitro Isolation Engine。该组件是首个部署在商用云环境的形式化验证 Hypervisor,使用 Isabelle/HOL 完成 33 万行机器检查数学证明,涵盖保密性、完整性、功能正确性、无运行时错误和内存安全。
推荐理由:给出了可量化的验证规模和语言选择,读者可以据此评估云虚拟机隔离的形式化保障程度。
AWS 宣布 Graviton5 处理器正式商用,搭载于 M9g 和 M9gd 实例。相比 Graviton4,核心数从 96 增至 192,支持 DDR5-8800 内存和 PCIe gen5,每核性能提升 25%,数据库性能提升 30%。采用 3nm 工艺、四芯片架构,L3 缓存增至 192MB,并引入 Nitro Isolation Engine 实现形式化验证的云安全隔离。
Google DeepMind Accelerator: Robotics 计划遴选 15 家欧洲早期机器人初创公司,提供 3 个月密集导师指导与技术支持,帮助将 AI 融入核心产品。入选公司覆盖物流、制造、医疗、气候与导航等领域,可使用 Google AI 栈、技术专长及 Gemini 机器人模型。
2026 年 AI 从"知道"转向"行动",Amazon 推出 Project Eluna,作为仓库运营的智能体模型,通过数字仪表板辅助运营决策。论文提出四种锚定方法:物理引导深度学习、不确定性感知推理、文本到数值桥接,以及第四种方法。UQ4CT 框架在五个基准上保持高准确率,同时将预期校准误差降低 25% 以上。
Google 推出由 Gemini Enterprise Agent Platform 托管的 Cross-Corpus Retrieval,基于 Agentic RAG 驱动,可处理多源、多跳的复杂查询。
Mistral 在 AI Now Summit 2026 推出面向工业工程的 AI 栈,并宣布与 Airbus、BMW、ASML 合作,覆盖设计、仿真与生产环节。Vibe 被升级为可处理长周期任务的统一智能体,同时法国 Les Ulis 新建 10 MW 数据中心计划于 2026 年 Q3 开放。
推荐理由:原文给出了工业 AI 栈与 Vibe 智能体的能力边界,读者可据此判断 Mistral 在企业级工作流中的差异化定位。
Mistral 将 Le Chat 升级为统一的 AI 智能体 Vibe,同一订阅同时覆盖工作与编码,用户原有的对话、设置和方案自动保留。
推荐理由:Le Chat 升级为 Vibe 后把工作流与编码并入同一智能体和同一订阅,读者可了解其功能边界与定价分层。