OpenAI 与 GSA 为联邦、州、地方和部落政府扩展 AI 访问与网络安全防御支持
OpenAI 与 GSA 将为符合条件的联邦、州、地方和部落政府提供零许可证费用、使用费五折优惠,并扩展网络安全防御支持。
OpenAI 与 GSA 将为符合条件的联邦、州、地方和部落政府提供零许可证费用、使用费五折优惠,并扩展网络安全防御支持。
OpenAI 推出 ChatGPT for Financial Services,整合内置金融数据与 GPT-6 Astra,支持研究、建模和生成客户可用材料。
PyTorch Foundation 于 9 月 8–9 日在上海举办 PyTorch Conference China 2026,与 KubeCon + CloudNativeCon 和 OpenInfra Summit 同期举行。
推荐理由:PyTorch Foundation 在中国大会公布新成员与开放 AI 栈分层,读者可据此追踪开源生态的协作版图和硬件集成进展。
Together AI 内核团队在 Vera Rubin NVL72 上扩展 ThunderKittens,支持 NVFP4 与 FP8 GEMM,并通过双 K 步长、独占张量内存、更大共享内存、B 侧收集器与 Early A release 等优化,将 NVFP4 推至超 22 PFLOPS,与 cuBLAS 和 CuTE DSL 竞争。
推荐理由:原文给出了在 Vera Rubin 上优化 NVFP4/FP8 GEMM 的具体方法与性能数据,读者可迁移这些调优思路到自家 Rubin 部署。
Hugging Face 用 Gradio Workflow 重建了 AUTOMATIC1111 的核心功能,形成包含 11 条媒体管道、73 个节点的单一工作流画布,涵盖文生图、高分辨率修复、图生图、提示词矩阵、VLM 问答、检测到 inpaint 掩码、ControlNet 风格标注器、背景去除、PNG Info 读取和图生视频。
推荐理由:原文展示了用同一套画布串联多种模型与媒体管道的构建方式,读者可据此评估 gr.Workflow 在多模态工作流中的可复用性。
Together AI 公开预览抢占式计算节点,算力与标准节点相同,按 sub-hourly 计费为按需价的 50%。回收时有 5 分钟 drain 窗口,节点标注 together.ai/compute-class=preemptible,适合可 checkpoint 或重试的短实验、推理突发和批处理任务。
推荐理由:原文给出了成本变化和开放入口,读者可以据此判断它会怎样改变现有工作流。
TRL v1.14 的 AsyncGRPOTrainer 新增 LoRA 适配器仅同步功能,结合 HF Jobs Storage Bucket 挂载,使训练与推理可运行在独立机器上,无需 NCCL。五次实验将 500 步训练从 3h27m 优化至 53min,通过 token 预算批处理和提升并发请求数将瓶颈从训练端转移到生成端。
推荐理由:通过LoRA适配器仅同步加存储桶挂载,训练与推理可部署在独立HF Jobs上无需NCCL,五次实验将500步训练从3小时27分压缩至53分钟。
GPT‑Live‑1 通过 API 推出全双工自然语音对话能力,支持更强指令遵循、自定义声音与电话渠道。开发者可借此构建更自然的语音交互应用。
OpenAI 发布 Agents API,这是一项托管服务,基于 Codex harness 提供编排、长时会话和工具调用能力。
summary_zh: MIT Schwarzman College of Computing 举办了为期一周的首届 AI Educators Pilot 工作坊,来自 Allen University、Babson College、Brandeis University 等多所高校的 19 名教师参与。
Encode-prefill-decode(EPD)拆分是一种多模态模型推理优化技术,将视觉编码器阶段与 prefill 和 decode 阶段分离。该技术在图像密集型提示、短到中等长度输出以及量化 MoE 模型上效果最显著。结合 NVIDIA Dynamo 可实现最高 5 倍加速。
summary_zh: CUDA Toolkit 13.4 为 Windows on Arm 平台提供 CUDA 应用支持,此前 CUDA 仅在 Arm 平台的 Linux 上可用。
机器人正越来越多地直接从图像学习操作技能,但大多数机器人策略仍依赖单目相机,难以准确估计深度。这使得在杂乱环境中抓取物体、插入零件或操作复杂几何形状等精确任务难以完成。
Kubernetes v1.37 新增五种 Node 生命周期条件:DrainInProgress、Drained、MaintenancePlanned、MaintenanceInProgress、GracefulNodeShutdownInProgress,为节点排水、维护和优雅关机提供统一状态通道。
Paul Christiano 加入 OpenAI 基金会董事会及其安全委员会,带来 AI 对齐、安全与标准领域的专业经验。
summary_zh: Google DeepMind 与 Primordial Soup 合作,为纪录短片《Love, Rendered》用生成式模型修复黑白旧照,并用性能捕捉模型映射 Burt 与 Ethelle 当下的微表情与姿态,将其映射到年轻形象上。
Google Search 推出 Live Game Feed,实时赛事页包含动态时间线、关键视频高光与AI洞察,美国英语移动端已上线,本月将扩展大学球队与全球覆盖。
Mistral 帮助欧洲能源运营商将 40,000 行 Fortran 77 迁移到 C++,并给出结构化智能体工作流:先构建数值 parity harness,再整理文档,最后由人类审核员驱动 coder、tester、reviewer 智能体逐模块迁移。
推荐理由:原文给出了一套可迁移的现代化工作流,读者可以据此评估自身代码迁移中自动化与人工审查的平衡点。
GPT-6 Astra 是 OpenAI 面向商业场景的最强模型,具备高级推理、计算机使用能力,以及更强的写作与设计判断力。
Weaviate 推出 HFresh,一种面向内存敏感场景的磁盘向量索引,默认用于 Weaviate Cloud 免费档的 Cost Optimized 配置。
Together AI 发布开源 AI 栈指南,将栈分为模型、推理、网关与路由器、Harness、工具与上下文管理五层。推荐同时使用大模型(如 Kimi K3,1.8T 总参数)与小模型(如 GLM 5.3 Flash,320B 总参数)处理不同复杂度的任务,并可通过 OpenRouter、Vercel AI Gateway 或 LiteLLM 路由多提供商。
推荐理由:原文分层拆解开源 AI 栈各层组件与选型思路,开发者可按需组合模型、网关与工具。
Kubernetes v1.37 将 Workload/PodGroup API、gang scheduling 与 Workload-Aware Preemption 升级至 Beta,并引入支持多层拓扑约束与抢占策略的 CompositePodGroup API。
推荐理由:核心 WAS API 升级到 Beta 并引入 CompositePodGroup,用户可据此评估分层调度和抢占策略对分布式训练与推理工作流的影响。
summary_zh: MIT 研究员使用 GPT-5.6 Sol 配合 Codex 自主运行量子计算实验、分析结果并校准量子比特。该方案展示了 LLM 在量子实验自动化中的实际应用路径。
Google DeepMind 发布了 AlphaGenome Atlas,提供人类基因组中 90 亿个单核苷酸变异的分子影响预测。该平台包含数千个分子效应预测,覆盖多个细胞类型,已在罕见病研究中验证变异功能。AlphaGenome Atlas 通过网站、AlphaGenome API 和 Google Antigravity 提供。
推荐理由:Google DeepMind 发布了 AlphaGenome Atlas,提供人类基因组中 90 亿个单核苷酸变异的分子影响预测,并推出 AVI 分数用于变异影响评估。
OpenAI 讨论能力更强、价格更可负担的 AI 如何扩展个人与企业可完成的工作,并让增长变得更经济。
Mistral 宣布完成 30 亿欧元 D 轮融资,投后估值超过 210 亿欧元,由三星电子领投,Scaleup Europe Fund 和 PSG Equity 联合领投。Mistral 称这是欧洲科技公司完成的规模最大的股权融资,资金将用于扩展前沿研究、算力容量、基础设施以及商业化与国际业务。公司目前在 20 个国家运营,服务 125+ 家全球企业,包括 Airbus、ASML 和 HSBC。
推荐理由:融资规模与投资方结构显示欧洲主权 AI 路线的资本支持力度,可用于对照 Mistral 全栈开源布局的商业方向。
NVIDIA 在 2026 年 9 月宣布推进原生 Rust GPU 编程,将 CUDA Rust 成长并成熟至 2027 年及以后。CUDA C++ 与 CUDA Python 已是成熟的企业级工具链,Rust 轨道面向 AI 系统层(推理引擎、服务基础设施、驱动、Agent 运行时)的持续演进需求。
ChatGPT Images 2.5 发布,帮助用户将想法、草图和参考照片转化为更个性化、更精致的图像,生成的图像更能反映用户的原始想法。
OpenAI 扩展对新闻业的支持,面向学生、教育工作者、记者和新闻机构提供工具、培训与合作伙伴关系。计划覆盖从课堂到新闻编辑部的全链条支持。
OpenAI 发布了一份 AI 生成的 Navier–Stokes 千禧年难题解法,包含说明文档和 Lean 形式化证明。
OpenAI 启动 500 万美元资助计划,支持独立研究生成式 AI 对青少年发展、身心健康与安全的影响。申请现已开放。
1Password 工程师使用 Codex 快速构建新功能与内部工具,在保持严格安全策略的同时达到生产就绪状态,工程效率提升 21%。
summary_zh: Foundry 将现有创意归档转换为可搜索的创意库,通过只读扫描、记录清单、准备检索记录并与 Weaviate 同步,扫描 23 个测试资产并生成 source URI。
第 40 届学习理论年度会议 COLT2027 将于 2027 年 6 月 28 日至 7 月 2 日在东京举行。该会议汇聚研究者分享机器学习理论基础的最新进展,推动领域发展与研究者协作。
RIKEN AIP 音乐信息智能团队(团队长浜田正敏、研究员三浦裕也、客座研究员小室哲也、JSPS PD 关真太郎)凭借「School Song Creation with Student Participation Using AI Composition Support」获得 IPSJ SIG 音乐与计算机科学最佳演示奖。该奖项由 SIG 委员会根据参会者投票选出,表彰研究发表表现。
OpenAI 联合 AIRPPU 与 WAN-IFRA 推出 AI 项目,支持乌克兰新闻机构加强创新、韧性与独立新闻。
Jakub Pachocki 反思 AI 能力持续提升带来的对齐挑战,呼吁加强安全保障与国际协调。
summary_zh: OpenAI 内部数据显示编码智能体正在重塑 AI 研究流程。早期数据涵盖智能体使用率、实验迭代速度、任务复杂度与研究加速效果,但具体数字和指标未在正文中披露。 OpenAI 内部数据显示编码智能体正在重塑 AI 研究流程。早期数据涵盖智能体使用率、实验迭代速度、任务复杂度与研究加速效果,但具体数字和指标未在正文中披露。
Kubernetes v1.37 将 KubeletInUserNamespace 功能门控从 Alpha 升至 Beta,默认启用。
NVIDIA NemoClaw 被用于构建一个记忆驱动型 Chief of Staff Agent,为企业消息、决策、项目和义务等持续变化的工作提供上下文。该 Agent 维护一个可读的 self model 作为记忆层,避免每次从零重建背景。