Google Beam 扩展至五个新国家、新增合作伙伴与客户
Google Beam 正式扩展至美国、加拿大、英国、法国、德国、日本六国,由 18 家渠道伙伴部署支持,硬件由 HP Dimension with Google Beam 交付。
Google Beam 正式扩展至美国、加拿大、英国、法国、德国、日本六国,由 18 家渠道伙伴部署支持,硬件由 HP Dimension with Google Beam 交付。
Google 宣布 Gemini 新增 Adobe、Airtable、Wispr AI、Picsart、Squarespace 和 SeatGeek 等连接应用,用户无需切换应用即可直接使用这些服务。
Google 发布 gemini-3.8-flash-tts 与 gemini-3.8-flash-lite-tts 两款文本转语音模型,并提供支持 2000+ 声音与自定义声音的互动 Playground。
Microsoft Research 在 Physical AI Toolchain 中新增行业首个机器人推理卸载能力,可将 SO-101、UR10e 等机器人的推理从机载 GPU 卸载至边缘或云 GPU。实验显示,卸载改善了移动操作任务的成功率、响应精度和电池续航,并支持通过 Kubernetes 自动容器化与编排。
推荐理由:首次系统量化了机器人推理卸载的收益,为物理 AI 基础设施选型提供可对比的实测依据。
Google DeepMind 为 Private AI Compute 平台新增安全端侧持久记忆层,通过硬件隔离飞地与设备持有密钥实现跨设备连续协助。新架构在加密通道连接的隔离环境中临时解密处理请求,数据用完后立即重新加密;配套发布技术白皮书、系统架构与安全证明,并公开第三方审计结果供社区验证。
summary_zh: OpenAI Academy 成立两周年,OpenAI 宣布将 AI 技能带给更多社区。 OpenAI Academy 成立两周年,OpenAI 宣布将 AI 技能带给更多社区。
阿里云发布 Qwen Image 2.1,参数仅7B,可在RTX 3090等消费卡运行。内部基准Qwen Image Benchmark得分60.2,接近GPT Image 2.5 Sunburst(67)和Nano Banana 2.0(59.82);AI Arena图像编辑得分1367,位列开源第一。
Google DeepMind 发布了 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 模型,支持通过自然语言提示生成自定义角色语音。
GPT-6 Astra 能生成更结构化、上下文感知更强的法律文档,让律师更专注于策略制定。
Ringg 使用 GPT-5.6 驱动多语言智能体,在语音、聊天、WhatsApp 和网页端处理客服通话,解决比例最高达 65%。相比 GPT-4.1,成本降低 90%。
invideo 借助 GPT-6 Astra 将调色速度提升 3 倍,并能在一天内生成 50 个自定义效果。编辑规划精度也得到提高。
阿里巴巴在 Apsara Conference 2026 发布 Zhenwu V900 AI 加速器,称性能较上一代 M890 提升三倍,支持最多 50 万张卡集群,并计划训练 5 至 10 万亿参数的 Qwen 模型。V900 配备 216 GB GPU 显存和 1,200 GB/s 片间带宽,预计 2027 年第一季度量产交付。
中国于9月20日由CAS Space的Kinetica 1 Y18火箭发射9颗卫星,其中包含S-AIDC开发的Supercomputing-1(S-AIDC-1)AI卫星。
MentalHealthBench 是一个由专家参与的评测基准,用于评估 AI 在真实心理健康对话中的帮助性与安全性。该基准为衡量模型在敏感场景下的表现提供了新标准。
summary_zh: TECNO EllaClaw 简化了跨应用工作流程,减少了完成任务的操作步骤。作者期待更多可定制的自动化流程与 Tecno AI 框架结合,让手机成为真正的 AI 生产力伴侣。 TECNO EllaClaw 简化了跨应用工作流程,减少了完成任务的操作步骤。作者期待更多可定制的自动化流程与 Tecno AI 框架结合,让手机成为真正的 AI 生产力伴侣。
NVIDIA AI Day Singapore 展示 Nemotron 3 Super、Nemotron 3 Nano Omni、Cosmos 开放世界模型及 VSS 蓝图在东南亚的落地。
ChatGPT Ads 扩展至东南亚和台湾,符合条件的企业可通过 ChatGPT 广告触达超过 60 个国家的用户。
summary_zh: Airbnb 扩大 GPT-6 Astra 与 OpenAI 前沿模型的访问权限,帮助工程团队解决 bug、设计系统并加速交付。 Airbnb 扩大 GPT-6 Astra 与 OpenAI 前沿模型的访问权限,帮助工程团队解决 bug、设计系统并加速交付。
OpenAI 与 Grab 联合推出 GO Forward with AI 计划,帮助东南亚 30,000 名合作伙伴构建实用 AI 技能。该计划为覆盖东南亚区域的合作项目。
Anthropic发布Claude Opus 5.5,声称典型工作负载成本较Opus 5降低约40%,并增强网络安全与生物等高危领域保护。OpenAI同步推出GPT-6 Sol与Luna,定位分别为高效日常驱动与快速廉价选项,训练方法与GPT-6 Astra相近,部分基准表现略优但使用成本约减半。
GPT-6 提升了提示词缓存的命中率,并新增诊断工具、显式断点与控制选项,以降低延迟与成本。
summary_zh: Simon Willison 发布 llm 0.36 版本更新。OpenAI 相关内容在 9 月 22 日的月度简报中被提及,涵盖 LLM 领域重要进展。
summary_zh: Janet Kuo 与 Maciej Szulik 讨论 Kubernetes SIG Apps 工作负载 API 的演进,涵盖 Deployments、StatefulSets、DaemonSets、Jobs 与 CronJobs 的可靠性与扩展性挑战。
summary_zh: llm-anthropic 0.29 由 Simon Willison 于 2026 年 9 月 22 日发布,为月度 LLM 动态简报。
llm-typesafe 0.1a0 发布,为 llm 工具新增对 TypeSafe AI Jev 模型的支持。安装后可通过 noul 提问获得置信度分数(如 0.99),也支持 choice 和 scoring 两种按预设标准分类的提问方式。
vLLM 推出硬件无关(HW agnostic)层,确保项目在推进前沿 GPU 性能工程的同时,继续支持旧 GPU、消费者级 GPU 和树外加速器。新层保持 fullgraph torch.compile 兼容、可扩展、与硬件特定路径隔离,并使用原生 PyTorch 或可移植 DSL 实现。
推荐理由:vLLM 新增硬件无关层,让关心多硬件和旧 GPU 的用户在不牺牲可移植性的前提下继续使用。
新型 AI 内存系统让智能手机端 AI 响应速度提升最多 3.67 倍,同时减少服务器调用,帮助设备更高效地本地处理更多任务。
summary_zh: Viture Vonder AI 眼镜提供六种镜框样式,支持处方镜片,售价 299 美元,将于本月晚些时候开售。眼镜主打日常思绪的思维导图功能,将 AI 交互与时尚外观结合。 Viture Vonder AI 眼镜提供六种镜框样式,支持处方镜片,售价 299 美元,将于本月晚些时候开售。眼镜主打日常思绪的思维导图功能,将 AI 交互与时尚外观结合。
Jev 现已开放给所有人使用,它是一个面向开发者的工具内 LLM,用户可向其提交文本并获取是/否判断、选项分类或相关性评分等答案。社区用它构建了跳过 YouTube 赞助片段、实时过滤聊天负面评论、按意图搜索 Gmail 等扩展。
NVIDIA Isaac ROS 5.0在多伦多ROSCon发布,引入智能体工作流与GPU加速软件包,帮助人与AI智能体共同开发机器人。FoundationPose提供面向智能体的推理库,使机器人感知并跟踪物体位姿的速度最高可快5.5倍。新版支持ROS Lyrical和Ubuntu 24.04。
GPT‑6 Astra 帮助 Parallel 的 agents 在研究合成劳动力市场数据时,将时间和成本均降至此前模型的一半。
Microsoft Agent Framework 发布 Foundry 托管代理隔离,包含用户隔离和 Foundry 托管会话隔离两个独立控制,分别对应调用者身份和沙箱会话。开发者可使用 .NET 和 Python SDK 通过 AgentSession 传入 delegated user identity 或显式 agent_session_id,实现共享沙箱或独立会话等部署模式。
推荐理由:原文给出了用户隔离与会话隔离两套控制及多种可用模式,读者可据此评估自身应用在数据归属和会话生命周期上的选择。
Together AI 发布 Canary Rollouts 功能,支持在同一个端点上以 canary、blue-green、rolling 三种策略将流量从源模型逐步迁移到目标模型,并在每步执行健康检查与指标门控。
推荐理由:平台将人工回滚转为自动化阶梯流量与健康检查,适合在生产环境替换模型时控制风险。
oMLX 创造者兼维护者 Jun Kim 加入 Hugging Face,继续主导这一基于 Apple MLX 的本地 AI 项目。oMLX 保持 Apache 2.0 开源,从副业转为有资金支持的全职项目,并作为 mlx-lm、mlx-vlm 之上的新想法试验场。Hugging Face 还希望打通 transformers 模型定义到 MLX 参考实现的快速转换。
Hugging Face 的 transformers 库新增 GGUF 模型支持,用户可通过熟悉的 API 在 Apple Silicon Mac 上运行 llama.cpp 量化 checkpoint。
推荐理由:transformers 新增 GGUF 支持,在 Apple Silicon 上通过熟悉 API 运行量化模型,性能接近 llama.cpp,为本地推理提供便捷入口。
TypeSafe AI 发布 Jev,定位为面向软件开发的 System One 模型,核心创新是用 RLCD 替代 RLHF/RLVR,强调校准性与可靠性。Jev 优先服务于代码调用,创始人 Diogo Almeida 主张模型应融入软件底层并最终消失于背景。
推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。
Kubernetes v1.37 将 PersistentVolumeClaimUnusedSinceTime 功能门控升至 Beta 并默认启用,PVC 保护控制器为每个 PVC 添加 Unused 条件,标识是否有运行中的 Pod 正在引用该卷。
NVIDIA推出DSX Ready认证计划,用于评定AI工厂电源与冷却产品是否符合DSX参考设计要求。计划初始覆盖电池储能系统(BESS)和冷却分配单元(CDU)两类,Hitachi Energy、LG Energy Solution、Tesla及LG Electronics、LiquidStack、Vertiv等合作伙伴产品已获认证。该计划帮助建设者降低集成风险,但通过认证不替代现场工程评估。
NVIDIA 推出全栈安全系统 Halos,覆盖 AV 与机器人从硬件、软件、AI 行为到部署生命周期的安全工程。Halos 整合 DRIVE AGX Thor、IGX Thor、Halos OS、Alpamayo、Isaac Lab 与 Omniverse,并提供可追溯的安全证据与第三方认证支持。
summary_zh: NVIDIA 发布开源安全运行时 OpenShell,为 AI Agent 提供沙箱执行与策略管控,合作伙伴 Cisco DefenseClaw 和 JFrog 已在其基础上构建治理与技能扫描能力。