Antigravity SDK 新增本地 AI 模型支持
Google 宣布 Antigravity SDK 支持本地模型与多种执行选项,初始支持通过 LiteRT 运行 Gemma 4 26B A4B,开发者可在离线环境下使用与云端相同的 agentic 能力。
推荐理由:本地 Gemma 4 26B 与云端 Gemini 3.8 Flash 协同的混合编排示例,帮助开发者在隐私与成本约束下设计本地 agent 工作流。
Google 宣布 Antigravity SDK 支持本地模型与多种执行选项,初始支持通过 LiteRT 运行 Gemma 4 26B A4B,开发者可在离线环境下使用与云端相同的 agentic 能力。
推荐理由:本地 Gemma 4 26B 与云端 Gemini 3.8 Flash 协同的混合编排示例,帮助开发者在隐私与成本约束下设计本地 agent 工作流。
Google Cloud API Gateway 进入 Public Preview,可作为远程 MCP server,将已有 REST 操作直接暴露为 agent 可调用的 MCP 工具,无需单独搭建服务器。
研究提出 Agent-Callable Feature Coverage(ACFC)指标与 Agent Readiness Conformance(ARC)框架,从可访问性、可发现性、可控性三轴评分(0-9)。
Google Research 提出 Diffusion Controller 框架,将图像生成去噪过程重构为连续控制问题,以轻量级转向阻尼器网络在灰盒环境下超越 LoRA。实验基于 Stable Diffusion v1.4 并在 HPS-v2 上评估,同时支持运行时调节控制强度。
summary_zh: 独立电影人 Jeff Synthesized 凭借《The Gifted》获得 Future Vision XPRIZE 大奖,从全球 2500 多部参赛作品中脱颖而出。
Google Research 推出 Co-Director、CANVAS、A²RD 和 VQQA 等框架,自动化长形式视频生成,缓解语义漂移并提升多镜头叙事一致性。
推荐理由:Google Research 推出 Co-Director、CANVAS、A²RD 和 VQQA 等多代理框架,自动化一致的长形式视频生成,有效缓解语义漂移和特征漂移,提升多镜头叙事一致性。
Google DeepMind 发布 Gemini 3.8 Live with Live Avatar,把近实时视频生成与语音对话结合,为企业对话模型加上动态视觉形象,已在 Gemini Enterprise 上线。
推荐理由:原文给出实时视频形象与异步工具调用的能力说明,读者可据此了解企业智能体的交互形态变化。
NVIDIA 联合 Google DeepMind、EMBL-EBI 等机构通过 AlphaFold Database 开放超过 2800 种病毒的蛋白质复合物预测结构,约 30% 为科学界全新发现的相互作用。
推荐理由:开放预测结果与推理流水线为研究者提供了可复用的基础设施,降低未来疫情中蛋白质结构解析的门槛。
Google Beam 正式扩展至美国、加拿大、英国、法国、德国、日本六国,由 18 家渠道伙伴部署支持,硬件由 HP Dimension with Google Beam 交付。
Google DeepMind 为 Private AI Compute 平台新增安全端侧持久记忆层,通过硬件隔离飞地与设备持有密钥实现跨设备连续协助。新架构在加密通道连接的隔离环境中临时解密处理请求,数据用完后立即重新加密;配套发布技术白皮书、系统架构与安全证明,并公开第三方审计结果供社区验证。
Google DeepMind 发布了 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 模型,支持通过自然语言提示生成自定义角色语音。
Google 开发的 Co-Scientist 通过多个自主智能体搜索文献、生成并筛选假设,帮助生物化学家 Anna Pertl 找到针对 MYC 蛋白的新策略。Frontier AI 实验室与初创公司也在推出类似平台,强调人类提问与判断仍不可替代。
推荐理由:展示了多智能体协作在科学假设生成中的实际工作流,读者可迁移其‘提问—修正—验证’方法到自身研究场景。
Google Research 推出 MilleMiglia,一个 C++ 实例生成器,用于构建中段物流网络的真实基准。中段物流覆盖区域或大陆尺度的配送中心间运输,占物流成本大头且影响时效,但学术研究长期缺乏公开高质量数据。MilleMiglia 在 GitHub 开源,通过隐私保护的方式捕捉中段运输的多车辆接力、时间窗口与分拣同步等约束,为后续优化研究提供基础。
Google AI & Economy 项目新增诺贝尔经济学奖得主 Philippe Aghion、多伦多大学教授 Ajay Agrawal 等顾问与访问学者。Anu Madgavkar 和 Daniel Rock 将共同领导该研究项目,聚焦全球 AI 扩散、小企业生态与生成式 AI 对劳动力市场的影响。团队将持续更新 ATLAS v1.0 数据并推动实证研究。
Google 工程师与设计师 Jane Wade、Sergio Hudson 合作,基于 Google Flow 打造 Styling Suite 与 Runway Visualization 两款工具。
Google Research 发布基于生成式 UI 的学习互动实验,教师可按课程目标生成定制化互动模拟,覆盖物理、化学、生物和数学中学内容。系统包含分层挑战、脚手架提示与自动校验循环,并已通过教师审核;使用 Google Workspace for Education 的学校可报名 Pilot Program 提供反馈。
推荐理由:教师可按教学目标生成互动模拟并获得分层提示与自动校验,为差异化教学提供了可迁移的方法路径。
summary_zh: 联合国系统推出 UN System Data Commons,基于 Google Data Commons 构建的开源平台,整合全球统计数据为 AI 就绪知识图谱。
Emerald AI、Google 与 NVIDIA 今日联合宣布成立 AI Energy Management Alliance(AEMA),首个专注于让数据中心根据电网状况动态调节用电的联盟。
Google Research提出Retrieve-for-Train框架,用离线强化学习发现属性对齐的查询扩展并编译为监督信号,再蒸馏到53.9M参数的扩散检索器,实现单次非自回归查询扇出。实验显示该方法在开放抽象检索和弱监督组合检索上均优于单查询搜索、零样本扩展和Best-of-N基线,同时实现12–20倍的推理加速。
推荐理由:用离线RL把查询分解编译成监督信号,再注入轻量扩散检索器,在保持集合级属性的同时把推理延迟压低一到两个数量级。
Google DeepMind 发布了 Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking 模型,专注于近实时推理和语音代理。
推荐理由:Google DeepMind 发布了 Gemini 3.8 Live 系列模型,提升实时推理和语音代理能力,支持复杂任务执行与流畅对话,为开发者构建生产级语音代理提供高效工具。
Google 宣布其技术和产品已覆盖全球 300 多种语言、70 亿人,占全球人口 86%。Gemini 3.5 Live Translate 支持 70 种语言、2000+ 语言对的实时口语翻译,Gemini 3.5 Transcribe 提供高精度语音转文本。
推荐理由:原文展示了从文本到音频理解再到端侧翻译的技术路径,读者可以据此判断 Google 在多语言 AI 交互上的最新能力边界。
summary_zh: Google 与全球社区和研究者合作,在疾病预测、自然灾害预警、教育普及和经济机会拓展等关键领域推动 AI 从理论走向可衡量的实际影响。
Google宣布其AI技术已支持超过300种语言,覆盖全球70亿人口(86%全球人口),并发布AI & Economy ATLAS互动洞察。同时公布AlphaGenome Atlas、WeatherNext 3、Planetary Prediction Engine等科学进展与应用。
Google 发布 ATLAS 交互式开放数据体验,并联合 Google DeepMind 与 MIT FutureTech 推出基于 ATLAS 的科学家 AI 使用研究。
summary_zh: NASA 宇航员 Christina Koch 与 Google 高级研究副总裁 James Manyika 对谈,分享在国际空间站停留 328 天、完成首次全女性太空行走及 Artemis II 绕月任务的经历。
summary_zh: DevFest 2026 将于 10 月 1 日至 12 月 31 日在全球 115 国举办超过 800 场活动,由 Google Developer Groups 社区主导。
Google Research 提出 ToolGrad 框架,先生成真实的工具使用链再反推用户提示,仅需单步 LLM 调用即可完成标注。
推荐理由:提出 answer-first 的 ToolGrad 框架,以文本梯度迭代构建工具链,为高效生成高质量工具使用数据提供了可迁移的新范式。
summary_zh: Google Search 的 AI Mode 可通过 Canvas 工具生成个性化训练计划、连接 YouTube Music 创建自定义播放列表,并基于超过 600 亿条商品信息的 Shopping Graph 推荐跑鞋与装备。
summary_zh: Google DeepMind 与 Primordial Soup 合作,为纪录短片《Love, Rendered》用生成式模型修复黑白旧照,并用性能捕捉模型映射 Burt 与 Ethelle 当下的微表情与姿态,将其映射到年轻形象上。
Google Search 推出 Live Game Feed,实时赛事页包含动态时间线、关键视频高光与AI洞察,美国英语移动端已上线,本月将扩展大学球队与全球覆盖。
Google DeepMind 发布了 AlphaGenome Atlas,提供人类基因组中 90 亿个单核苷酸变异的分子影响预测。该平台包含数千个分子效应预测,覆盖多个细胞类型,已在罕见病研究中验证变异功能。AlphaGenome Atlas 通过网站、AlphaGenome API 和 Google Antigravity 提供。
推荐理由:Google DeepMind 发布了 AlphaGenome Atlas,提供人类基因组中 90 亿个单核苷酸变异的分子影响预测,并推出 AVI 分数用于变异影响评估。
Google Research 评估了将 UK Biobank 欧洲 GWAS 结果迁移至 Biobank Japan 约 20 万日本样本的 PRS 性能,覆盖 BMI、血压、血脂等 8 项临床性状。
Google Research与HHMI Janelia及剑桥合作者发布完整雄性果蝇大脑和中枢神经系统连接组,包含166,000个神经元和1.25亿个突触连接,是迄今最大脑图谱。研究利用AI和计算技术构建细胞级全脑图谱,配套Neuroglancer开源可视化工具,并已用于视觉、味觉和社会行为研究。
Google DeepMind 发布 WeatherNext 3,改用实时卫星观测数据直接训练全球天气 AI 模型。模型以 5 公里分辨率、每小时更新生成预报,降水预报 CRPS 最高较 IMERG 提升 60%,并已集成至 Search、Gemini、Maps 及 Google Cloud 平台。
推荐理由:WeatherNext 3 摒弃传统数值天气预报训练数据,改为直接使用实时卫星观测数据,将全球分辨率提升至5公里并实现每小时更新,降水预报CRPS最高改善60%。
Google DeepMind 今日启动 Fairwind Program,为政府和国家网络机构、关键基础设施运营者及技术平台提供 Gemini 3.8 Flash Cyber 与 CodeMender 的有限访问权限,可在组织内部安全云环境中自动发现并修复漏洞,将补丁时间从数周缩短至分钟级。
Google DeepMind 发布 Gemini 3.8 Flash 和 Gemini 3.8 Flash Cyber,前者延续 3.7 Flash 的速度与定价(每百万输入 token 0.75 美元、每百万输出 token 3.75 美元),在软件工程、智能体任务和多步推理上明显提升。
推荐理由:3.8 Flash 在相同价格下把提升集中在长周期编码与智能体任务,读者可据此判断是否替换现有生产模型。
Google 今日推出 Fairwind Program,面向政府机构、企业和网络安全合作伙伴,提供 Gemini 3.8 Flash Cyber 与 CodeMender 组合,以自主方式发现并修复漏洞。参与组织需遵守内部安全团队访问限制与多因素认证等运营标准,目前已有超过 650 家全球合作伙伴。
Google 发布 Gemini 3.7 Flash,定位为编码与智能体工作负载的最强基础模型,定价为 3.6 Flash 的一半;同步推出 Gemini 3.5 Transcribe 语音转文本模型。
推荐理由:Google 在一个月内连续发布两款 Flash 模型并下放到 Pixel 硬件,开发者可以用更低成本构建智能体。
Google DeepMind 在 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite 上推出智能体视频理解功能,视频分析 token 消耗最高降低 88%、成本最高降低 66%、准确率最高提升 7%。
推荐理由:原文给出了 token 与成本降幅的具体数字和 API 启用方式,读者可据此判断长视频分析的成本边界。
Google Pics 基于 Nano Banana 模型,面向 Google AI Pro、Ultra 订阅者及大部分 Workspace 商业用户开放,可进行对象分割、图像内文字编辑与翻译、多选项生成和协作编辑。该工具以独立产品形式推出,并已集成到 Docs 和 Slides,Drive 将在未来几周跟进,使用入口为 pics.new。
推荐理由:原文给出了生成与编辑能力及 Workspace 入口,读者可据此判断它会怎样融入现有办公流程。