Dynamically Scaled Activation Steering(DSAS)方法解析
DSAS 是一种与方法无关的激活转向框架,通过自适应调节转向强度,在仅检测出不需要的行为时才进行干预。该方法在生成时计算上下文相关的缩放因子,可与现有转向方法联合优化,在毒性缓解与效用保持之间取得更好平衡。DSAS 适用于文本到图像扩散模型,计算开销小且能定位需要转向的 token。
DSAS 是一种与方法无关的激活转向框架,通过自适应调节转向强度,在仅检测出不需要的行为时才进行干预。该方法在生成时计算上下文相关的缩放因子,可与现有转向方法联合优化,在毒性缓解与效用保持之间取得更好平衡。DSAS 适用于文本到图像扩散模型,计算开销小且能定位需要转向的 token。
summary_zh: 一家全球金融科技公司在 Together 上将编程智能体流量迁移至 GLM-5.2,采用 Dedicated Model Inference 实现自服务供给、指标 API 和模型灵活性。
OpenAI 声称其最先进 AI 模型解决了 Navier–Stokes 方程相关的千禧年难题,证明该方程在某些情况下会产生奇点,即预测出物理上不可能的无限速度。物理学家和数学家正借助 AI 进一步理解湍流。
推荐理由:AI 证明 Navier–Stokes 方程存在奇点,为流体湍流研究提供了新的数学视角。
ConvexGating 从单细胞细胞术数据的聚类结果中推断最优门控策略,旨在将聚类得到的细胞群体转化为可用于分选的高纯度、低步骤门控方案。flow cytometry、mass cytometry(cyTOF)和 CITE-seq 等高维数据场景中,手动门控依赖操作者经验且存在跨操作者变异,而聚类方法虽能无偏分离细胞却难以直接转为分选策略。
Google Research 发布基于生成式 UI 的学习互动实验,教师可按课程目标生成定制化互动模拟,覆盖物理、化学、生物和数学中学内容。系统包含分层挑战、脚手架提示与自动校验循环,并已通过教师审核;使用 Google Workspace for Education 的学校可报名 Pilot Program 提供反馈。
推荐理由:教师可按教学目标生成互动模拟并获得分层提示与自动校验,为差异化教学提供了可迁移的方法路径。
AI Now Institute 联合主任 Sarah Myers West 指出,以"AI 可能毁灭人类"为前提的监管法案会挤占其他监管思路。她呼吁先厘清 AI 造成危害的具体机制,再讨论缓解措施。
summary_zh: 联合国系统推出 UN System Data Commons,基于 Google Data Commons 构建的开源平台,整合全球统计数据为 AI 就绪知识图谱。
图像编辑基础模型的多模态能力正变得核心,用户可通过指令直接编辑图像。评估这类模型面临挑战,需要闭环的 agentic evaluation 方法。原文未给出具体模型版本、参数规模或 benchmark 分数。
summary_zh: AI Now 联合主任 Amba Kak 于 2026 年 9 月 17 日在 Monopoly Busters Caucus 的"AI 十字路口"听证会上作证,警告 AI 行业将权力进一步集中到少数私营主体手中,并呼吁立法者保护公众免受监控经济的后果。
summary_zh: AI Now Institute 首席 AI 科学家 Heidy Khlaaf 指出,科学主张必须可证伪,不能等同于宗教式断言。核武器已存在 80 余年且具备灭绝人类的能力,但核设施与公共互联网物理隔离(air-gapped),AI 代理难以直接操控;Stuxnet 也需通过物理 USB 驱动器才能侵入核设施系统。
Pawprint Studio 的开放世界捉宠 RPG《Aniimo》本周在 GeForce NOW 首发上线,无需下载 45GB 即可在 Steam Deck、新支持的 Firefox 浏览器等设备串流游玩。
JetBrains 详细记录了 Air Context 语义代码搜索管线的前期工程实践,涵盖解析、结构感知分块、向量化与二进制量化。系统支持九种主流语言,对超长路径和查询作用域做缩写对齐,并强调代码不入库、不用于训练。
Cooley 基于 ChatGPT Work 构建了 GO Public 工具,将智能引入 IPO 流程,帮助律师更早发现潜在问题并聚焦关键判断。
GitHub Copilot运行时从TypeScript重写为Rust,由AI代理主导完成,超过80万行Rust代码。迁移过程实现了性能提升和跨产品共享运行时。
推荐理由:原文详细记录了使用Copilot代理将GitHub Copilot运行时从TypeScript迁移至Rust的过程,性能提升显著,并实现了多产品共享。
研究人员构建了由多达37,000个智能体组成的“虚拟生物药企”,由一位“首席科学家”统筹,以加速药物发现。相关论文发表于Science(doi:10.1126/science.aeg6779),并有bioRxiv预印本(doi:10.64898/2026.04.20.719538)支持。
推荐理由:虚拟生物药企的规模化智能体架构为AI制药提供了可参考的组织范式。
Apple ML Research 发布 REVERSAL-BENCH 基准,通过连续参数 ρ∈[0,1] 控制环境可逆性,并在八种操作设置、五种物理引擎中提供重置预言机与可恢复性标注。评估显示无重置智能体随 ρ 增大持续陷入不可恢复状态,而回合制智能体保持稳定学习;该失效由不可逆性驱动,而非障碍物复杂度,并存在于完整物理仿真与学习操作策略中。
summary_zh: 研究团队利用定量方法对死后海马体组织中的阿尔茨海默病病理特征与微胶质细胞激活进行映射分析。数据来自USC ADRC,使用NACC统一数据集,资助方包括NIH、NSF及Chan Zuckerberg Initiative等。
OpenAI 发布 Astra for Law,为法律行业提供前沿智能、定制化律所工作流、关联法律数据源以及法律级保密控制。方案面向客户保密场景设计,具体模型版本、参数规模与价格信息原文未披露。
Weaviate 1.39 扩展 Rotational Quantization(RQ),新增 4-bit 支持并带来多项量化改进。8-bit RQ 编码速度最高提升 3.8×,4-bit RQ 在保持相似召回率的同时堆内存减少 45%。
Cell 今日发表报告,公布一套面向衰老生物学的人工智能系统,包含基于衰老数据训练的 LLM、17 项基准任务,以及将模型与代理(agent)整合的接口。作者用这些基准评估了专用 LLM 和 OpenAI、DeepSeek 等公司的通用大模型,发现专用模型在多数测试中表现更优。研究指出,衰老尚未有清晰定义,如何训练 AI 理解衰老仍是关键难题。
推荐理由:为衰老生物学专门定制 LLM 与 17 项基准,揭示专用模型在特定领域或优于通用大模型。
Agentic AI 工作流可用于准备和验证物理 AI 系统的数字孪生。Agents 可以检查 3D 场景、在 OpenUSD 中编写仿真相关数据、添加物理属性、渲染预检视图,并针对 SimReady 要求验证结果。该工作流展示了从 Blender 场景到 NVIDIA 仿真就绪 OpenUSD 交付的完整流程。
TensorRT Edge-LLM 在 Jetson AGX Thor 上完成 MLPerf Edge Agentic Benchmark,速度比此前快 6.4 倍。AI Agent 在边缘设备上的多步骤推理与工具调用对推理延迟提出更高要求,TensorRT Edge-LLM 通过优化推理流程提升边缘端 Agent 工作负载的吞吐与响应速度。
summary_zh: AI Now Institute 联合主任 Sarah Myers West 与 Forbes 高级编辑 Maggie McGrath 讨论了企业开发 AI 过程中的透明度问题。
Cloudflare Page Shield ML 在真实流量中捕获8个恶意JS载荷,其中7个在VirusTotal无恶意记录,URLScan也无恶意判定。四个活动分别劫持分成、静默窃取分成、植入后门、控制付费移动访客;系统通过GNN加LLM二审与教师模型投票标注,误报率低于0.3%。
推荐理由:原文展示了Page Shield ML在真实流量中捕获传统扫描遗漏的恶意JS,为依赖签名检测的防御提供了持续浏览器可见性的价值。
PyTorch Foundation 宣布 PyTorch Conference North America 2026 将于 10 月 20–21 日在圣何塞举行,主题为开放研究、工具链与性能优化,涵盖 torch.compile 编译器、Helion/CuteDSL/FlyDSL 等 DSL、分布式训练、低精度量化及 AI Agents 辅助开发等议程。
作者 Tommaso Stocchi 以滑雪度假村演示为例,对比 A2A 专家代理与基于 MCP 的分布式技能两种架构,并给出五步迁移流程。技能路径将专家指令移入编排器,由 SDK 直接加载 SKILL.md 并暴露 MCP 工具;实测显示技能路径模型调用更少(3 次 vs 6-7 次)、延迟更低,但总 token 数反而增加约 22%。
推荐理由:通过同一应用的 A2A 与 MCP 两种架构对比,给出可迁移的迁移步骤与实测延迟和 token 数据,帮助读者判断是否将专家代理改为分布式技能。
PyTorch Blog发布Low Precision Flash Attention 4,在Blackwell上扩展MXFP8前向与反向,前向达2.85 PF/s、反向达2 PF/s,LLM形状较BF16加速1.6×和1.52×。代码已开源至ads_model_kernel_library/lp_fa4。
推荐理由:原文给出了MXFP8前向与反向的PFLOP/s数据及开源地址,读者可据此评估Blackwell训练栈的实际加速效果。
summary_zh: Kubernetes v1.37 新增 emptyDir 权限模式与 bind mount 选项,允许在卷挂载层面直接设置 noexec、nosuid、nodev 及 sticky bit(01777)等标志,无需借助 init container 或变通方案。
summary_zh: AI Now Institute 招聘独立承包制地方政策研究员/土地使用专家,支持数据中心扩张研究项目。该研究员将与 Local Progress 合作,制定三个州级数据中心政策指南,并更新研究模板。
OpenAI 分享了用于追踪、调查和披露模型对齐偏差的框架,并附六份关于模型异常或令人担忧行为的具体报告。
cuTile Rust (cutile-rs) 是一个基于瓦片的系统,用于在 Rust 语言中安全、惯用地编写 GPU kernel。它扩展了 Rust 所有权模型到瓦片式 GPU kernel,将可变输出拆分为不相交片段,并在 kernel 启动间保持宿主端所有权契约。程序员可在需要更低级控制时局部选择退出。
OpenAI 与 AARP 将在美国 10 个城市为 1,000 名老年人举办免费 ChatGPT 实操工作坊,帮助他们安全地掌握实用 AI 技能。
Lambda 在 MLPerf Inference v6.1 提交结果,首次在数据中心硬件上运行智能体推理基准,并部署超过万亿参数的 Kimi K2.6 模型。
推荐理由:Lambda在MLPerf Inference v6.1提交了首个数据中心硬件上的智能体基准和万亿参数模型部署,并给出与v6.0的同比性能提升数据。
NVIDIA 官方发布 Vera Rubin NVL72 在 MLPerf Inference v6.1 的预览结果,在 DeepSeek-R1 和 Qwen3-VL 上分别较 GB300 NVL72 提升最高 2.5x 和 3.7x 吞吐。
推荐理由:NVIDIA 官方公布 Vera Rubin NVL72 在 MLPerf Inference v6.1 的首秀成绩,读者可据此对比新旧平台推理吞吐与扩展效率。
MIT与协作机构开发xvr(X-ray volume registration)技术,利用患者术前3D扫描生成数千张合成X射线训练AI模型,可在数秒内将术中2D X射线与3D扫描精准对齐,精度达亚毫米级。 该模型在覆盖多医院、多器官系统的最大真实注册数据集上,比现有AI方法精度提升一个数量级,适配新患者仅需约5分钟。
推荐理由:该方法通过患者特异性合成数据训练,在真实数据集上显著超越现有AI方法,或提升微创手术的安全性与可及性。
Emerald AI、Google 与 NVIDIA 今日联合宣布成立 AI Energy Management Alliance(AEMA),首个专注于让数据中心根据电网状况动态调节用电的联盟。
ChatGPT Work 与 Codex 分析帮助团队理解 AI 使用量和支出,识别培训需求,并将采用情况与业务结果关联。
Mistral 为 Mozilla Firefox Smart Window(beta)提供模型支持,该 AI 浏览助手目前面向法国和北美用户,英国和德国今年晚些时候跟进。Firefox Smart Window 默认不保存对话记录,Mistral 承诺零数据保留,双方共同强调用户控制与开源分发。
GPT-6 Astra 帮助 Hex 的数据代理将分析答案转化为可交互可视化报告,使员工愿意分享这些可视化内容。
OpenAI 新经济研究显示工作者将 AI 用于传统角色之外的新活动,并使部分 AI 任务成为日常工作 recurring part。原文未披露具体模型、版本号、参数规模、benchmark 分数、速度倍数、价格或上下文长度等可验证数字与可用性信息。