在 Claude Science 中运行 NVIDIA BioNeMo NIM 微服务进行蛋白质结构预测
summary_zh: NVIDIA BioNeMo NIM 微服务可在 Claude Science 中用于蛋白质结构预测。Agentic AI 正在改变科研方式,AI 科学家能阅读论文、提出假设、调用模型并决定实验优先级。
summary_zh: NVIDIA BioNeMo NIM 微服务可在 Claude Science 中用于蛋白质结构预测。Agentic AI 正在改变科研方式,AI 科学家能阅读论文、提出假设、调用模型并决定实验优先级。
summary_zh: NVIDIA Omniverse NuRec 帮助将自动驾驶感知栈从一款车型迁移到另一款车型(如从 SUV 到轿车),以应对传感器布局、标定、视场、遮挡、车身几何、时序和覆盖范围的变化。
JuliaHub 推出 Dyad 3.0,帮助工程团队通过自主 AI 智能体完成物理仿真、安全分析与质量校验,并依据物理定律修正设计。Julia 用户已超 100 万,被用于模拟电路、气候建模、疫苗研发和飞机防撞系统。
推荐理由:原文给出 Dyad 3.0 的物理约束能力和 Boeing 等客户案例,读者可据此判断工程设计的自动化边界。
summary_zh: Ollama 的 Pro、Max 和 Team 计划改为透明按 Token 定价,每月包含固定额度用完后仍按同单价续用。新 Pro $20/月含 $60、Max $100/月含 $300、Team $500/月含 $1,000 共享额度,支持 Claude Code、Codex 和 API,零数据留存,免费计划也可按量使用。
Kubernetes 1.37 将 Pod Certificates 与 Cluster Trust Bundles 带入 GA,在 Kubelet 内直接内置 X.509 证书签发能力,用于 TLS 与 mTLS。
NVIDIA TensorRT Model Connect 提供参考实现,帮助开发者将开源模型通过 C++ 直接接入 TensorRT 推理。原文指出该工具链可减少模型特定的转换、预处理、后处理及运行时代码编写。两行命令即可完成从 checkpoint 到原生推理的部署。
Hugging Face 与 Voice Arena 合作在 Open ASR Leaderboard 推出 Monsoon en-IN 和 Monsoon hi-IN 评测集,覆盖印度英语和印地语。
推荐理由:新增 Hindi 与 Indian English 评测集让 ASR 错误率的地域、人口和设备差异可被追踪,读者可据此评估模型在多元人群上的真实表现。
Kubernetes v1.37 将 metrics.k8s.io API 从 beta 晋升为稳定版 v1,提供节点与 Pod 的 CPU 和内存使用量,与 v1beta1 资源类型和字段完全一致。kubectl top 已支持 v1 并自动回退,HPA 控制器目前仍仅支持 v1beta1。该 API 通过 API 聚合层由 metrics-server 等实现提供,无需启用特性门控。
Google 搜索 AI Mode 新增三项旅行规划功能:航班价格追踪、里程积分价格显示和酒店预订。航班价格追踪已覆盖全球 180 多个国家和地区;里程积分显示首批支持 Alaska Airlines、American Airlines、Hilton 等多家航司和酒店集团。酒店预订在美国英文版上线,集成 Booking.com、Expedia、IHG 等合作伙伴。
ChatGPT Work 在遇到登录页时会暂停并显示表单小组件,用户可在其中输入用户名、密码和 2FA 码,凭证直接传给云端浏览器而不会进入聊天,登录后可继续执行任务,会话可在设置中清除。
summary_zh: Google DeepMind 联合新加坡 AI 安全研究所、OpenMined、AVERI 和 MLCommons,对 Gemini Flash Lite 模型开展全球首个双盲评估,外部评测被限制在加密环境中,防止模型提前接触测试题目。
Weaviate 1.39 发布,Boost API 与 MMR 多样性选择进入正式可用,4-bit 旋转量化预览、Search REST API 实验性上线,HNSW 快照改为自动。
推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。
Microsoft Agent Framework 发布 Python 通道包,支持 OpenAI Responses、Telegram、A2A 和 MCP 协议接入。
推荐理由:原文给出了多协议接入能力和共享状态模型,开发者可据此判断是否需要将现有 Agent Framework 应用扩展到新的通道。
Goodfire推出Silico平台并开放公众使用,同时提供100万美元免费使用额度支持学术和非营利研究。平台基于机械可解释性,结合多种工具与AI代理,帮助用户调查模型行为,如幻觉成因,并已用于发现阿尔茨海默病新生物标志物。
Kubernetes v1.37 发布,主题为 Garhwal,包含 67 项增强,其中 16 项升为 Stable、23 项升为 Beta、27 项进入 Alpha、1 项弃用。Stable 特性包括弹性 watchcache 初始化,Beta 特性包括 HorizontalPodAutoscaler 缩放到零和基于清单的准入控制配置,Alpha 特性包括 Pod 级检查点与恢复。
NVIDIA Dynamo 推出 Shadow Engine Recovery 预览功能,在 LLM 引擎进程失败时实现秒级恢复,避免冷启动带来的权重加载、kernel 编译和 CUDA graph 捕获开销。
推荐理由:原文给出热恢复能力与秒级恢复入口,读者可据此评估它对推理可用性的实际影响。
summary_zh: Google Search 提供 5 种工具帮助用户升级家居装饰:AI Mode 可上传房间照片可视化推荐沙发并生成预览;Google Lens 可识别复古物品并搜索相似商品。
NVIDIA 发布 CUDA Python 1.0,提供稳定的公共 API,让 Python 开发者无需深入 CUDA C++ 即可直接访问 GPU。统一基础层减少对 PyTorch、CuPy、RAPIDS 等上层库的依赖,降低维护绑定与构建工具链的成本。完整平台访问使开发者能更灵活地编写 GPU 加速代码,推动 Python GPU 生态进一步发展。
Claude Code Remote Control 更新支持从手机启动新会话、笔记本电脑与手机断线后自动恢复,iOS 上会话加载更快。Claude Academy 推出 Anthropic 免费的课程、教程和岗位指南。
Ollobot 推出 AI 家庭伴侣机器人 OlloNi SS1,通过主动交互、情绪感知和持续在场填补现有技术的空白。全球 AI 伴侣市场预计从 2026 年的 480 亿美元增长至 2033 年的 3180 亿美元,年复合增长率 31%。
开发者可将 Claude Desktop 配置为通过 Ollama 作为第三方网关,同时使用本地模型和 Ollama 云端模型。连接后可在 Ollama 内切换 Anthropic 模型或关闭功能恢复原设置。默认关闭遥测,Ollama 对所有模型和服务执行严格零数据保留策略。
summary_zh: NVIDIA Vera Rubin 与 Blackwell 面向 Agentic AI 推理推出新性能基准。OpenRouter 报告显示真实使用中平均每请求 prompt tokens 增长约 4 倍。
summary_zh: AI 工厂是受电力约束的工业系统,衡量效率的关键指标已从 GPU 数量转向每瓦 AI 输出。NVIDIA DSX MaxLPS 针对推理负载优化应用级每瓦性能,关注电力分配与冷却等非计算环节的能耗。
summary_zh: NVIDIA 提出 Vera CPU 应对 Agentic AI 集群调度难题,指出 AI 工厂中 GPU 负责运行模型,CPU 负责编排、工具执行与沙箱计算,而智能体工作负载具有不可预测和高动态特性。
NVIDIA BlueField-4 DPU 为 Agentic AI 工厂提供专用数据处理能力,支撑多 Terabit 带宽下的线速网络、存储与安全。传统云基础设施面向通用工作负载设计,而 Agentic AI 工厂需连接多样用户、智能体、应用、数据源与存储系统至大规模加速计算单元。
NVIDIA Groq 3 LPX 是 NVIDIA Vera Rubin 平台的交互式 AI 推理加速器,与 Vera Rubin NVL72 搭配后扩展平台能力,覆盖从小模型到大模型、开源到闭源的最广泛 AI 工作负载。Vera Rubin NVL72 是迄今最通用的机器,提供高吞吐与交互性。
Balaji Ingole在B2B电商公司Amla领导AI驱动的数字转型项目,开发AI智能体帮助制造商在电商平台自动完成商品上架。传统商品设置需手动处理数千产品、耗时2至3个月,AI工具可大幅缩短这一流程。目前文章未披露具体模型版本、参数规模或benchmark分数。
Google Research 提出 Biomarker Discovery Framework,一个多智能体系统,用于从可穿戴传感器数据中优先排序候选生物标志物。在三个队列共9,279名参与者-观测中,框架自主识别了41个心理健康和25个代谢候选数字生物标志物。框架结合假设生成、统计分析、对抗验证和文献推理,通过11项内部检查电池分配报告标签,保持统计严谨性与人类监督。
AdaptGrow 是 GPU 加速的矩阵分解算法,将滚动相关性与尾部依赖矩阵转化为硬聚类、软因子载荷和结构断裂信号,支持单 GPU 与多节点规模运行。该算法面向量化策略中的投资组合构建、风险聚合、统计套利与交易监控场景,解决错误分组带来的风险。
Spotfire Industry Pro 演示了如何利用 Agentic AI、跨域可视化和下沉式计算,在数十亿数据点中加速多领域根因调查。Agentic AI 自动完成跨域分析与可视化生成,帮助半导体工程师在不移动数据的前提下连接不同系统的洞察。
NVIDIA AVO 在 ARC-AGI-3 上达到 100%,展示面向长时程自主智能体的前沿通用架构。AVO 强调智能体系统(harness)在上下文接收、工具使用、状态维护、反馈响应、失败恢复与长任务持续上的关键作用。原文未给出具体模型版本号、参数规模、benchmark 分数细节、速度倍数、价格或开源/闭源信息。
NVIDIA 基于 OpenShell 及生态合作,梳理了 AI Agent Stack 各层的安全与信任构建思路。文章分析了安全在智能体长期运行中的角色,并给出每层应承担的安全职责。
summary_zh: Google DeepMind 回顾十五年来从 Atari 到 EVE Online 的游戏 AI 研究,与 Fenris Creations 等游戏工作室合作开发 SIMA 多世界智能体。
Papers with Code 构建混合搜索系统,结合 PostgreSQL 全文检索与 pgvector 语义检索,并使用 RRF 算法融合结果。系统依赖 Hugging Face Jobs 进行批量 embedding 构建、Storage Buckets 存储持久化产物、Inference Endpoints 提供低延迟在线查询 embedding。
Liquid AI发布LFM2.5-DSpark推测解码草稿模型,为LFM2.5-1.2B-Instruct、LFM2.5-2.6B和LFM2.5-8B-A1B三款模型提供最高3.2倍GPU加速与最高2.87倍端侧加速。函数调用延迟平均降低57%,llama.cpp与SGLang已支持首日集成。
Skala 1.1 在 GMTKN55 上加权误差达 2.8 kcal/mol,在 55 个类别中 32 个达到最优,同时保持半局域泛函的计算效率。Skala 已登陆 CP2K,并正在集成至 Psi4、FHI-aims、ORCA 和 VASP;微软研究院同步推出持续更新的性能基准报告。
推荐理由:原文给出精度提升与多软件集成进展,读者可据此评估 Skala 在现有计算化学工作流中的可用性。
summary_zh: 生成式推荐系统将目标从基于嵌入相似度的传统目标,转变为在大型商品目录中根据用户历史序列预测下一个动作或物品。LLM 的兴起推动了这一从判别式到生成式的范式转变,使推荐系统能够建模更复杂的用户行为序列。
个人智能体本质上只是文件与工具的连接器,记忆也仅是会话开始时读取的文件。Ben 分享了清理后的 AGENTS.md 写法:把问题视为请求回答而非修改,并预告明天展示自己搭建个人智能体的完整会话。
Mistral 发布 Agentic Search 检索层,通过 search、open、navigate、read、grep 五个工具让模型多步检索、打开并核对文档,已集成进 Mistral Search Toolkit 以及 Studio 和 Vibe 的 Libraries。
推荐理由:原文用 FinanceBench 和 OfficeQA Pro 两组基准对比一次性 RAG 与多步检索循环,读者可借此了解复杂文档检索的取舍。
summary_zh: NVIDIA Holoscan 是构建实时边缘 AI 应用的平台,HoloHub 为其配套仓库,提供参考应用与组件。开发者可使用通用编码智能体调用与工程师相同的示例、文档和开发工具。