Skip to content

产品更新

AI 产品与应用的功能上新、改版与商业化动态——谁家的产品变强了、变贵了、能用了。

242 selectedRelated topics模型发布行业动态AI 编码

Latest selected

101–120 of 242
Sep 18Fri
  1. LangChain · Official75

    Included Health 基于 LangGraph 与 Deep Agents 构建联邦医疗导航智能体

    Included Health 推出基于 LangGraph 与 Deep Agents 的 Dot 医疗导航智能体,采用联邦多智能体架构处理保险、预约与专科转介等场景。系统通过共享技能注册表与全局语气提示保持跨团队一致性,并内置人工介入与 LangSmith 临床审核闭环。上线后聊天参与度提升 75%,临床路由一致率超 95%,高风险识别率超 99%。

    Why it matters: 原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。

Sep 17Thu
  1. GitHub Blog · AI & ML78

    GitHub Copilot运行时迁移至Rust,使用Copilot

    GitHub Copilot运行时从TypeScript重写为Rust,由AI代理主导完成,超过80万行Rust代码。迁移过程实现了性能提升和跨产品共享运行时。

    Why it matters: 原文详细记录了使用Copilot代理将GitHub Copilot运行时从TypeScript迁移至Rust的过程,性能提升显著,并实现了多产品共享。

  2. Cloudflare · AI72

    Cloudflare Client-Side Security 在线下商店发现4个恶意JS活动

    Cloudflare Page Shield ML 在真实流量中捕获8个恶意JS载荷,其中7个在VirusTotal无恶意记录,URLScan也无恶意判定。四个活动分别劫持分成、静默窃取分成、植入后门、控制付费移动访客;系统通过GNN加LLM二审与教师模型投票标注,误报率低于0.3%。

    Why it matters: 原文展示了Page Shield ML在真实流量中捕获传统扫描遗漏的恶意JS,为依赖签名检测的防御提供了持续浏览器可见性的价值。

Sep 16Wed
  1. Latent Space88

    TypeSafe 发布 Jev:专注决策而非文本生成的前沿模型

    TypeSafe 发布 Jev,基于 RLCD 训练,宣称比小型前沿 LLM 快 20–200 倍、便宜 40–400 倍,输出 token 免费。社区指出它并非通用语言模型,更接近结构化分类器或裁判模型,适合替代生产系统中的 LLM 路由与判断。

    Why it matters: 原文给出 Jev 在延迟与成本上的具体倍数优势,读者可据此判断其是否值得替代现有分类器与路由策略。

  2. NVIDIA Blog62

    曼彻斯特大学利用 NVIDIA Earth-2 预测英国空气污染

    曼彻斯特大学与 NVIDIA Earth-2 团队基于 Isambard-AI 训练 Earth-2 CorrDiff 和 StormCast,生成了分辨率 2-3 平方公里的英国全域污染模型,训练仅用两天。同一工作流可在 DGX Spark 桌面系统运行推理,作者计划开源训练数据与工作流,并展望由智能体接口驱动的实时污染问答。

    Why it matters: 展示了生成式AI模型从国家级超算到桌面设备的可迁移路径,降低了污染建模的硬件门槛。

  3. NVIDIA Blog65

    NVIDIA AI Infra Summit 发布 Vera Rubin 与 DSX 平台升级,展示每瓦特 token 优化成果

    NVIDIA 在 AI Infra Summit 公布 Vera Rubin NVL72 与 DSX 平台新成果,MLPerf Inference v6.1 中 Vera Rubin NVL72 较 GB300 NVL72 吞吐量提升最高 3.7 倍,DSX MaxLPS 在相同功耗下集群 token 吞吐量提升 24%、每瓦性能提升 23%。

    Why it matters: AI基础设施的关键指标正从峰值性能转向每兆瓦智能体token数,读者可据此评估自身AI工厂的能效与扩容空间。

  4. Google AI Blog62

    Google 发布多语言 AI 产品矩阵,覆盖 300 种语言及 1000 种语言计划

    Google 宣布其技术和产品已覆盖全球 300 多种语言、70 亿人,占全球人口 86%。Gemini 3.5 Live Translate 支持 70 种语言、2000+ 语言对的实时口语翻译,Gemini 3.5 Transcribe 提供高精度语音转文本。

    Why it matters: 原文展示了从文本到音频理解再到端侧翻译的技术路径,读者可以据此判断 Google 在多语言 AI 交互上的最新能力边界。

Sep 15Tue
  1. Cloudflare · AI79

    Cloudflare 推出 Disallow AI Training 设置,可在不影响搜索索引的前提下拒绝 AI 训练爬虫

    Cloudflare 发布新的 Disallow AI Training 设置,允许网站在保持搜索可发现性的同时拒绝混合型爬虫进行 AI 训练。Apple、Google 和 Microsoft 已承诺遵守该设置。

    Why it matters: 原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。

  2. NVIDIA Blog67

    费城儿童医院基于开源 NVIDIA AI 工具实现儿童心脏建模

    费城儿童医院使用 MONAI 等开源工具,将儿童心脏建模时间从数小时缩短到秒级,已用于术前规划和部分手术。波士顿儿童医院将建模用于约半数心脏手术,医院间正组建开源联盟。

    Why it matters: 原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。

  3. LangChain · Official76

    LangChain 推出付费媒体智能体并开源

    LangChain 发布并开源了 Paid Media Agent,六个月内将付费渠道贡献从 0 提升至营销管道的 20%,合格线索成本下降 30%。该智能体以 Slack 为界面,每周汇总广告平台与仓库数据,生成报告并提出关键词、定向和素材变更建议;团队可在会话中追问、审批后执行,同时通过代码计算与确定性规则保障结果可复现。

    Why it matters: LangChain 分享了付费媒体智能体的架构设计与成本优化路径,读者可借鉴其工作台与技能分层模式来构建自己的分析型 Agent。

Sep 14Mon
  1. LangChain · Official60

    LangChain Managed Deep Agents 发布 Connections:托管凭证与调用者身份

    LangChain 推出 Connections 功能,为 Managed Deep Agents 提供命名凭证与按调用者解析的身份机制。凭证分为 agent 拥有和用户拥有两种,类型分别为静态密钥与 OAuth 授权,通过 connections.get() 在运行时按 slug 读取。

    Why it matters: 原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。

Sep 12Sat
Sep 11Fri
  1. Together AI69

    Together AI 扩展微调服务:新增模型、实时指标与更细粒度控制

    Together AI 升级微调平台,新增 GLM-5.3、Kimi K2.7、DeepSeek-V4-Flash、Qwen 3.8-27B、Gemma 4 等开源模型支持,并引入实验实时追踪、Expert LoRA、早停、任意批量大小、样本权重、预飞行校验与打包控制等功能。

    Why it matters: 原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。

  2. Kubernetes AI62

    Kubernetes v1.37 调度器支持原地 Pod 扩容抢占(Alpha)

    Kubernetes v1.37 引入 InPlacePodVerticalScalingSchedulerPreemption 特性门控,允许调度器为原地扩容被 deferred 的 Pod 主动抢占同节点低优先级工作负载。原文给出从创建 kind 集群、配置 PriorityClass、触发扩容到观察 Preempted 事件的完整演示步骤。

    Why it matters: 原文给出了调度器主动抢占低优先级工作负载的机制,读者可以据此评估集群密度与关键服务响应性的平衡。

Sep 10Thu
  1. Hugging Face Blog67

    Gradio Workflow 重建 AUTOMATIC1111 工作流

    Hugging Face 用 Gradio Workflow 重建了 AUTOMATIC1111 的核心功能,形成包含 11 条媒体管道、73 个节点的单一工作流画布,涵盖文生图、高分辨率修复、图生图、提示词矩阵、VLM 问答、检测到 inpaint 掩码、ControlNet 风格标注器、背景去除、PNG Info 读取和图生视频。

    Why it matters: 原文展示了用同一套画布串联多种模型与媒体管道的构建方式,读者可据此评估 gr.Workflow 在多模态工作流中的可复用性。

  2. Together AI69

    Together AI 推出抢占式计算:相同算力半价

    Together AI 公开预览抢占式计算节点,算力与标准节点相同,按 sub-hourly 计费为按需价的 50%。回收时有 5 分钟 drain 窗口,节点标注 together.ai/compute-class=preemptible,适合可 checkpoint 或重试的短实验、推理突发和批处理任务。

    Why it matters: 原文给出了成本变化和开放入口,读者可以据此判断它会怎样改变现有工作流。

Sep 9Wed
  1. Kubernetes AI60

    Kubernetes v1.37 推进 Workload-Aware Scheduling

    Kubernetes v1.37 将 Workload/PodGroup API、gang scheduling 与 Workload-Aware Preemption 升级至 Beta,并引入支持多层拓扑约束与抢占策略的 CompositePodGroup API。

    Why it matters: 核心 WAS API 升级到 Beta 并引入 CompositePodGroup,用户可据此评估分层调度和抢占策略对分布式训练与推理工作流的影响。

  2. LangChain · Official76

    LangChain deepagents 新增子代理上下文模式:支持 fork 与 isolated

    LangChain 在 deepagents 中引入子代理上下文模式,支持 isolated(默认隔离上下文)和 fork(继承监督者完整对话)两种模式。fork 模式可复用监督者上下文、减少重复工具调用并享受 prompt caching,适用于 worker 类子代理;isolated 模式适用于 verifier 和 researcher 等需要独立判断的场景。

    Why it matters: 原文给出了两种上下文模式与适用场景,读者可据此在worker和verifier之间选择合适的子代理隔离策略。

Sep 5Sat
  1. GitHub Blog · AI & ML60

    GitHub Copilot Project HydraFusion:通过多模型编排实现前沿质量

    GitHub Copilot 发布 Project HydraFusion 研究预览,通过运行时多模型编排自动选择工作流以平衡性能、成本和延迟。在 TerminalBench 2.1 上比 Claude Opus 5 质量提升 4.9 个百分点且成本降低 67%,DeepSWE 和 CheckpointBench 上也接近 Opus 5 水平。

    Why it matters: HydraFusion通过多模型编排自动选择最优工作流,在三个编码基准中以显著成本降低逼近Claude Opus 5的性能,为开发者提供无需手动协调模型的前沿质量编码体验。