Skip to content

产品更新

AI 产品与应用的功能上新、改版与商业化动态——谁家的产品变强了、变贵了、能用了。

241 selectedRelated topics模型发布行业动态AI 编码

Latest selected

181–200 of 241
Jun 30Tue
  1. Hugging Face Blog60

    Every Eval Ever 与 Hugging Face 社区评测实现互操作,转换器自动同步评测结果

    Every Eval Ever 与 Hugging Face 社区评测现已实现互操作,官方提供了转换器工具,可自动将 EEE 评测记录同步为模型仓库中的 YAML 文件。数据存储已收录约 22.9 万条评测结果,覆盖 2.2 万个模型和 2200 个基准。该工具支持 MMLU-Pro、GPQA、HLE 和 GSM8K 四项基准,并在写入前自动审核冲突。

    Why it matters: EEE与Hugging Face社区评测现在可互操作,转换器自动将EEE记录写入YAML文件并审核冲突,解决评测结果分散难以对比的长期问题。

Jun 29Mon
  1. Ollama Blog73

    Ollama 0.31 推出 Gemma 4 多Token预测加速

    Ollama 0.31 在 Apple Silicon 上为 Gemma 4 启用多Token预测(MTP),在 Aider polyglot 基准上生成速度提升近 90%,且不改变模型输出。系统自动调节 draft 长度,无需配置;Ollama 还向 MLX 贡献了批量验证内核。升级方式为重新拉取 gemma4:12b-mlx 并用 ollama launch 启动编码智能体。

    Why it matters: Ollama 为 Gemma 4 带来近 90% 的生成加速且无需配置,读者可据此评估 Apple Silicon 上的编码智能体工作流是否能直接受益。

Jun 25Thu
  1. Weaviate Blog72

    Weaviate 1.38 发布:HFresh 与 MCP Server 进入通用可用

    Weaviate v1.38 开源版与云版本同步发布,HFresh 磁盘向量索引与内置 MCP Server 达到通用可用。异步复制改为集群级单调度器并默认开启,Boost API 与嵌套对象过滤作为预览功能加入。

    Why it matters: HFresh 与 MCP Server 同时进入 GA,读写分离的运行时配置和集群级异步复制重构对运维方式有直接影响。

  2. Google DeepMind60

    Gemini 3.5 Flash 新增计算机使用功能,支持构建跨平台智能体

    Gemini 3.5 Flash 内置计算机使用能力,开发者可通过 Gemini API 和企业平台构建跨浏览器、移动端与桌面的自定义智能体。该功能此前仅作为独立的 Gemini 2.5 计算机使用模型提供,现原生集成至 Flash 模型,并配备提示注入对抗训练及可选的企业安全防护系统。

    Why it matters: 计算机使用功能从独立模型整合进3.5 Flash,开发者可通过API和企业平台构建跨浏览器、移动端与桌面的自定义智能体,并配备提示注入防护与企业级安全机制。

Jun 11Thu
  1. Ollama Blog62

    Ollama MLX引擎在Apple Silicon上性能再提升,支持NVFP4与快照系统

    Ollama更新MLX引擎,在Apple Silicon上最高提速20%,并新增对NVIDIA NVFP4格式的支持,使模型量化质量损失约为q4_K_M的一半。Ollama推出快照系统,在Agent多子Agent切换、思考模型推理和分支重试时保存模型状态,避免重复处理上下文。用户可下载最新版Ollama后运行gemma4:12b-mlx模型,或通过ollama launch在编码Agent中使用。

    Why it matters: Ollama在Apple Silicon上通过MLX引擎支持NVFP4格式并引入快照系统,读者可据此评估本地Agent工作流的性能提升与跨端部署可能性。

Jun 10Wed
  1. Amazon Science76

    AWS EC2 M9g 实例推出经形式化验证的隔离引擎

    AWS 宣布 EC2 M9g 和 M9gd 实例正式可用,首次搭载 Graviton5 处理器并配备 Nitro Isolation Engine。该组件是首个部署在商用云环境的形式化验证 Hypervisor,使用 Isabelle/HOL 完成 33 万行机器检查数学证明,涵盖保密性、完整性、功能正确性、无运行时错误和内存安全。

    Why it matters: 给出了可量化的验证规模和语言选择,读者可以据此评估云虚拟机隔离的形式化保障程度。

Jun 5Fri
Jun 3Wed
  1. Weaviate Blog67

    Engram 正式发布:面向 Agent 的托管记忆与上下文服务

    Weaviate 宣布 Engram 正式可用,这是一项托管记忆与上下文服务,将原始噪声事件转化为结构化、可持久化、有作用域的记忆,并通过 Weaviate 混合检索提供统一读取。服务包含异步管道、去重与确定性 reconciliation,以及个性化、持续学习和多 agent 状态的现成模板,底层具备 Temporal 级持久性和项目/用户/属性级隔离。

    Why it matters: 原文给出从原始事件到结构化记忆的管理路径,读者可据此判断它能否解决长上下文退化与多 agent 上下文碎片问题。

May 28Thu
  1. Mistral AI62

    Mistral 在 AI Now Summit 2026 发布工业 AI 栈与 Vibe 智能体

    Mistral 在 AI Now Summit 2026 推出面向工业工程的 AI 栈,并宣布与 Airbus、BMW、ASML 合作,覆盖设计、仿真与生产环节。Vibe 被升级为可处理长周期任务的统一智能体,同时法国 Les Ulis 新建 10 MW 数据中心计划于 2026 年 Q3 开放。

    Why it matters: 原文给出了工业 AI 栈与 Vibe 智能体的能力边界,读者可据此判断 Mistral 在企业级工作流中的差异化定位。

  2. Mistral AI63

    Mistral AI 发布 Search Toolkit 公测版

    Mistral AI 发布 Search Toolkit 公测版,这是一个可组合框架,用于构建面向 AI 应用的生产级搜索流水线。框架将摄入、检索和评估统一在单一接口下,减少团队组装基础设施的时间,并内置召回率、精确率、MRR 和 NDCG 等评估指标。

    Why it matters: 将摄入、检索与评估统一到单一框架,减少团队在集成上的工程开销,使其能专注于搜索质量本身的持续优化。

  3. Ollama Blog76

    OpenJarvis 1.0 发布:本地优先的个人 AI 代理现可通过 Ollama 运行

    OpenJarvis 是斯坦福 Hazy Research 与 Scaling Intelligence 实验室推出的开源框架,1.0 版现已发布并内置 Ollama 支持。框架默认本地运行模型,云端可选,并追踪能耗、成本与延迟。安装脚本自动检测现有 Ollama,用户可拉取如 qwen3.5:35b 等模型,并使用晨间简报、跨文件研究和本地编码等内置代理预设。

    Why it matters: 原文给出本地优先框架与 Ollama 集成入口,读者可据此评估本地 Agent 工作流的可行性。

May 22Fri
  1. Mistral AI64

    Mistral Studio 发布 Connectors 支持内置与自定义 MCP

    Mistral 在 Studio 发布 Connectors,使内置与自定义 MCP 可通过 API/SDK 用于所有模型和 Agent 调用,并支持直接工具调用与人工审批流程。开发者可将企业集成封装为可复用实体集中注册,减少重复搭建与认证壁垒。

    Why it matters: Studio 新增 Connectors 与直接工具调用,开发者可将企业集成封装为可复用实体并在 LeChat 与 AI Studio 间共享,减少重复搭建与认证壁垒。

May 19Tue
  1. Together AI73

    Together AI 发布编码智能体推理基准测试

    Together AI 推出面向编码智能体的规模化推理基准,测试长提示(45k–200k token)、高并发与短输出(平均 450 token)场景下的 TPM、TPS 与 p50 TTFT。

    Why it matters: 原文给出了一套高并发长上下文编码智能体的基准测试方法与退化曲线,读者可据此评估自研或商用引擎在真实负载下的 TTFT 与吞吐表现。

May 17Sun
  1. Google DeepMind62

    Google 扩展内容透明度工具,SynthID 验证进入搜索与 Chrome

    Google 正在把内容透明度与验证工具扩展到搜索、Gemini、Chrome、Pixel 和 Google Cloud。SynthID 已为超过 1000 亿张图片和视频、6 万年音频加上水印,Gemini 应用中的验证功能已被使用 5000 万次,并将在未来几周扩展到搜索和 Chrome。

    Why it matters: 原文列出了 SynthID 与 C2PA 在搜索、Chrome、Pixel 上的落地范围,可据此判断内容溯源的行业分工。

May 16Sat
May 14Thu
  1. Kubernetes AI73

    Kubernetes v1.36 推进工作负载感知调度

    Kubernetes v1.36 将 Workload API 改为静态模板,并引入独立的 PodGroup API 与专用的 PodGroup 调度周期,实现原子级工作负载调度。同时推出拓扑感知调度、工作负载感知抢占、PodGroup 的 DRA ResourceClaim 支持,以及 Job 控制器与新一代 API 的首批集成。所有功能均以 Alpha 特性提供,需启用对应的功能开关。

    Why it matters: 原文给出了架构升级和多项新功能,读者可以据此评估它对大规模 AI 训练与批处理工作流的实际影响。

May 13Wed
  1. Kubernetes AI60

    Kubernetes v1.36:PSI 指标正式毕业至 GA

    Kubernetes v1.36 将节点、Pod 和容器层级的 PSI 压力指标升级为稳定可用(GA),不再需要功能门控。Kubelet 会先检测内核是否支持 PSI 再上报,避免旧版本在内核未启用时输出误导性零值。

    Why it matters: 原文给出资源占用实测数据,读者可据此判断在生产集群启用 PSI 监控的额外开销是否在可接受范围内。