跳到正文

#产品更新

今日 112 条
2月16日周一
  1. Ollama Blog60

    Ollama 在 Claude Code 中支持 Subagents 与网页搜索

    Ollama 在 Claude Code 中新增 Subagents 与网页搜索功能,无需 MCP 服务器或 API Key。Subagents 可并行执行文件搜索、代码探索和研究等任务;网页搜索内建于 Anthropic 兼容层,模型需要最新信息时由 Ollama 直接返回结果。推荐云端模型包括 minimax-m2.5、glm-5 与 kimi-k2.5。

    推荐理由:原文给出无需 MCP 与 API Key 的入口,读者可据此判断它能否降低 Claude Code 的接入成本。

2月12日周四
  1. Together AI62

    Together AI 推出 Dedicated Container Inference,定制模型推理速度最高提升 2.6 倍

    Together AI 发布 Dedicated Container Inference,支持用户以 Docker 容器方式部署自定义生成式媒体模型,并由平台负责自动扩缩容、队列、流量隔离与监控。客户实测视频生成等任务推理速度提升 1.4–2.6 倍;在 Together GPU Cloud 训练的模型可直接部署,无需传输产物。

    推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。

2月5日周四
2月1日周日
1月28日周三
  1. Mistral AI61

    Mistral 发布终端编码智能体 Mistral Vibe 2.0

    Mistral 发布终端编码智能体 Mistral Vibe 2.0,由 Devstral 2 模型族驱动,新增自定义子智能体、多选项澄清、斜杠命令技能和统一智能体模式。

    推荐理由:原文列出子智能体、斜杠命令技能等可配置能力与付费方式,读者可据此判断终端编码智能体的团队落地成本。

1月23日周五
1月22日周四
1月16日周五
  1. Ollama Blog76

    Ollama 兼容 Anthropic API,Claude Code 可使用开源模型

    Ollama v0.14.0 起兼容 Anthropic Messages API,Claude Code 可通过 --model 指定本地模型(如 gpt-oss:20b、qwen3-coder)或云端模型(如 glm-4.7:cloud、minimax-m2.1:cloud)运行,并支持工具调用、流式对话、系统提示与视觉输入。

    推荐理由:Ollama 兼容 Anthropic API 后,Claude Code 可直连本地或云端开源模型,为开发者提供无需切换平台即可替换模型的选择。

1月15日周四
10月29日周三
  1. Ollama Blog62

    OpenAI 发布 gpt-oss-safeguard 开源安全推理模型

    OpenAI 与 ROOST 合作通过 Ollama 推出 gpt-oss-safeguard 推理模型,提供 20B 和 120B 两个版本,基于 Apache 2.0 许可。模型支持自定义策略解释、可配置推理强度(低/中/高),并开放完整推理过程便于调试。OpenAI 在内部评测集、2022 年 moderation 数据集和 ToxicChat 上进行了评估。

    推荐理由:开源安全分类模型支持自定义策略与可调推理强度,为安全团队提供可审计、可部署的替代选项。

10月28日周二
  1. Ollama Blog62

    MiniMax M2 上线 Ollama 云端

    MiniMax M2 在 Ollama 云端上线,主打编码与智能体工作流。Ollama 给出在 VS Code、Zed、Droid 等工具中的接入步骤,并提供云端 API 访问。

    推荐理由:原文给出模型能力变化与多工具接入入口,读者可据此判断它对现有开发工作流的影响。

10月24日周五
10月23日周四
  1. Ollama Blog62

    Ollama 发布 NVIDIA DGX Spark 性能测试结果

    Ollama 在 DGX Spark 固件 580.95.05 与 Ollama v0.12.6 下测试 gpt-oss、gemma3、llama3.1、deepseek-r1、qwen3 等模型的 prefill 与 decode 速度,并给出固件升级与安装命令。

    推荐理由:原文给出 DGX Spark 上多模型的量化与速度数据,读者可据此评估本地部署的吞吐与显存匹配度。

10月18日周六
10月16日周四
10月14日周二
  1. Ollama Blog64

    Qwen3-VL 登陆 Ollama 云端

    Qwen3-VL 作为 Qwen 系列最强视觉语言模型已在 Ollama 云端上线,本地将随后推出。模型支持视觉 Agent 操作 PC/移动端界面、视觉编程生成 Draw.io/HTML/CSS/JS、2D/3D 空间推理、原生 256K 上下文可扩展至 1M,以及 32 语言 OCR。

    推荐理由:原文给出了 Qwen3-VL 在 Ollama 云端的入口与主要能力,读者可据此判断它对视觉 Agent 与多模态工作流的影响。

10月13日周一
10月1日周三
9月29日周一
9月24日周三
  1. Ollama Blog40

    Ollama 推出 Web Search API

    Ollama 新增 Web Search API,提供免费额度与云端更高速率限制,通过 REST API 及 Python/JavaScript 库调用,为模型补充实时网页信息以减少幻觉、提升准确性。该能力可配合 Qwen 3 4B 等模型构建搜索代理,并支持 gpt-oss 等模型执行长时研究任务。

9月23日周二
  1. Ollama Blog58

    Ollama 推出新的模型调度系统

    Ollama 发布新的模型调度引擎,精确测量模型所需内存,减少内存溢出崩溃并提升 GPU 利用率。示例显示 gemma3:12b 在 128k 上下文下 token 生成速度从 52.02 提升至 85.54 tokens/s,mistral-small3.2 提示评估速度从 127.84 提升至 1380.24 tokens/s。新功能默认适用于新引擎实现的所有模型。

9月19日周五
  1. Ollama Blog60

    Ollama 推出云端模型预览

    Ollama 发布云端模型预览功能,支持在数据中心硬件上运行本地无法容纳的大型模型,同时保持本地工具体验和 OpenAI 兼容 API。可用模型包括 qwen3-coder:480b-cloud、gpt-oss:120b-cloud、gpt-oss:20b-cloud 和 deepseek-v3.1:671b-cloud,需登录 ollama.com 使用。

    推荐理由:本地工具链无缝接入云端大模型,读者可据此评估在不更换工作流的前提下扩展模型规模的可行性。

9月2日周二
8月20日周三
8月1日周五
7月30日周三
  1. Ollama Blog35

    Ollama 推出 macOS 与 Windows 新应用

    Ollama 的新应用已在 macOS 和 Windows 上线,支持模型下载与对话、文件拖拽上传(包括文本和 PDF),并可处理代码文件。内置的多模态引擎支持向 Gemma 3 等模型发送图片,上下文长度可在设置中调整但需要更多内存。新应用可从 Ollama 官网下载,CLI 版本仍可从 GitHub releases 页面获取。

7月17日周四
  1. Mistral AI61

    Le Chat 新增深度研究、语音对话与项目管理功能

    Mistral AI 为 Le Chat 推出深度研究、语音对话、多语言推理和项目管理等新功能。深度研究模式可自动规划、搜索并生成结构化参考报告,语音模式由 Voxtral 模型驱动支持自然语言对话,多语言推理由 Magistral 模型支持,项目功能可组织对话并保留工具与设置。

    推荐理由:Le Chat 新增深度研究、语音对话、多语言推理和项目管理功能,为用户提供了从信息搜集到组织协作的一体化 AI 助手体验。

7月3日周四
  1. Mistral AI38

    Mistral AI 推出 AI for Citizens 计划

    Mistral AI 推出 AI for Citizens 计划,帮助各国政府与公共机构按本地需求部署 AI,改造公共服务。该计划已与法国、卢森堡、新加坡、荷兰、英格兰、瑞士等国的政府、国防部门、公共机构及教育机构合作。方案提供自托管、本地 AI 数据中心、SaaS 与 serverless API 等部署选择,并支持数据主权。

6月11日周三
6月4日周三
5月30日周五
  1. Ollama Blog62

    Ollama 新增思考模式开关功能

    Ollama 发布思考模式开关,用户可在 CLI、交互会话、脚本和 API 中启用或禁用模型的思考过程。支持的模型包括 DeepSeek R1 和 Qwen 3,API 新增 think 参数,可分离 thinking 与 content 输出。

    推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。

5月28日周三
  1. Ollama Blog73

    Ollama 支持流式工具调用

    Ollama 现在支持流式工具调用,可在生成内容的同时实时调用工具,覆盖 Qwen 3、Qwen2.5、Llama 3.1、Llama 4 等模型。新解析器通过参考模型模板识别工具调用前缀,并能在无前缀时回退解析 JSON,从而提升流式场景下的工具调用可靠性。

    推荐理由:Ollama 新增流式工具调用解析器,让聊天应用可以边生成边调用工具。

5月27日周二
  1. Mistral AI62

    Mistral 发布 Agents API

    Mistral 发布 Agents API,将语言模型与代码执行、网页搜索、图像生成及 MCP 工具等内置连接器结合,并提供持久记忆与多智能体编排能力。SimpleQA 上 Mistral Large 和 Medium 启用网页搜索后得分分别从 23%、22.08% 提升至 75%、82.32%。

    推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。

5月15日周四
  1. Ollama Blog72

    Ollama 推出多模态模型新引擎

    Ollama 发布新多模态引擎,支持 Llama 4、Gemma 3、Qwen 2.5 VL、Mistral Small 3.1 等视觉模型。引擎改进包括模型模块化、图像元数据精度、图像缓存与 KV 缓存优化,并针对 Llama 4 Scout 实现分块注意力与 2D 旋转嵌入。

    推荐理由:原文给出了多模态引擎的具体改进与支持的模型,读者可以据此判断本地多模态推理的可靠性与扩展方向。

4月9日周三
3月28日周五
3月14日周五
  1. TensorFlow Blog21

    TensorFlow 2.19 更新了什么

    TensorFlow 2.19 已发布,主要更新包括 LiteRT C++ API 变更、TF-Lite tfl.Cast op 支持 bfloat16,以及停止发布 libtensorflow 包。tf.lite.Interpreter 将于 TF 2.20 删除,需迁移至 ai_edge_litert.interpreter。

3月7日周五
  1. Mistral AI72

    Mistral OCR 文档理解 API 发布

    Mistral 推出 OCR API,支持图像和 PDF 输入,以 interleaved 文本与图片结构化输出,并作为默认文档理解模型集成到 Le Chat。API 在 la Plateforme 以 1000 页/$ 开放,批量推理每美元页数约翻倍,同时提供自托管选项。

    推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。