跳到正文

产品更新

AI 产品与应用的功能上新、改版与商业化动态——谁家的产品变强了、变贵了、能用了。

174条精选相关主题模型发布行业动态AI 编码

最新精选

第 161–174 条 · 共 174 条
7月30日周三
7月17日周四
  1. Mistral AI61

    Le Chat 新增深度研究、语音对话与项目管理功能

    Mistral AI 为 Le Chat 推出深度研究、语音对话、多语言推理和项目管理等新功能。深度研究模式可自动规划、搜索并生成结构化参考报告,语音模式由 Voxtral 模型驱动支持自然语言对话,多语言推理由 Magistral 模型支持,项目功能可组织对话并保留工具与设置。

    推荐理由:Le Chat 新增深度研究、语音对话、多语言推理和项目管理功能,为用户提供了从信息搜集到组织协作的一体化 AI 助手体验。

5月30日周五
  1. Ollama Blog62

    Ollama 新增思考模式开关功能

    Ollama 发布思考模式开关,用户可在 CLI、交互会话、脚本和 API 中启用或禁用模型的思考过程。支持的模型包括 DeepSeek R1 和 Qwen 3,API 新增 think 参数,可分离 thinking 与 content 输出。

    推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。

5月28日周三
  1. Ollama Blog73

    Ollama 支持流式工具调用

    Ollama 现在支持流式工具调用,可在生成内容的同时实时调用工具,覆盖 Qwen 3、Qwen2.5、Llama 3.1、Llama 4 等模型。新解析器通过参考模型模板识别工具调用前缀,并能在无前缀时回退解析 JSON,从而提升流式场景下的工具调用可靠性。

    推荐理由:Ollama 新增流式工具调用解析器,让聊天应用可以边生成边调用工具。

5月27日周二
  1. Mistral AI62

    Mistral 发布 Agents API

    Mistral 发布 Agents API,将语言模型与代码执行、网页搜索、图像生成及 MCP 工具等内置连接器结合,并提供持久记忆与多智能体编排能力。SimpleQA 上 Mistral Large 和 Medium 启用网页搜索后得分分别从 23%、22.08% 提升至 75%、82.32%。

    推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。

5月15日周四
  1. Ollama Blog72

    Ollama 推出多模态模型新引擎

    Ollama 发布新多模态引擎,支持 Llama 4、Gemma 3、Qwen 2.5 VL、Mistral Small 3.1 等视觉模型。引擎改进包括模型模块化、图像元数据精度、图像缓存与 KV 缓存优化,并针对 Llama 4 Scout 实现分块注意力与 2D 旋转嵌入。

    推荐理由:原文给出了多模态引擎的具体改进与支持的模型,读者可以据此判断本地多模态推理的可靠性与扩展方向。

3月7日周五
  1. Mistral AI72

    Mistral OCR 文档理解 API 发布

    Mistral 推出 OCR API,支持图像和 PDF 输入,以 interleaved 文本与图片结构化输出,并作为默认文档理解模型集成到 Le Chat。API 在 la Plateforme 以 1000 页/$ 开放,批量推理每美元页数约翻倍,同时提供自托管选项。

    推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。

12月6日周五
  1. Ollama Blog62

    Ollama 支持结构化输出

    Ollama 新增结构化输出功能,可通过 JSON Schema 约束模型返回格式,并更新 Python 与 JavaScript 库。支持文本与视觉模型的结构化提取,提供 cURL、Python(Pydantic)、JavaScript(Zod)及 OpenAI 兼容接口示例,建议配合 return as JSON 与 temperature=0 使用。

    推荐理由:原文给出 JSON Schema 约束输出与多语言库升级,读者可据此评估结构化输出在数据提取和一致性上的可用性。

9月25日周三
  1. Ollama Blog60

    Llama 3.2 通过 Ollama 发布小尺寸与多模态版本

    Meta Llama 3.2 现可通过 Ollama 运行,提供 1B/3B 文本模型与 11B/90B 视觉模型。1B 和 3B 面向移动端与边缘设备本地部署,用于构建个性化端侧智能体;11B 和 90B 支持图像推理、文档理解与图表分析。原文链接:https://ollama.com/blog/llama3.2

    推荐理由:原文给出本地部署入口和模型规格,读者可据此判断它对端侧隐私和即时响应的实际影响。

7月25日周四
  1. Ollama Blog67

    Ollama 新增工具调用支持

    Ollama 现在支持 Llama 3.1 等模型的工具调用,可通过 tools 字段提供可用工具并接收 tool_calls 响应。支持的模型包括 Llama 3.1、Mistral Nemo、Firefunction v2、Command-R+,OpenAI 兼容端点也已支持工具调用。

    推荐理由:Ollama 为热门模型新增工具调用能力并开放 OpenAI 兼容接口,用户可据此快速接入外部工具。

4月18日周四
  1. Ollama Blog67

    Llama 3 通过 Ollama 可用

    Llama 3 现已可通过 Ollama 运行,数据集为 Llama 2 的七倍,上下文从 8K 翻倍至 16K,token 词汇表扩至 128K,误拒率低于 Llama 2 的三分之一,提供 8B 与 70B 两个版本。Meta 计划后续推出 400B 参数版本,并增加多模态、多语言和更长上下文等能力。

    推荐理由:原文给出 Llama 3 在数据规模、上下文和 token 上的具体升级,以及与 Llama 2 的对比,读者可据此判断是否切换现有工作流。

4月10日周三
  1. TensorFlow Blog62

    TensorFlow Lite XNNPack 支持动态范围量化

    TensorFlow 官方宣布 XNNPack 的全连接和卷积算子支持动态范围量化,Stable Diffusion 推理速度最高提升 6.2 倍,且无需校准数据集即可启用。从 TensorFlow 2.17 起,预编译二进制默认开启该能力。

    推荐理由:原文给出动态量化在多个模型上的加速数据,读者可据此评估在旧设备上部署 AI 功能的可行性。

2月8日周四
6月21日周三
  1. TensorFlow Blog62

    TensorFlow Lite 实现移动端胎儿超声评估

    Google Research 推出基于 TensorFlow Lite 的移动端胎儿超声评估模型,支持非专家通过盲扫协议获取孕周与胎位预测。模型在 Pixel 设备上实现 30 帧/秒以上实时推理,且无精度损失,并提供扫查质量反馈。

    推荐理由:原文给出移动端实时推理速度与质量反馈机制,读者可据此评估该工具在低资源场景下的可用性。