跳到正文

全部动态

今日 131 条
9月29日周一
9月24日周三
  1. Ollama Blog40

    Ollama 推出 Web Search API

    Ollama 新增 Web Search API,提供免费额度与云端更高速率限制,通过 REST API 及 Python/JavaScript 库调用,为模型补充实时网页信息以减少幻觉、提升准确性。该能力可配合 Qwen 3 4B 等模型构建搜索代理,并支持 gpt-oss 等模型执行长时研究任务。

9月23日周二
  1. Ollama Blog58

    Ollama 推出新的模型调度系统

    Ollama 发布新的模型调度引擎,精确测量模型所需内存,减少内存溢出崩溃并提升 GPU 利用率。示例显示 gemma3:12b 在 128k 上下文下 token 生成速度从 52.02 提升至 85.54 tokens/s,mistral-small3.2 提示评估速度从 127.84 提升至 1380.24 tokens/s。新功能默认适用于新引擎实现的所有模型。

9月19日周五
  1. Ollama Blog60

    Ollama 推出云端模型预览

    Ollama 发布云端模型预览功能,支持在数据中心硬件上运行本地无法容纳的大型模型,同时保持本地工具体验和 OpenAI 兼容 API。可用模型包括 qwen3-coder:480b-cloud、gpt-oss:120b-cloud、gpt-oss:20b-cloud 和 deepseek-v3.1:671b-cloud,需登录 ollama.com 使用。

    推荐理由:本地工具链无缝接入云端大模型,读者可据此评估在不更换工作流的前提下扩展模型规模的可行性。

9月2日周二
8月20日周三
8月5日周二
  1. Ollama Blog73

    OpenAI 发布 gpt-oss 开源模型(20B 与 120B)

    OpenAI 联合 Ollama 发布 gpt-oss-20b 与 gpt-oss-120b 两个开源权重模型,支持 Agentic 能力、链式推理、可配置推理强度和 MXFP4 量化,20B 模型可在 16GB 内存运行,120B 模型可单卡 80GB GPU 部署。

    推荐理由:本地即可运行 OpenAI 最新开源权重模型,读者能据此评估自身硬件是否满足部署门槛。

8月1日周五
7月30日周三
  1. Ollama Blog35

    Ollama 推出 macOS 与 Windows 新应用

    Ollama 的新应用已在 macOS 和 Windows 上线,支持模型下载与对话、文件拖拽上传(包括文本和 PDF),并可处理代码文件。内置的多模态引擎支持向 Gemma 3 等模型发送图片,上下文长度可在设置中调整但需要更多内存。新应用可从 Ollama 官网下载,CLI 版本仍可从 GitHub releases 页面获取。

7月17日周四
  1. Mistral AI61

    Le Chat 新增深度研究、语音对话与项目管理功能

    Mistral AI 为 Le Chat 推出深度研究、语音对话、多语言推理和项目管理等新功能。深度研究模式可自动规划、搜索并生成结构化参考报告,语音模式由 Voxtral 模型驱动支持自然语言对话,多语言推理由 Magistral 模型支持,项目功能可组织对话并保留工具与设置。

    推荐理由:Le Chat 新增深度研究、语音对话、多语言推理和项目管理功能,为用户提供了从信息搜集到组织协作的一体化 AI 助手体验。

7月3日周四
  1. Mistral AI38

    Mistral AI 推出 AI for Citizens 计划

    Mistral AI 推出 AI for Citizens 计划,帮助各国政府与公共机构按本地需求部署 AI,改造公共服务。该计划已与法国、卢森堡、新加坡、荷兰、英格兰、瑞士等国的政府、国防部门、公共机构及教育机构合作。方案提供自托管、本地 AI 数据中心、SaaS 与 serverless API 等部署选择,并支持数据主权。

6月11日周三
6月4日周三
6月3日周二
  1. Ollama Blog67

    Minions:Ollama 与前沿模型的安全隐私协作协议

    Stanford Hazy Research 推出 Minions 协议,通过 NVIDIA Hopper H100 远程证明与加密 enclave 实现 Ollama 本地模型与云端前沿模型的端到端加密协作,敏感上下文不离开设备,延迟增加不到 1%。项目已开源并提供 Streamlit 演示与 Python 示例代码。

    推荐理由:原文给出了端到端加密协作协议的实现路径和实测开销,读者可据此评估本地-云端混合架构的安全性与成本平衡。

5月30日周五
  1. Ollama Blog62

    Ollama 新增思考模式开关功能

    Ollama 发布思考模式开关,用户可在 CLI、交互会话、脚本和 API 中启用或禁用模型的思考过程。支持的模型包括 DeepSeek R1 和 Qwen 3,API 新增 think 参数,可分离 thinking 与 content 输出。

    推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。

5月28日周三
  1. Ollama Blog73

    Ollama 支持流式工具调用

    Ollama 现在支持流式工具调用,可在生成内容的同时实时调用工具,覆盖 Qwen 3、Qwen2.5、Llama 3.1、Llama 4 等模型。新解析器通过参考模型模板识别工具调用前缀,并能在无前缀时回退解析 JSON,从而提升流式场景下的工具调用可靠性。

    推荐理由:Ollama 新增流式工具调用解析器,让聊天应用可以边生成边调用工具。

5月27日周二
  1. Mistral AI62

    Mistral 发布 Agents API

    Mistral 发布 Agents API,将语言模型与代码执行、网页搜索、图像生成及 MCP 工具等内置连接器结合,并提供持久记忆与多智能体编排能力。SimpleQA 上 Mistral Large 和 Medium 启用网页搜索后得分分别从 23%、22.08% 提升至 75%、82.32%。

    推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。

5月21日周三
  1. Mistral AI65

    Devstral:Mistral AI 发布开源智能体编程模型

    Devstral 是 Mistral AI 与 All Hands AI 合作开发的开源智能体编程模型,在 SWE-Bench Verified 上得分 46.8%,领先开源 SoTA 超过 6 个百分点。

    推荐理由:Devstral以46.8%的SWE-Bench Verified成绩超越多数闭源模型,且可本地部署,读者可据此评估开源方案在真实软件工程任务中的可行性。

5月15日周四
  1. Ollama Blog72

    Ollama 推出多模态模型新引擎

    Ollama 发布新多模态引擎,支持 Llama 4、Gemma 3、Qwen 2.5 VL、Mistral Small 3.1 等视觉模型。引擎改进包括模型模块化、图像元数据精度、图像缓存与 KV 缓存优化,并针对 Llama 4 Scout 实现分块注意力与 2D 旋转嵌入。

    推荐理由:原文给出了多模态引擎的具体改进与支持的模型,读者可以据此判断本地多模态推理的可靠性与扩展方向。

5月6日周二
4月9日周三
3月28日周五
3月14日周五
  1. TensorFlow Blog21

    TensorFlow 2.19 更新了什么

    TensorFlow 2.19 已发布,主要更新包括 LiteRT C++ API 变更、TF-Lite tfl.Cast op 支持 bfloat16,以及停止发布 libtensorflow 包。tf.lite.Interpreter 将于 TF 2.20 删除,需迁移至 ai_edge_litert.interpreter。

3月7日周五
  1. Mistral AI72

    Mistral OCR 文档理解 API 发布

    Mistral 推出 OCR API,支持图像和 PDF 输入,以 interleaved 文本与图片结构化输出,并作为默认文档理解模型集成到 Le Chat。API 在 la Plateforme 以 1000 页/$ 开放,批量推理每美元页数约翻倍,同时提供自托管选项。

    推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。

3月4日周二
  1. Mistral AI34

    Mistral AI 用 Agentic Workflow 赋能产品开发

    Mistral AI 展示了 TranscriptToPRDTicket agentic workflow,利用 Mistral Large 2 自动将会议纪要转化为 PRD 和开发工单。该流程由 PRDAgent 和 TicketCreationAgent 两个组件驱动,自动在 Linear 和 Jira 中生成结构化工单。相关实现已在 Google Colab notebook 中提供。

2月19日周三
2月12日周三
2月2日周日
1月21日周二
  1. Vector Institute31

    FairSense:融合负责任 AI 与可持续性

    FairSense-AI 扩展偏见检测到文本与视觉内容,同时采用节能 AI 框架,由 Vector 团队开发。优化后 Llama 3.2 1B 每小时推理碳排放从 107,000 kg 降至 0.012 kg CO2,并使用 CodeCarbon 评估能耗。提供 Python 包,集成 LLM/VLM 进行偏见评分与风险识别,并计划接入 MIT 风险库与 NIST 框架。

12月6日周五
  1. Ollama Blog62

    Ollama 支持结构化输出

    Ollama 新增结构化输出功能,可通过 JSON Schema 约束模型返回格式,并更新 Python 与 JavaScript 库。支持文本与视觉模型的结构化提取,提供 cURL、Python(Pydantic)、JavaScript(Zod)及 OpenAI 兼容接口示例,建议配合 return as JSON 与 temperature=0 使用。

    推荐理由:原文给出 JSON Schema 约束输出与多语言库升级,读者可据此评估结构化输出在数据提取和一致性上的可用性。

11月25日周一
11月20日周三
  1. TensorFlow Blog27

    MLSysBook.AI:机器学习系统工程的原理与实践

    MLSysBook.AI 是哈佛大学 CS249r Tiny Machine Learning 课程及 HarvardX TinyML 系列扩展而来的开源"教材",覆盖数据工程、模型开发、优化、部署、监控与维护等端到端 ML 生命周期。它将核心概念映射到 TensorFlow 生态,阐明量化等原则在嵌入式设备与大型数据中心间的一致性,帮助 ML 从业者构建高效、可扩展的系统。

11月6日周三
10月29日周二
  1. TensorFlow Blog34

    TensorFlow 2.18 更新了什么

    TensorFlow 2.18 发布,亮点包括支持 NumPy 2.0、LiteRT 代码库迁移、Hermetic CUDA 以及 CUDA 内核更新。NumPy 2.0 可能改变计算精度并引发类型错误,迁移指南已更新。CUDA 内核不再支持 compute capability 5.0,最低预编译支持为 Pascal(6.0),Maxwell 需用 TF 2.16 或从源码编译。

10月24日周四
  1. Vector Institute25

    Vector Institute 发布多模态数据集 Newsmediabias-plus(NMB+)以支持伦理 AI 系统开发

    Vector Institute 发布了多模态数据集 Newsmediabias-plus(NMB+),包含约 90,000 篇新闻文章,覆盖文本与图像,并附带偏见分类和发布详情。该数据集面向学术研究者、NGO 及社会导向团队,用于检测虚假信息、分析媒体偏见及训练公平性模型。数据集在 Hugging Face 上以非商业许可开放。

10月19日周六
9月18日周三
  1. Vector Institute18

    Vector 实习生 OJ Onyeagwu 打造语义搜索与推荐系统,提升 Partner Portal 用户体验

    Vector 实习生 OJ Onyeagwu 为 Partner Portal 构建了基于 Flask API 和向量数据库的语义搜索系统,并引入内容推荐轮播与 Coherent Re-rank 端点。系统根据用户 AI 技能水平与行业提供个性化推荐,数据管道在 GCP 上运行并同步 WordPress、Vimeo 与 arXiv 数据。Qdrant 向量数据库存储嵌入向量以支持高效相似度搜索。