跳到正文

开源生态

开源模型、框架与仓库动态:权重开放、社区项目爆火、开源与闭源的力量消长。

176条精选相关主题模型发布Hugging FaceAI 编码

最新精选

第 161–176 条 · 共 176 条
6月10日周二
  1. Mistral AI74

    Mistral 发布首个推理模型 Magistral

    Mistral AI 发布首个推理模型 Magistral,分开源的 Magistral Small(24B)与企业版 Magistral Medium;Magistral Medium 在 AIME2024 得分 73.6%,多数投票 @64 达 90%,Small 分别为 70.7% 与 83.3%。

    推荐理由:Mistral 首次推出推理模型 Magistral,分开源与企业两个版本,读者可据此对比其推理能力与部署选择。

6月3日周二
  1. Ollama Blog67

    Minions:Ollama 与前沿模型的安全隐私协作协议

    Stanford Hazy Research 推出 Minions 协议,通过 NVIDIA Hopper H100 远程证明与加密 enclave 实现 Ollama 本地模型与云端前沿模型的端到端加密协作,敏感上下文不离开设备,延迟增加不到 1%。项目已开源并提供 Streamlit 演示与 Python 示例代码。

    推荐理由:原文给出了端到端加密协作协议的实现路径和实测开销,读者可据此评估本地-云端混合架构的安全性与成本平衡。

5月30日周五
  1. Ollama Blog62

    Ollama 新增思考模式开关功能

    Ollama 发布思考模式开关,用户可在 CLI、交互会话、脚本和 API 中启用或禁用模型的思考过程。支持的模型包括 DeepSeek R1 和 Qwen 3,API 新增 think 参数,可分离 thinking 与 content 输出。

    推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。

5月28日周三
  1. Ollama Blog73

    Ollama 支持流式工具调用

    Ollama 现在支持流式工具调用,可在生成内容的同时实时调用工具,覆盖 Qwen 3、Qwen2.5、Llama 3.1、Llama 4 等模型。新解析器通过参考模型模板识别工具调用前缀,并能在无前缀时回退解析 JSON,从而提升流式场景下的工具调用可靠性。

    推荐理由:Ollama 新增流式工具调用解析器,让聊天应用可以边生成边调用工具。

5月21日周三
  1. Mistral AI65

    Devstral:Mistral AI 发布开源智能体编程模型

    Devstral 是 Mistral AI 与 All Hands AI 合作开发的开源智能体编程模型,在 SWE-Bench Verified 上得分 46.8%,领先开源 SoTA 超过 6 个百分点。

    推荐理由:Devstral以46.8%的SWE-Bench Verified成绩超越多数闭源模型,且可本地部署,读者可据此评估开源方案在真实软件工程任务中的可行性。

5月7日周三
  1. Mistral AI62

    Mistral 发布 Mistral Medium 3

    Mistral 发布 Mistral Medium 3,宣称以显著更低成本提供接近前沿大模型的性能。模型在编码与 STEM 任务上接近更大更慢的竞品,API 定价为输入 $0.4 / 输出 $2 每百万 token,可在四卡及以上自托管环境部署。

    推荐理由:原文给出性能与成本对比,读者可据此判断它对现有开源大模型格局的影响。

3月7日周五
  1. Mistral AI72

    Mistral OCR 文档理解 API 发布

    Mistral 推出 OCR API,支持图像和 PDF 输入,以 interleaved 文本与图片结构化输出,并作为默认文档理解模型集成到 Le Chat。API 在 la Plateforme 以 1000 页/$ 开放,批量推理每美元页数约翻倍,同时提供自托管选项。

    推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。

2月25日周二
  1. Ollama Blog74

    Minions:本地与云端大语言模型协同工作

    斯坦福 Hazy Research 团队发布 Minions 论文与开源代码,让本地小模型(如 Llama 3.2 via Ollama)与云端大模型(如 GPT-4o)协作,将大量 LLM 工作负载转移到消费设备。

    推荐理由:通过本地小模型与云端大模型协作的两套协议,在显著降低远程调用成本的同时保持较高性能。

12月6日周五
  1. Ollama Blog62

    Ollama 支持结构化输出

    Ollama 新增结构化输出功能,可通过 JSON Schema 约束模型返回格式,并更新 Python 与 JavaScript 库。支持文本与视觉模型的结构化提取,提供 cURL、Python(Pydantic)、JavaScript(Zod)及 OpenAI 兼容接口示例,建议配合 return as JSON 与 temperature=0 使用。

    推荐理由:原文给出 JSON Schema 约束输出与多语言库升级,读者可据此评估结构化输出在数据提取和一致性上的可用性。

10月21日周一
9月25日周三
  1. Ollama Blog60

    Llama 3.2 通过 Ollama 发布小尺寸与多模态版本

    Meta Llama 3.2 现可通过 Ollama 运行,提供 1B/3B 文本模型与 11B/90B 视觉模型。1B 和 3B 面向移动端与边缘设备本地部署,用于构建个性化端侧智能体;11B 和 90B 支持图像推理、文档理解与图表分析。原文链接:https://ollama.com/blog/llama3.2

    推荐理由:原文给出本地部署入口和模型规格,读者可据此判断它对端侧隐私和即时响应的实际影响。

7月25日周四
  1. Ollama Blog67

    Ollama 新增工具调用支持

    Ollama 现在支持 Llama 3.1 等模型的工具调用,可通过 tools 字段提供可用工具并接收 tool_calls 响应。支持的模型包括 Llama 3.1、Mistral Nemo、Firefunction v2、Command-R+,OpenAI 兼容端点也已支持工具调用。

    推荐理由:Ollama 为热门模型新增工具调用能力并开放 OpenAI 兼容接口,用户可据此快速接入外部工具。

6月27日周四
  1. Ollama Blog62

    Google Gemma 2 发布

    Google Gemma 2 现已提供 2B、9B 和 27B 三种规格,采用全新架构,27B 参数在基准测试中超越两倍规模模型。Ollama 已支持运行 Gemma 2,并给出与 LangChain、LlamaIndex 的集成示例。

    推荐理由:27B 参数在开放模型中实现超越更大模型的性能,为开源部署提供了新的效率标杆。

4月18日周四
  1. Ollama Blog67

    Llama 3 通过 Ollama 可用

    Llama 3 现已可通过 Ollama 运行,数据集为 Llama 2 的七倍,上下文从 8K 翻倍至 16K,token 词汇表扩至 128K,误拒率低于 Llama 2 的三分之一,提供 8B 与 70B 两个版本。Meta 计划后续推出 400B 参数版本,并增加多模态、多语言和更长上下文等能力。

    推荐理由:原文给出 Llama 3 在数据规模、上下文和 token 上的具体升级,以及与 Llama 2 的对比,读者可据此判断是否切换现有工作流。

4月10日周三
  1. TensorFlow Blog62

    TensorFlow Lite XNNPack 支持动态范围量化

    TensorFlow 官方宣布 XNNPack 的全连接和卷积算子支持动态范围量化,Stable Diffusion 推理速度最高提升 6.2 倍,且无需校准数据集即可启用。从 TensorFlow 2.17 起,预编译二进制默认开启该能力。

    推荐理由:原文给出动态量化在多个模型上的加速数据,读者可据此评估在旧设备上部署 AI 功能的可行性。

2月8日周四