跳到正文

Hugging Face

Hugging Face 开源社区动态:热门模型与数据集、排行榜变化与开源生态的晴雨表。

最新精选

第 41–49 条 · 共 49 条
6月30日周二
  1. Hugging Face Blog60

    Every Eval Ever 与 Hugging Face 社区评测实现互操作,转换器自动同步评测结果

    Every Eval Ever 与 Hugging Face 社区评测现已实现互操作,官方提供了转换器工具,可自动将 EEE 评测记录同步为模型仓库中的 YAML 文件。数据存储已收录约 22.9 万条评测结果,覆盖 2.2 万个模型和 2200 个基准。该工具支持 MMLU-Pro、GPQA、HLE 和 GSM8K 四项基准,并在写入前自动审核冲突。

    推荐理由:EEE与Hugging Face社区评测现在可互操作,转换器自动将EEE记录写入YAML文件并审核冲突,解决评测结果分散难以对比的长期问题。

6月5日周五
6月3日周三
  1. Weaviate Blog64

    Engram 正式发布:面向 Agent 的托管记忆与上下文服务

    Weaviate 宣布 Engram 正式在 Weaviate Cloud 上线,这是一项托管记忆与上下文服务,旨在解决长上下文退化、原始数据混乱和多 Agent 上下文碎片化问题。Engram 通过异步管道提取、去重并调和事件,生成结构化持久记忆,并依托 Weaviate 混合检索提供统一记忆与检索平台。

    推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。

5月28日周四
  1. Ollama Blog76

    OpenJarvis 1.0 发布:本地优先的个人 AI 代理现可通过 Ollama 运行

    OpenJarvis 是斯坦福 Hazy Research 与 Scaling Intelligence 实验室推出的开源框架,1.0 版现已发布并内置 Ollama 支持。框架默认本地运行模型,云端可选,并追踪能耗、成本与延迟。安装脚本自动检测现有 Ollama,用户可拉取如 qwen3.5:35b 等模型,并使用晨间简报、跨文件研究和本地编码等内置代理预设。

    推荐理由:原文给出本地优先框架与 Ollama 集成入口,读者可据此评估本地 Agent 工作流的可行性。

5月21日周四
  1. Weaviate Blog60

    用 Weaviate MCP 构建代码助手:基于代码与文档的 RAG 教程

    Weaviate Blog 发布教程,展示如何利用内置 MCP 服务器搭建代码助手:将代码按语法边界分块注入 CodeChunks,按标题分块注入 DocChunks,通过混合搜索(BM25+向量)让 Claude Code、Cursor、VS Code 调用 weaviate-query-hybrid 获取真实代码引用,而非依赖模型训练数据。

    推荐理由:原文给出了一套从零搭建代码助手的方法和脚本,读者可按步骤实操并迁移到自己的代码库。

4月21日周二
  1. Weaviate Blog67

    Weaviate 发布 Engram 托管记忆服务

    Weaviate 推出托管记忆服务 Engram,基于 Weaviate 向量数据库,通过异步管道从原始数据提取、整合并持久化记忆,支持语义搜索检索。Engram 提供项目级、用户级和属性级作用域,以及可配置管道和缓冲机制,适用于聊天机器人、持续学习和多智能体系统,并计划推出 Claude Code 等集成。

    推荐理由:原文给出了记忆管理的能力变化和开放入口,读者可以据此判断它会怎样改变现有 Agent 工作流。

10月14日周二
  1. Ollama Blog64

    Qwen3-VL 登陆 Ollama 云端

    Qwen3-VL 作为 Qwen 系列最强视觉语言模型已在 Ollama 云端上线,本地将随后推出。模型支持视觉 Agent 操作 PC/移动端界面、视觉编程生成 Draw.io/HTML/CSS/JS、2D/3D 空间推理、原生 256K 上下文可扩展至 1M,以及 32 语言 OCR。

    推荐理由:原文给出了 Qwen3-VL 在 Ollama 云端的入口与主要能力,读者可据此判断它对视觉 Agent 与多模态工作流的影响。

8月5日周二
  1. Ollama Blog73

    OpenAI 发布 gpt-oss 开源模型(20B 与 120B)

    OpenAI 联合 Ollama 发布 gpt-oss-20b 与 gpt-oss-120b 两个开源权重模型,支持 Agentic 能力、链式推理、可配置推理强度和 MXFP4 量化,20B 模型可在 16GB 内存运行,120B 模型可单卡 80GB GPU 部署。

    推荐理由:本地即可运行 OpenAI 最新开源权重模型,读者能据此评估自身硬件是否满足部署门槛。

6月3日周二
  1. Ollama Blog67

    Minions:Ollama 与前沿模型的安全隐私协作协议

    Stanford Hazy Research 推出 Minions 协议,通过 NVIDIA Hopper H100 远程证明与加密 enclave 实现 Ollama 本地模型与云端前沿模型的端到端加密协作,敏感上下文不离开设备,延迟增加不到 1%。项目已开源并提供 Streamlit 演示与 Python 示例代码。

    推荐理由:原文给出了端到端加密协作协议的实现路径和实测开销,读者可据此评估本地-云端混合架构的安全性与成本平衡。