跳到正文

#部署/工程

今日 67 条
3月19日周三
3月14日周五
  1. TensorFlow Blog21

    TensorFlow 2.19 更新了什么

    TensorFlow 2.19 已发布,主要更新包括 LiteRT C++ API 变更、TF-Lite tfl.Cast op 支持 bfloat16,以及停止发布 libtensorflow 包。tf.lite.Interpreter 将于 TF 2.20 删除,需迁移至 ai_edge_litert.interpreter。

3月7日周五
  1. Mistral AI72

    Mistral OCR 文档理解 API 发布

    Mistral 推出 OCR API,支持图像和 PDF 输入,以 interleaved 文本与图片结构化输出,并作为默认文档理解模型集成到 Le Chat。API 在 la Plateforme 以 1000 页/$ 开放,批量推理每美元页数约翻倍,同时提供自托管选项。

    推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。

1月21日周二
  1. Vector Institute31

    FairSense:融合负责任 AI 与可持续性

    FairSense-AI 扩展偏见检测到文本与视觉内容,同时采用节能 AI 框架,由 Vector 团队开发。优化后 Llama 3.2 1B 每小时推理碳排放从 107,000 kg 降至 0.012 kg CO2,并使用 CodeCarbon 评估能耗。提供 Python 包,集成 LLM/VLM 进行偏见评分与风险识别,并计划接入 MIT 风险库与 NIST 框架。

11月25日周一
11月20日周三
  1. TensorFlow Blog27

    MLSysBook.AI:机器学习系统工程的原理与实践

    MLSysBook.AI 是哈佛大学 CS249r Tiny Machine Learning 课程及 HarvardX TinyML 系列扩展而来的开源"教材",覆盖数据工程、模型开发、优化、部署、监控与维护等端到端 ML 生命周期。它将核心概念映射到 TensorFlow 生态,阐明量化等原则在嵌入式设备与大型数据中心间的一致性,帮助 ML 从业者构建高效、可扩展的系统。

10月29日周二
  1. TensorFlow Blog34

    TensorFlow 2.18 更新了什么

    TensorFlow 2.18 发布,亮点包括支持 NumPy 2.0、LiteRT 代码库迁移、Hermetic CUDA 以及 CUDA 内核更新。NumPy 2.0 可能改变计算精度并引发类型错误,迁移指南已更新。CUDA 内核不再支持 compute capability 5.0,最低预编译支持为 Pascal(6.0),Maxwell 需用 TF 2.16 或从源码编译。

10月21日周一
9月18日周三
  1. Vector Institute18

    Vector 实习生 OJ Onyeagwu 打造语义搜索与推荐系统,提升 Partner Portal 用户体验

    Vector 实习生 OJ Onyeagwu 为 Partner Portal 构建了基于 Flask API 和向量数据库的语义搜索系统,并引入内容推荐轮播与 Coherent Re-rank 端点。系统根据用户 AI 技能水平与行业提供个性化推荐,数据管道在 GCP 上运行并同步 WordPress、Vimeo 与 arXiv 数据。Qdrant 向量数据库存储嵌入向量以支持高效相似度搜索。

7月19日周五
  1. TensorFlow Blog22

    TensorFlow 2.17 更新了什么

    TensorFlow 2.17 已发布,二进制包为计算能力 8.9 的 GPU(如 NVIDIA RTX 40 系列、L4、L40)提供专用 CUDA 内核,同时停止支持计算能力 5.0,预编译包最低支持 Pascal 架构(6.0)。TensorFlow 2.18 将放弃 TensorRT 支持,2.17 是最后一个包含 TensorRT 的版本,并将支持 Numpy 2.0。

5月20日周一
4月8日周一
3月14日周四
  1. Ollama Blog36

    Ollama 支持 AMD 显卡预览

    Ollama 在 Windows 和 Linux 上推出 AMD 显卡预览支持,所有功能均可由 AMD 显卡加速。已支持 Radeon RX 7900 XTX、7900 XT、6950 XT、Vega 64、PRO W7900、Instinct MI300X 等系列显卡,更多型号即将推出。用户可下载 Ollama for Linux 或 Windows 开始使用。

2月7日周三
1月23日周二
12月6日周三
11月30日周四
11月18日周六
  1. TensorFlow Blog33

    TensorFlow 2.15 更新了什么

    TensorFlow 2.15 已发布,Linux 的 NVIDIA CUDA 库通过 pip 安装升级到 CUDA 12.2,Windows x64/x86 默认启用 oneDNN CPU 优化。tf.function 类型全面可用,引入 TraceType、FunctionType 和 AtomicFunction;编译工具升级到 Clang 17.0.1 与 CUDA 12.2。

10月20日周五
10月19日周四
10月13日周五
10月5日周四
  1. Ollama Blog30

    Ollama 发布官方 Docker 镜像

    Ollama 发布官方 Docker sponsored 开源镜像,简化通过 Docker 容器使用大语言模型的方式。所有与 LLM 的交互均在本地进行,不将私有数据发送给第三方。Mac 上建议以独立应用运行以获得 GPU 加速,Linux 上可在 Docker 容器内为 Nvidia GPU 提供 GPU 加速,并通过 REST API 与应用交互。

9月12日周二
8月25日周五
8月19日周六
  1. TensorFlow Blog26

    TensorFlow Lite Flutter 插件正式发布

    TensorFlow Lite Flutter 插件已迁移至 TensorFlow GitHub 官方仓库并正式发布,支持在移动端、嵌入式、Web 和边缘设备本地运行 TensorFlow 模型。插件新增实时摄像头目标检测等功能,桌面端支持正在开发中。开发者可从 pub.dev 安装,并使用 Kaggle Models 等资源获取预训练模型。

8月10日周四
7月26日周三
  1. TensorFlow Blog25

    TensorFlow 2.13 和 Keras 2.13 有什么新功能?

    TensorFlow 2.13 和 Keras 2.13 已发布,Apple Silicon wheels 首次亮相。Keras V3 格式成为 .keras 文件默认保存格式,提供更轻量、可读且安全的模型保存与加载。tf.data 新增 Dataset.zip 支持 Python 风格解包、Dataset.shuffle 支持全量打乱以及 pad_to_cardinality 转换。

6月21日周三
  1. TensorFlow Blog62

    TensorFlow Lite 实现移动端胎儿超声评估

    Google Research 推出基于 TensorFlow Lite 的移动端胎儿超声评估模型,支持非专家通过盲扫协议获取孕周与胎位预测。模型在 Pixel 设备上实现 30 帧/秒以上实时推理,且无精度损失,并提供扫查质量反馈。

    推荐理由:原文给出移动端实时推理速度与质量反馈机制,读者可据此评估该工具在低资源场景下的可用性。

6月7日周三
5月26日周五
12月17日周五