跳到正文

#产品更新

今日 29 条
9月16日周三
  1. Google AI Blog62

    Google 发布多语言 AI 产品矩阵,覆盖 300 种语言及 1000 种语言计划

    Google 宣布其技术和产品已覆盖全球 300 多种语言、70 亿人,占全球人口 86%。Gemini 3.5 Live Translate 支持 70 种语言、2000+ 语言对的实时口语翻译,Gemini 3.5 Transcribe 提供高精度语音转文本。

    推荐理由:原文展示了从文本到音频理解再到端侧翻译的技术路径,读者可以据此判断 Google 在多语言 AI 交互上的最新能力边界。

9月15日周二
  1. NVIDIA Blog67

    费城儿童医院基于开源 NVIDIA AI 工具实现儿童心脏建模

    费城儿童医院使用 MONAI 等开源工具,将儿童心脏建模时间从数小时缩短到秒级,已用于术前规划和部分手术。波士顿儿童医院将建模用于约半数心脏手术,医院间正组建开源联盟。

    推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。

9月14日周一
  1. MIT News · AI44

    MIT衍生公司Atlas Building Composites将塑料废料转化为耐用建筑材料

    MIT衍生公司Atlas Building Composites开发AI驱动机器人制造平台,将一次性塑料转化为房屋地基、甲板、屋架等建筑构件。其无水塑料回收技术与大型复合增材制造技术已用于支撑谷仓、码头,并近期为美国陆军工程兵团提供回收复合屋架,在马萨诸塞州湿地建造40英尺桥梁。大型复合屋架可在13分钟内打印完成,承重超过4000磅;每个Atlas工厂单元每天可生产约一栋小型房屋的结构框架材料。

9月12日周六
9月11日周五
  1. Together AI69

    Together AI 扩展微调服务:新增模型、实时指标与更细粒度控制

    Together AI 升级微调平台,新增 GLM-5.3、Kimi K2.7、DeepSeek-V4-Flash、Qwen 3.8-27B、Gemma 4 等开源模型支持,并引入实验实时追踪、Expert LoRA、早停、任意批量大小、样本权重、预飞行校验与打包控制等功能。

    推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。

  2. Kubernetes AI62

    Kubernetes v1.37 调度器支持原地 Pod 扩容抢占(Alpha)

    Kubernetes v1.37 引入 InPlacePodVerticalScalingSchedulerPreemption 特性门控,允许调度器为原地扩容被 deferred 的 Pod 主动抢占同节点低优先级工作负载。原文给出从创建 kind 集群、配置 PriorityClass、触发扩容到观察 Preempted 事件的完整演示步骤。

    推荐理由:原文给出了调度器主动抢占低优先级工作负载的机制,读者可以据此评估集群密度与关键服务响应性的平衡。

9月10日周四
  1. NVIDIA Developer · AI23

    NVIDIA 用 Nemotron 和 Palantir Foundry 将供应链专长编码为从晶圆到首 Token 的可量化流程

    NVIDIA 将全球供应链绩效定义为从 wafer-out 到 first token 的两个阶段:Time-to-rack(硅片离开 fab 到系统上架)和 Time-to-token(之后的供电、散热、网络与软件栈)。文章展示如何用 Nemotron 与 Palantir Foundry 把供应链专家知识编码为可量化、可优化的流程。

  2. Hugging Face Blog67

    Gradio Workflow 重建 AUTOMATIC1111 工作流

    Hugging Face 用 Gradio Workflow 重建了 AUTOMATIC1111 的核心功能,形成包含 11 条媒体管道、73 个节点的单一工作流画布,涵盖文生图、高分辨率修复、图生图、提示词矩阵、VLM 问答、检测到 inpaint 掩码、ControlNet 风格标注器、背景去除、PNG Info 读取和图生视频。

    推荐理由:原文展示了用同一套画布串联多种模型与媒体管道的构建方式,读者可据此评估 gr.Workflow 在多模态工作流中的可复用性。

  3. Together AI69

    Together AI 推出抢占式计算:相同算力半价

    Together AI 公开预览抢占式计算节点,算力与标准节点相同,按 sub-hourly 计费为按需价的 50%。回收时有 5 分钟 drain 窗口,节点标注 together.ai/compute-class=preemptible,适合可 checkpoint 或重试的短实验、推理突发和批处理任务。

    推荐理由:原文给出了成本变化和开放入口,读者可以据此判断它会怎样改变现有工作流。

9月9日周三
  1. Kubernetes AI60

    Kubernetes v1.37 推进 Workload-Aware Scheduling

    Kubernetes v1.37 将 Workload/PodGroup API、gang scheduling 与 Workload-Aware Preemption 升级至 Beta,并引入支持多层拓扑约束与抢占策略的 CompositePodGroup API。

    推荐理由:核心 WAS API 升级到 Beta 并引入 CompositePodGroup,用户可据此评估分层调度和抢占策略对分布式训练与推理工作流的影响。