华为搁置 Ascend 900 系列 AI 芯片全球发售,专注满足国内需求
华为在华为连接大会上宣布,因产能不足无法满足国内需求,下一代 Ascend 960/970/980 NPU 将仅在中国销售,仅对部分需求强烈的国家限量供应。
华为在华为连接大会上宣布,因产能不足无法满足国内需求,下一代 Ascend 960/970/980 NPU 将仅在中国销售,仅对部分需求强烈的国家限量供应。
TypeSafe AI 推出首款 System One 模型 Jev,由前 OpenAI 工程师 Diogo Almeida 主导,针对陈述评估与决策场景设计,而非开放式对话。Jev 以结构化 JSON 返回带置信度的答案,支持并行处理、无全局记忆,宣称比 GPT-6 Astra 快 194 倍、便宜 445 倍,上下文窗口上限 64k tokens。
Higgsfield AI 借助 GPT-6 Astra 一日内上线新视频功能,让小企业视频广告创作更便捷,并加速新创意工具推向市场。
Nvidia 计划年底前免费发布新模型 Nemotron 4,面向已使用其芯片的国家;阿联酋旗舰数据中心将运行 40 万颗 Nvidia 芯片,若采用该模型将进一步削弱其中立性。
summary_zh: OpenAI Academy 新增面向员工、开发者、领导者、教育工作者和学生的学习路径,帮助构建和展示实用的 AI 技能。 OpenAI Academy 新增面向员工、开发者、领导者、教育工作者和学生的学习路径,帮助构建和展示实用的 AI 技能。
summary_zh: Google Pixel 11 Pro XL 配备 6.8 英寸 OLED 屏幕、Tensor G6 芯片和 12/16GB RAM,售价 £1,279,较去年涨价 £80 且内存缩水。
Hugging Face 发布 tokenizers v1 预览版,在 Apple M4 Max 上单线程编码速度比 v0.23 快 3 到 30 倍,8 线程扩展效率达 76%。主要改进包括 bitcannon 位流分词、线程本地词缓存、无分配合并循环和批量模型调用,且输出 token ID 与 v0.23 完全一致。
推荐理由:原文给出了速度提升和开放入口,读者可以据此判断它会怎样改变现有工作流。
summary_zh: V7 使用 GPT-5.6 将分散的公司文件转化为上下文,供智能体完成复杂且带来源链接的工作。成本降低 78% 同时准确率提升。 V7 使用 GPT-5.6 将分散的公司文件转化为上下文,供智能体完成复杂且带来源链接的工作。成本降低 78% 同时准确率提升。
llm-keys-ui 0.1 发布,提供一种不把 API key 粘贴进 agent 会话或 ChatGPT app 就能将其保存到远程机器的方式。
summary_zh: Noctua NF-A4x10 5V PWM 风扇被 CAIM1 反 AI 4K 相机采用,用于同时处理高码率成像与密码学运算时的主动散热,防止设备过热降频。
summary_zh: GPT-6 Astra 用关键词 "TRUPPENVERSCHIEBUNG" 解密了一条 1918 年 11 月 29 日的德国无线电报文,原文为 "AN ENGLISH CRUISER ARRIVED AT SEVASTOPOL ON THE ?
summary_zh: MIT Reads 迎来十周年,将重点转向虚构与回忆录阅读,强调故事帮助人们理解自身与世界观的作用。MIT 图书馆馆长 Chris Bourg 与校长 Sally Kornbluth 均表示,集体阅读与讨论在 AI 影响教育与校园社交的背景下更具现实意义。
Google 工程师与设计师 Jane Wade、Sergio Hudson 合作,基于 Google Flow 打造 Styling Suite 与 Runway Visualization 两款工具。
华为在华为连接大会上更新 AI 硬件路线图,Ascend 960DT 提前至 2027 Q1,Ascend 960PR FP4 推理性能翻倍至 8 PFLOPS。Ascend 970 和 980 分别计划于 2028 和 2029 推出,FP4 性能分别为 14 和 28 PFLOPS。Atlas 950 SuperPoD 目前实际部署规模低于官方最大配置。
summary_zh: 一家全球金融科技公司在 Together 上将编程智能体流量迁移至 GLM-5.2,采用 Dedicated Model Inference 实现自服务供给、指标 API 和模型灵活性。
Google Research 发布基于生成式 UI 的学习互动实验,教师可按课程目标生成定制化互动模拟,覆盖物理、化学、生物和数学中学内容。系统包含分层挑战、脚手架提示与自动校验循环,并已通过教师审核;使用 Google Workspace for Education 的学校可报名 Pilot Program 提供反馈。
推荐理由:教师可按教学目标生成互动模拟并获得分层提示与自动校验,为差异化教学提供了可迁移的方法路径。
summary_zh: 联合国系统推出 UN System Data Commons,基于 Google Data Commons 构建的开源平台,整合全球统计数据为 AI 就绪知识图谱。
Anthropic 为 Claude Code 云端用户重设计项目功能,支持多线程编排、共享记忆与跨仓库协作;目前仅面向部分 Pro/Max 订阅者,本地终端用户暂不包含。
Google 发布成年雄性果蝇全脑及中枢神经系统连接组后,一名 Balatro 玩家用自研训练算法结合该结构训练模型玩 Balatro,当前随机种子胜率约 20%。玩家未公开训练细节和代码仓库,评论者对项目真实性提出质疑;Balatro 因小丑牌互动、boss 能力等复杂机制,对 AI 来说仍很难稳定通关。
Claude Cowork 将合并到 Claude Chat,取消独立标签页,所有连接应用、技能与上下文可在普通 Claude.ai 聊天中使用,合盖后仍可继续工作。Claude Artifacts 新增 Docs 和 Slides 专用产品,Claude Design 移入对话;Claude Code 推出名为 Mods 的实验,可修改应用外观与行为。
Pawprint Studio 的开放世界捉宠 RPG《Aniimo》本周在 GeForce NOW 首发上线,无需下载 45GB 即可在 Steam Deck、新支持的 Firefox 浏览器等设备串流游玩。
Cooley 基于 ChatGPT Work 构建了 GO Public 工具,将智能引入 IPO 流程,帮助律师更早发现潜在问题并聚焦关键判断。
Luckey Faraday 使用 GPT-6 Astra 将《黑色行动2》Hijacked 地图从浏览器版重建为 Java 代码,直接运行在 Minecraft 自身 OpenGL 上下文而非内嵌浏览器中。地图、碰撞、AI 寻路、武器和渲染均以 Fabric Mod 形式注入游戏,视频显示约 45 fps 流畅全屏运行。开发者表示仍有大量工作待完成,后续可能追加地图、武器和多人模式。
GitHub Copilot运行时从TypeScript重写为Rust,由AI代理主导完成,超过80万行Rust代码。迁移过程实现了性能提升和跨产品共享运行时。
推荐理由:原文详细记录了使用Copilot代理将GitHub Copilot运行时从TypeScript迁移至Rust的过程,性能提升显著,并实现了多产品共享。
OpenAI 发布 Astra for Law,为法律行业提供前沿智能、定制化律所工作流、关联法律数据源以及法律级保密控制。方案面向客户保密场景设计,具体模型版本、参数规模与价格信息原文未披露。
Weaviate 1.39 扩展 Rotational Quantization(RQ),新增 4-bit 支持并带来多项量化改进。8-bit RQ 编码速度最高提升 3.8×,4-bit RQ 在保持相似召回率的同时堆内存减少 45%。
summary_zh: Kubernetes v1.37 新增 emptyDir 权限模式与 bind mount 选项,允许在卷挂载层面直接设置 noexec、nosuid、nodev 及 sticky bit(01777)等标志,无需借助 init container 或变通方案。
Anthropic 把 Claude Cowork 和 Claude Chat 合并为统一的 Claude,并将 Design、Slides 和 Docs 集成到同一界面,Pro 与 Max 计划率先开放。Anthropic 表示用户无需选择任务去向,Cliaude 会自动判断所需能力,且 Design 等工具仍可独立使用。
ChatGPT Work 与 Codex 分析帮助团队理解 AI 使用量和支出,识别培训需求,并将采用情况与业务结果关联。
Mistral 为 Mozilla Firefox Smart Window(beta)提供模型支持,该 AI 浏览助手目前面向法国和北美用户,英国和德国今年晚些时候跟进。Firefox Smart Window 默认不保存对话记录,Mistral 承诺零数据保留,双方共同强调用户控制与开源分发。
GPT-6 Astra 帮助 Hex 的数据代理将分析答案转化为可交互可视化报告,使员工愿意分享这些可视化内容。
TypeSafe 发布 Jev,基于 RLCD 训练,宣称比小型前沿 LLM 快 20–200 倍、便宜 40–400 倍,输出 token 免费。社区指出它并非通用语言模型,更接近结构化分类器或裁判模型,适合替代生产系统中的 LLM 路由与判断。
推荐理由:原文给出 Jev 在延迟与成本上的具体倍数优势,读者可据此判断其是否值得替代现有分类器与路由策略。
OpenAI 新经济研究显示工作者将 AI 用于传统角色之外的新活动,并使部分 AI 任务成为日常工作 recurring part。原文未披露具体模型、版本号、参数规模、benchmark 分数、速度倍数、价格或上下文长度等可验证数字与可用性信息。
曼彻斯特大学与 NVIDIA Earth-2 团队基于 Isambard-AI 训练 Earth-2 CorrDiff 和 StormCast,生成了分辨率 2-3 平方公里的英国全域污染模型,训练仅用两天。同一工作流可在 DGX Spark 桌面系统运行推理,作者计划开源训练数据与工作流,并展望由智能体接口驱动的实时污染问答。
推荐理由:展示了生成式AI模型从国家级超算到桌面设备的可迁移路径,降低了污染建模的硬件门槛。
summary_zh: Glyph 将企业数据目录的列描述生成与类型标注建模为协作 LLM 智能体图。描述器通过 active RAG 从企业 GitHub 检索管道源码;标注器并行运行描述标签器、业务正则标签器和基于微调对比编码器的元数据标签器,再用 RRF 融合输出。
NVIDIA 公布 DSX 平台早期验证结果:Lambda 在 19 节点 HGX B200 集群上运行 DSX MaxLPS,同等功耗预算下 token 吞吐提升 24%,每瓦性能提升 23%。
NVIDIA 在 AI Infra Summit 公布 Vera Rubin NVL72 与 DSX 平台新成果,MLPerf Inference v6.1 中 Vera Rubin NVL72 较 GB300 NVL72 吞吐量提升最高 3.7 倍,DSX MaxLPS 在相同功耗下集群 token 吞吐量提升 24%、每瓦性能提升 23%。
推荐理由:AI基础设施的关键指标正从峰值性能转向每兆瓦智能体token数,读者可据此评估自身AI工厂的能效与扩容空间。
Google 宣布其技术和产品已覆盖全球 300 多种语言、70 亿人,占全球人口 86%。Gemini 3.5 Live Translate 支持 70 种语言、2000+ 语言对的实时口语翻译,Gemini 3.5 Transcribe 提供高精度语音转文本。
推荐理由:原文展示了从文本到音频理解再到端侧翻译的技术路径,读者可以据此判断 Google 在多语言 AI 交互上的最新能力边界。
summary_zh: Google 与全球社区和研究者合作,在疾病预测、自然灾害预警、教育普及和经济机会拓展等关键领域推动 AI 从理论走向可衡量的实际影响。
Google宣布其AI技术已支持超过300种语言,覆盖全球70亿人口(86%全球人口),并发布AI & Economy ATLAS互动洞察。同时公布AlphaGenome Atlas、WeatherNext 3、Planetary Prediction Engine等科学进展与应用。