OpenAI 发布澳大利亚青少年安全蓝图
OpenAI 发布澳大利亚青少年安全蓝图,这是一项包含六大支柱的路线图,旨在为年轻人提供更安全的 AI 体验并赋能青少年。
OpenAI 发布澳大利亚青少年安全蓝图,这是一项包含六大支柱的路线图,旨在为年轻人提供更安全的 AI 体验并赋能青少年。
summary_zh: 一家全球金融科技公司在 Together 上将编程智能体流量迁移至 GLM-5.2,采用 Dedicated Model Inference 实现自服务供给、指标 API 和模型灵活性。
OpenAI 声称其最先进 AI 模型解决了 Navier–Stokes 方程相关的千禧年难题,证明该方程在某些情况下会产生奇点,即预测出物理上不可能的无限速度。物理学家和数学家正借助 AI 进一步理解湍流。
推荐理由:AI 证明 Navier–Stokes 方程存在奇点,为流体湍流研究提供了新的数学视角。
Cooley 基于 ChatGPT Work 构建了 GO Public 工具,将智能引入 IPO 流程,帮助律师更早发现潜在问题并聚焦关键判断。
OpenAI 发布 Astra for Law,为法律行业提供前沿智能、定制化律所工作流、关联法律数据源以及法律级保密控制。方案面向客户保密场景设计,具体模型版本、参数规模与价格信息原文未披露。
Cell 今日发表报告,公布一套面向衰老生物学的人工智能系统,包含基于衰老数据训练的 LLM、17 项基准任务,以及将模型与代理(agent)整合的接口。作者用这些基准评估了专用 LLM 和 OpenAI、DeepSeek 等公司的通用大模型,发现专用模型在多数测试中表现更优。研究指出,衰老尚未有清晰定义,如何训练 AI 理解衰老仍是关键难题。
推荐理由:为衰老生物学专门定制 LLM 与 17 项基准,揭示专用模型在特定领域或优于通用大模型。
OpenAI 分享了用于追踪、调查和披露模型对齐偏差的框架,并附六份关于模型异常或令人担忧行为的具体报告。
OpenAI 与 AARP 将在美国 10 个城市为 1,000 名老年人举办免费 ChatGPT 实操工作坊,帮助他们安全地掌握实用 AI 技能。
ChatGPT Work 与 Codex 分析帮助团队理解 AI 使用量和支出,识别培训需求,并将采用情况与业务结果关联。
GPT-6 Astra 帮助 Hex 的数据代理将分析答案转化为可交互可视化报告,使员工愿意分享这些可视化内容。
OpenAI 新经济研究显示工作者将 AI 用于传统角色之外的新活动,并使部分 AI 任务成为日常工作 recurring part。原文未披露具体模型、版本号、参数规模、benchmark 分数、速度倍数、价格或上下文长度等可验证数字与可用性信息。
Fyxer 基于 OpenAI 模型、微调、记忆功能和真实用户反馈,构建 AI 助理来整理收件箱并以用户口吻起草邮件。
Perplexity 使用 GPT-6 Astra 撰写通信、修改软件并监控生产系统,检查频率较此前模型显著降低。GPT-6 Astra 为 OpenAI 模型,Perplexity 将其用于端到端系统任务。
GPT‑6 Astra 提升 Devin 的软件测试与验证能力,旨在帮助工程师减少代码审查量、加快交付。
OpenAI 将 Habitat 从 Python 库演进为全球分布式存储平台,服务 10 亿 ChatGPT 用户,每秒处理 2200 万次请求。
César de la Fuente 的实验室使用 Codex 和 ChatGPT 在现存与灭绝基因组中搜索抗菌候选分子,以应对耐药感染。
ChatGPT Work 推出 Data agent,用户可用自然语言连接公司数据、发现洞察,并构建 AI 驱动的交互式仪表盘。
OpenAI 与 GSA 将为符合条件的联邦、州、地方和部落政府提供零许可证费用、使用费五折优惠,并扩展网络安全防御支持。
OpenAI 推出 ChatGPT for Financial Services,整合内置金融数据与 GPT-6 Astra,支持研究、建模和生成客户可用材料。
GPT‑Live‑1 通过 API 推出全双工自然语音对话能力,支持更强指令遵循、自定义声音与电话渠道。开发者可借此构建更自然的语音交互应用。
OpenAI 发布 Agents API,这是一项托管服务,基于 Codex harness 提供编排、长时会话和工具调用能力。
Paul Christiano 加入 OpenAI 基金会董事会及其安全委员会,带来 AI 对齐、安全与标准领域的专业经验。
GPT-6 Astra 是 OpenAI 面向商业场景的最强模型,具备高级推理、计算机使用能力,以及更强的写作与设计判断力。
summary_zh: MIT 研究员使用 GPT-5.6 Sol 配合 Codex 自主运行量子计算实验、分析结果并校准量子比特。该方案展示了 LLM 在量子实验自动化中的实际应用路径。
OpenAI 讨论能力更强、价格更可负担的 AI 如何扩展个人与企业可完成的工作,并让增长变得更经济。
ChatGPT Images 2.5 发布,帮助用户将想法、草图和参考照片转化为更个性化、更精致的图像,生成的图像更能反映用户的原始想法。
OpenAI 扩展对新闻业的支持,面向学生、教育工作者、记者和新闻机构提供工具、培训与合作伙伴关系。计划覆盖从课堂到新闻编辑部的全链条支持。
OpenAI 发布了一份 AI 生成的 Navier–Stokes 千禧年难题解法,包含说明文档和 Lean 形式化证明。
OpenAI 启动 500 万美元资助计划,支持独立研究生成式 AI 对青少年发展、身心健康与安全的影响。申请现已开放。
1Password 工程师使用 Codex 快速构建新功能与内部工具,在保持严格安全策略的同时达到生产就绪状态,工程效率提升 21%。
OpenAI 联合 AIRPPU 与 WAN-IFRA 推出 AI 项目,支持乌克兰新闻机构加强创新、韧性与独立新闻。
Jakub Pachocki 反思 AI 能力持续提升带来的对齐挑战,呼吁加强安全保障与国际协调。
summary_zh: OpenAI 内部数据显示编码智能体正在重塑 AI 研究流程。早期数据涵盖智能体使用率、实验迭代速度、任务复杂度与研究加速效果,但具体数字和指标未在正文中披露。 OpenAI 内部数据显示编码智能体正在重塑 AI 研究流程。早期数据涵盖智能体使用率、实验迭代速度、任务复杂度与研究加速效果,但具体数字和指标未在正文中披露。
OpenAI 推出 Daybreak for Frontline Defenders,承诺投入 10 亿美元扩大前沿网络安全 AI、培训和支持的覆盖范围。该计划面向关键服务提供者,具体可用性与接入方式原文未进一步说明。
Legora 使用 GPT-6 Astra 在数分钟内审阅了 41 份文档,找出全部 4 个植入错误,并在财务审核工作流中性能提升近 40%。
Playco 基于 GPT-6 Astra 从一个灰色框基础构建了三款主题游戏原型,手动修复数量比上一模型减少 50%。
Together AI 在 113 个 DeepSWE 任务、每侧 452 次 rollout 上对比 GLM-5.3(max)与 GPT-5.6 Sol(max)。
推荐理由:同一跑道上 GLM-5.3 以一半价格逼近 Sol,在重试和覆盖率上反而反超,读者可据此设计前端开源、后端旗舰的级联路由。
Together AI 在 DeepSWE 上对比 GLM-5.3 与 Claude Fable 5:首次尝试通过率 69.0% vs 69.7%,GLM-5.3 每次调用 $3.99。
推荐理由:在精度相近时,GLM-5.3 以五分之一成本覆盖更多任务,为预算有限的工程团队提供了清晰的选型与路由依据。
Google Research 提出知识剖析框架,发现前沿大模型的事实性错误主要源于回忆失败而非知识未编码。WikiProfile 基准包含 2,150 条维基百科事实,每个事实配 10 个问题,评测了 13 个 LLM 约 450 万条响应。
推荐理由:该研究将大模型的 factual error 重新定义为 recall 失败而非 encoding 失败,并证明思考机制可恢复约四成到六成已编码但无法直接提取的事实。
AWS Trainium Frontier 竞赛邀请学术和工业界团队在 Trainium2 上从零训练语言模型,探索模型架构、优化器、训练循环与 NKI 自定义内核的全栈设计。
推荐理由:AWS Trainium Frontier 竞赛让参与者在固定训练预算下从零训练语言模型,探索硬件原生架构与自定义内核的协同设计空间。