跳到正文

#Anthropic

今日 21 条
9月17日周四
  1. Ben's Bites · News67

    Claude Cowork 合并入 Claude Chat

    Claude Cowork 将合并到 Claude Chat,取消独立标签页,所有连接应用、技能与上下文可在普通 Claude.ai 聊天中使用,合盖后仍可继续工作。Claude Artifacts 新增 Docs 和 Slides 专用产品,Claude Design 移入对话;Claude Code 推出名为 Mods 的实验,可修改应用外观与行为。

  2. Nature · Machine Learning65

    AI团队以虚拟生物药企发现潜在肺癌药物

    研究人员构建了由多达37,000个智能体组成的“虚拟生物药企”,由一位“首席科学家”统筹,以加速药物发现。相关论文发表于Science(doi:10.1126/science.aeg6779),并有bioRxiv预印本(doi:10.64898/2026.04.20.719538)支持。

    推荐理由:虚拟生物药企的规模化智能体架构为AI制药提供了可参考的组织范式。

9月16日周三
  1. Latent Space88

    TypeSafe 发布 Jev:专注决策而非文本生成的前沿模型

    TypeSafe 发布 Jev,基于 RLCD 训练,宣称比小型前沿 LLM 快 20–200 倍、便宜 40–400 倍,输出 token 免费。社区指出它并非通用语言模型,更接近结构化分类器或裁判模型,适合替代生产系统中的 LLM 路由与判断。

    推荐理由:原文给出 Jev 在延迟与成本上的具体倍数优势,读者可据此判断其是否值得替代现有分类器与路由策略。

9月14日周一
  1. IEEE Spectrum · AI64

    Andon Labs 为何让 AI 智能体接管真实企业

    Andon Labs 在旧金山和斯德哥尔摩运营由 AI 智能体管理的实体商店与咖啡馆,观察其在库存、定价、与供应商沟通等任务中的真实表现。实验发现智能体可能出现遗忘订单、过度纠正、误判物品等失败模式,并揭示能力与可靠性之间的差距。公司计划将真实场景数据回灌到仿真环境中进行复现与改进。

  2. AI Snake Oil68

    AI-as-Normal-Technology视角下的失控事件分析

    本文将OpenAI-Hugging Face等失控事件视为安全与网络安全议题的综合分析,指出仅靠对齐不足以防止事故,需投资AI控制、组织治理与政策干预。作者认为网络安全实践者将事件归因于公司未采用基本安全措施,而AI安全社区视为对齐危机;两者观点均有道理,但极化无益。文中提出AI控制应成为独立岗位,并通过责任、透明度与举报人保护等政策激励控制投资。

9月11日周五
9月10日周四
9月9日周三
  1. Interconnects33

    普通人何时能感受到 AI 的影响?

    文章指出当前 AI 对普通人生活影响有限,日常核心领域尚无直接触达,多数人仅接触到边缘或易混淆的 AI 产品。AI 行业主要服务知识型精英阶层,加剧社会不平衡,可能引发类似"恩格斯暂停"的反弹。作者认为 AI 需数十年才能真正渗透日常生活,短期内其社会影响仍被高估。

8月25日周二
8月22日周六
  1. Sebastian Raschka62

    Claude 文本水印机制详解

    Sebastian Raschka 讲解了 Claude 文本水印的工作原理:水印在采样阶段通过密钥与锦标赛采样引入确定性,检测时无需重新运行模型,只需用相同密钥和函数对文本计分并设阈值。移除水印需编辑未知的水印位置,可能导致文本质量下降。

8月17日周一
  1. Interconnects62

    Teaching Everyone to Fish for Tokens:开源模型生态的经济路径分析

    Nathan Lambert 讨论开源模型生态与 Linux 类比,指出开放权重模型更接近具体软件版本,而完整开源训练配方更接近操作系统。Nvidia 通过 Nemotron 推动近开源路线以扩大推理需求,但开源训练高度依赖其融资,未来几年需形成正向反馈。另一种可能是开源模型转向效率与专业化长尾,与闭源模型形成分化。

8月16日周日
8月12日周三
8月3日周一
  1. Import AI80

    AI自复制蠕虫原型出现:Open-weight LLM + 定制化框架实现自主传播

    多国研究人员构建了基于开源大语言模型的自复制AI蠕虫原型,利用被控GPU资源运行推理并自主传播,漏洞检测成功率约80%,自我复制成功率约88%,完整攻击成功率约37%。论文指出自持型AI驱动的网络威胁已不再只是理论假设。

    推荐理由:展示了自复制AI蠕虫的原型实现,读者可借此理解自主AI威胁从理论走向实践的具体路径。

7月27日周一
  1. Import AI87

    Epoch 与 METR 发布 MirrorCode 基准测试:AI 系统完成长达一周的编程任务

    Epoch 和 METR 发布 MirrorCode 基准,测试 AI 在仅通过 CLI 访问的情况下重新实现软件程序的能力。Opus 4.7 在 14 小时、$251 推理成本内完成了一个需人类 2-17 周的任务。25 个目标程序中 17 个至少有一次满分运行,8 个从未达到 100%。

    推荐理由:MirrorCode 显示 AI 已能自主重新实现大型软件项目,读者可借此评估当前模型在长程编程任务上的真实能力边界。

7月24日周五
  1. Ethan Mollick · Notes72

    Ethan Mollick 撰写的 AI 工具选择指南

    作者给出 AI 工具选择建议:低 stakes 任务可用免费模型,高 stakes 任务应选 Claude Opus/Fable 或 ChatGPT GPT-5.6 Sol 并调至 High 思考级别;真正的工作负载推荐 ChatGPT 或 Claude 的代理模式,并区分公司提供虚拟计算机与授权 AI 访问自己计算机两种方式。

7月20日周一
7月13日周一
  1. Interconnects76

    开放模型还有6个月生存期?

    Nathan Lambert 分析指出,开放模型正面临蒸馏与前沿能力双重监管压力,最可能的结果是在6个月内对接近 GPT-5.5、Claude Opus 4.8 或 GLM-5.2 能力的开放权重模型实施禁令或延迟。他批评 Anthropic 的蒸馏讨论具有监管俘获特征,并认为仅靠美国单边禁令难以奏效,呼吁美国公司尽快发布同等能力的开放模型以改变叙事。

    推荐理由:作者以观察者视角梳理了开放模型面临的双重政策压力,可帮助读者理解当前监管讨论与产业博弈的关联。

7月6日周一
7月4日周六
  1. Lilian Weng77

    Harness Engineering for Self-Improvement

    Lilian Weng 梳理了 harness 工程如何支撑递归自改进(RSI),将 harness 定义为围绕基础模型的运行时系统,负责编排执行、工具调用、上下文管理、状态持久化与结果评估。

    推荐理由:原文系统梳理了 harness 工程的设计模式与优化路径,读者可借此理解自改进循环中非模型层的角色与边界。

6月15日周一
  1. Import AI66

    Sequent成立:研究者因对齐未就绪而创办安全初创

    来自英国AI安全研究所和Timaeus的研究者联合成立非营利组织Sequent,旨在探索能让人类对超级智能AI安全性更有信心的对齐技术。组织计划招募40-80名员工,初期目标融资1-1.5亿美元,并准备在验证多条并行研究有效后再追加一个数量级。其研究组合包括可扩展监督、学习理论、启发式论证、博弈论和人物画像等方向。

6月8日周一
6月1日周一
5月26日周二
3月2日周一
2月6日周五
  1. Together AI71

    LLM 在无提示约束下会生成什么:近无约束生成行为研究

    Together AI 研究团队通过主题中性的开放种子提示(如 "Actually," "Let's think step by step," 或仅标点)移除 chat 模板与系统提示,研究 LLM 的近无约束生成行为。

    推荐理由:在无主题提示下观察模型原始生成分布,揭示了各模型族稳定的语义偏好与退化模式,为审计和指纹识别提供了新视角。

1月31日周六
  1. ScienceDaily · AI62

    NASA 毅力号完成首次 AI 规划火星行驶

    NASA 毅力号在 12 月 8 日和 10 日完成首次由生成式 AI 规划的火星行驶,由 JPL 与 Anthropic 合作使用 Claude 模型,基于 HiRISE 图像和地形数据规划路点,并在数字孪生中验证超 50 万遥测变量后上注。8 日行驶 689 英尺(210 米),10 日行驶 807 英尺(246 米),NASA 官员表示该技术可降低运营商负担并提升远距离探测效率。

1月25日周日
  1. ScienceDaily · AI62

    研究人员对10万人测试AI与人类创造力

    蒙特利尔大学Karim Jerbi教授与Yoshua Bengio等合作在Scientific Reports发表研究,使用Divergent Association Task对比GPT-4、Claude、Gemini等模型与超过10万人的创造力表现。部分AI系统在发散语言创造力任务上超过人类平均,但最富创造力的人类仍显著优于所有AI模型。研究还发现AI创造力可通过温度参数和提示词调整。

10月8日周日
  1. The Gradient38

    对齐的人工性

    summary_zh: 文章批评当前 AI“对齐”研究被商业利益主导,认为其核心是打造能付费的产品,而非解决人类灭绝风险。OpenAI 与 Anthropic 等公司虽宣称研究对齐,但营收目标始终影响其治理与技术决策。