跳到正文

#开源生态

今日 0 条
9月28日周一
9月21日周一
9月19日周六
9月11日周五
9月2日周三
8月17日周一
  1. Interconnects62

    Teaching Everyone to Fish for Tokens:开源模型生态的经济路径分析

    Nathan Lambert 讨论开源模型生态与 Linux 类比,指出开放权重模型更接近具体软件版本,而完整开源训练配方更接近操作系统。Nvidia 通过 Nemotron 推动近开源路线以扩大推理需求,但开源训练高度依赖其融资,未来几年需形成正向反馈。另一种可能是开源模型转向效率与专业化长尾,与闭源模型形成分化。

8月9日周日
7月13日周一
  1. Interconnects76

    开放模型还有6个月生存期?

    Nathan Lambert 分析指出,开放模型正面临蒸馏与前沿能力双重监管压力,最可能的结果是在6个月内对接近 GPT-5.5、Claude Opus 4.8 或 GLM-5.2 能力的开放权重模型实施禁令或延迟。他批评 Anthropic 的蒸馏讨论具有监管俘获特征,并认为仅靠美国单边禁令难以奏效,呼吁美国公司尽快发布同等能力的开放模型以改变叙事。

    推荐理由:作者以观察者视角梳理了开放模型面临的双重政策压力,可帮助读者理解当前监管讨论与产业博弈的关联。

6月19日周五
  1. Interconnects23

    禁止开源 AI 将是一个错误

    文章指出禁止开源 AI 是严重错误,开源软件已为全球创造超 8 万亿美元经济价值。开源 AI 以开放权重模型形式成为对抗 Anthropic 与 OpenAI 双头垄断的关键制衡力量。文章强调开源的透明性使其更安全,并呼吁警惕以中美竞争为借口监管开源带来的反噬。

1月27日周二
  1. Jeremy Howard · fast.ai50

    Breaking the Spell of Vibe Coding

    Vibe coding 指大量生成复杂 AI 代码且不打算让人阅读,已对科技行业产生类似赌博的"dark flow"效应。资深开发者 Armin Ronacher 描述自己两个月过度提示 Claude、浪费 token,建了很多最终未使用或无法正常工作的工具,称其为"agent psychosis"。

12月30日周二
  1. Sebastian Raschka52

    2025 年 LLM 现状:进展、问题与预测

    Sebastian Raschka 回顾 2025 年大语言模型关键发展,指出 RLVR 与 GRPO 主导了后训练范式,推理模型在数学和代码领域已接近金牌水平,同时警告基准刷榜泡沫。他预测 2026 年 RLVR 将扩展至更多领域,推理时缩放和持续学习将更受关注,并认为私有数据与领域适配将成为下一阶段竞争焦点。