跳到正文
原文
Google Developers · AI·· 57 分钟前AI 评分50

自主 LLM 后训练:Tunix 在 TPU 上自动微调实验

Autonomous LLM post-training with Tunix on TPUs

AI 导读

Google 发布 autofinetune 项目,将自主研究循环应用于 LLM 后训练(SFT 与 GRPO),由 Tunix、Gemma 与 Cloud TPU 配合 Antigravity CLI 和 Gemini Flash 3.7 驱动。

来源:Google Developers · AI · developers.googleblog.com