Google Developers Blog(RSS)·· 16 小时前AI 评分52
Google 介绍用 Tunix 在 TPU 上通过 autofinetune 智能体循环自动化 LLM 后训练
Autonomous LLM post-training with Tunix on TPUs
AI 导读
Google 发布 autofinetune 项目,将 autoresearch 的自主研究循环应用到 LLM 后训练(SFT 和基于 GRPO 的强化学习),使用 Tunix、Gemma 和 Cloud TPU,并由 Antigravity CLI 与 Gemini Flash 3.7 编排。
来源:Google Developers Blog(RSS) · developers.googleblog.com