跳到正文
原文
Google Developers Blog(RSS)·· 16 小时前AI 评分52

Google 介绍用 Tunix 在 TPU 上通过 autofinetune 智能体循环自动化 LLM 后训练

Autonomous LLM post-training with Tunix on TPUs

AI 导读

Google 发布 autofinetune 项目,将 autoresearch 的自主研究循环应用到 LLM 后训练(SFT 和基于 GRPO 的强化学习),使用 Tunix、Gemma 和 Cloud TPU,并由 Antigravity CLI 与 Gemini Flash 3.7 编排。

来源:Google Developers Blog(RSS) · developers.googleblog.com