跳到正文
原文
arXiv:cs.AI(全量分类)· Blaz Bertalanic, Carolina Fortuna·· 1 天前AI 评分44

小 LLM 团队扩展的精确生成-变换分解:跨编排架构研究

An Exact Generate - Transform Decomposition of Small-LLM Team Scaling Across Orchestration Architectures

AI 导读

研究横扫 8 种智能体编排架构、5 个指令微调 7-9B 模型和 5 个短答案基准,发现团队扩展收益高度依赖任务:从 3 次到 30 次调用,GSM8K 和 GSMHard 准确率最多提升 17 分,而 ARC、GPQA、MMLU 最多仅提升 4 分。

来源:arXiv:cs.AI(全量分类) · arxiv.org