TensorZero:实验与工程博客·· 15 小时前精选AI 评分66
TensorZero 在 LLM 网关中引入多臂老虎机自适应 A/B 实验
Bandits in your LLM Gateway: Improve LLM Applications Faster with Adaptive Experimentation (A/B Testing)
AI 导读
TensorZero 推出基于 Track-and-Stop 最佳臂识别的多臂老虎机算法,在 LLM 网关中实现自适应 A/B 实验,动态调整采样比例并用 anytime-valid 的 GLRT 停止规则避免 p-hacking。
推荐理由
文章用仿真和真实 NER 实验数据说明自适应实验相比均匀采样能减少约 37% 的判定时间,并给出可直接复用的配置方法。
来源:TensorZero:实验与工程博客 · tensorzero.com