跳到正文
原文
Google Research·· 16 天前AI 评分32

Google Research 用 Retrieve-for-Train 绕过推理瓶颈,加速复杂 AI 搜索

Bypassing inference bottlenecks: Accelerating complex AI search with Retrieve-for-Train

AI 导读

Google Research 提出 Retrieve-for-Train 框架,用离线强化学习把奖励对齐的 fan-out 查询编译成监督信号,再蒸馏进一个 53.9M 参数的扩散检索器,实现推理时单次非自回归的查询 fan-out,无需测试时 CoT 推理 token。

来源:Google Research · research.google