Google Research·· 14 天前AI 评分50
通过 Retrieve-for-Train 绕过推理瓶颈:利用 RL 编译扩散模型加速复杂 AI 搜索
Bypassing inference bottlenecks: Accelerating complex AI search with Retrieve-for-Train
AI 导读
Google Research 提出 Retrieve-for-Train 框架,利用离线强化学习将奖励对齐的查询发散行为编译进 53.9M 参数的轻量级扩散检索器。该方法避免了标准 LLM 在推理时因链式推理(CoT)产生的延迟和语义坍缩,在 Gemma3-4B 和 Qwen3-4B 模型验证下实现了单-pass 高效查询发散。
来源:Google Research · research.google