今天看啥  ›  专栏  ›  专知

ICML 2026 | REAR:通过奖励分解,在测试时重对齐大模型偏好

专知  · 公众号  ·  · 2026-07-02 20:35
    

原文地址: 访问原文地址
总结与预览地址:访问文章预览/总结
文章地址: 访问文章快照