今天看啥  ›  专栏  ›  青稞AI

On-Policy Self-Distillation:LLM利用隐式用户反馈定向纠错与持续学习

青稞AI  · 公众号  · AI  · 2026-06-30 12:00
    

原文地址: 访问原文地址
总结与预览地址:访问文章预览/总结
文章地址: 访问文章快照