今天看啥  ›  专栏  ›  青稞AI

谈谈 DeepSeek-R1 和 V3.2 的后训练以及 RL 训练稳定性的问题

青稞AI  · 公众号  · AI  · 2026-04-03 00:00
    

原文地址: 访问原文地址 (快捷配置)
总结与预览地址:访问文章预览/总结
文章地址: 访问文章快照