基础API: 未开通,请先订阅专栏再开通
高级API: 未开通,请先订阅专栏再开通
扩展API接口一: 未开通,请先订阅专栏再开通
|
|
中科院联合北大发布X-DiffVLA | 终结"一机一模型"时代 深度强化学习 CASIA · 公众号 · · 1 月前 · |
|
|
自动化所&小米打破端到端“模仿陷阱” | BeyondDrive提出“犯错-觉醒”机制刷新NAVSI... 深度强化学习 CASIA · 公众号 · · 1 月前 · |
|
|
深度强化学习讲座系列—总第23期,2026-06 深度强化学习 CASIA · 公众号 · · 2 月前 · |
|
|
磐石·科学基础大模型赋能LAMOST:从千万光谱中开启稀有天体搜寻新方案 深度强化学习 CASIA · 公众号 · · 2 月前 · |
|
|
恭喜2026年夏季毕业生 深度强化学习 CASIA · 公众号 · · 2 月前 · |
|
|
实录精选!直面OPD训练困境,如何破解三类典型失败与修复路径? 深度强化学习 CASIA · 公众号 · · 2 月前 · |
|
|
自动化所最新推出 π-Play: 基于自博弈生成特权信息的自蒸馏大模型自进化框架 深度强化学习 CASIA · 公众号 · · 2 月前 · |
|
|
直播预告|从 MiniLLM 开始,为什么 OPD 正在成为推理模型时代的“基础设施”? 深度强化学习 CASIA · 公众号 · · 2 月前 · |
|
|
2026智源大会议程公开丨强化学习论坛 深度强化学习 CASIA · 公众号 · · 3 月前 · |
|
|
【转载】重探 On-Policy Distillation(OPD):三类典型失败以及修复路径 深度强化学习 CASIA · 公众号 · · 3 月前 · |