|
|
纯干货!工业场景下,LLM Agent RL的一些实践感悟 包包算法笔记 · 公众号 · AI · 8 月前 · |
|
|
理解 RL学习的本质!大模型如何同时学习新技能和避免灾难性遗忘? 包包算法笔记 · 公众号 · AI · 8 月前 · |
|
|
· 公众号 · AI · 8 月前 · |
|
|
· 公众号 · AI · 8 月前 · |
|
|
· 公众号 · AI · 8 月前 · |
|
|
· 公众号 · AI · 8 月前 · |
|
|
· 公众号 · AI · 8 月前 · |
|
|
· 公众号 · AI · 8 月前 · |
|
|
· 公众号 · AI · 8 月前 · |
|
|
· 公众号 · AI · 8 月前 · |
|
|
· 公众号 · AI · 8 月前 · |
|
|
如何训练一个开源推理模型、Olmo-Thinking作者分享实录 包包算法笔记 · 公众号 · AI · 9 月前 · |
|
|
· 公众号 · AI · 9 月前 · |
|
|
Kimi Linear一作张宇:关于模型训练的一些感想 包包算法笔记 · 公众号 · AI · 9 月前 · |
|
|
· 公众号 · AI · 9 月前 · |
|
|
· 公众号 · AI · 9 月前 · |
|
|
大模型RL各种trick 包包算法笔记 · 公众号 · AI · 9 月前 · |
|
|
· 公众号 · AI · 9 月前 · |
|
|
· 公众号 · AI · 9 月前 · |
|
|
中国首个开源AI原生后端来了!AI Coding 终于能闭环了 包包算法笔记 · 公众号 · AI · 9 月前 · |