|
|
三问一图万字拆解DeepSeek-R1:训练之道、实力之源与市场之变 吃果冻不吐果冻皮 · 公众号 · · 1 年前 · |
|
|
Kimi-VL:视觉语言模型(VLM)的新探索 吃果冻不吐果冻皮 · 公众号 · · 1 年前 · |
|
|
PPO 算法的37个实现细节 吃果冻不吐果冻皮 · 公众号 · · 1 年前 · |
|
|
R1 的一些认知:4 个经典误区 吃果冻不吐果冻皮 · 公众号 · · 1 年前 · |
|
|
重要性采样是什么?在强化学习中怎么应用,又有什么缺陷? 吃果冻不吐果冻皮 · 公众号 · · 1 年前 · |
|
|
一文了解DeepSeek及应用场景 吃果冻不吐果冻皮 · 公众号 · · 1 年前 · |
|
|
详解模型部署工程师的关键技能:CUDA开发与TensorRT部署 吃果冻不吐果冻皮 · 公众号 · · 1 年前 · |
|
|
万字长文总结多模态大模型后训练 吃果冻不吐果冻皮 · 公众号 · · 1 年前 · |