|
|
多模态大模型文心4.5后训练详解 吃果冻不吐果冻皮 · 公众号 · · 1 年前 · |
|
|
万字长文|小作坊的强化之路 吃果冻不吐果冻皮 · 公众号 · · 1 年前 · |
|
|
万字技术干货!LLM工程师必读量化指南,可视化图解揭秘大模型如何量化 吃果冻不吐果冻皮 · 公众号 · · 1 年前 · |
|
|
Qwen3-RL训练过程详解 吃果冻不吐果冻皮 · 公众号 · · 1 年前 · |
|
|
2025最新!三万字长文,详解统一多模态理解与生成模型的进展、挑战与机遇 吃果冻不吐果冻皮 · 公众号 · · 1 年前 · |
|
|
谈一谈对大模型对齐框架的反思及其改进思路 吃果冻不吐果冻皮 · 公众号 · · 1 年前 · |
|
|
LLM中On-Policy与Off-Policy的本质区别是什么? 吃果冻不吐果冻皮 · 公众号 · · 1 年前 · |
|
|
盘一盘,2017年Transformer之后,LLM领域的重要论文 吃果冻不吐果冻皮 · 公众号 · · 1 年前 · |