|
|
训练刚开始,子空间就锁死了——在线蒸馏的几何秘密 AI帝国 · 公众号 · · 1 月前 · |
|
|
Agent部署前,能不能先用Lean4查逻辑bug? AI帝国 · 公众号 · · 1 月前 · |
|
|
无人机在长指令时,为什么要先想再飞? AI帝国 · 公众号 · · 1 月前 · |
|
|
AI记忆系统为什么常输给最朴素的全上下文? AI帝国 · 公众号 · · 1 月前 · |
|
|
用因果图给LLM做"推理透视",来看看LLM到底是怎么“思考”的 AI帝国 · 公众号 · · 1 月前 · |
|
|
小实验选数据配比,放大后为什么会失灵? AI帝国 · 公众号 · · 1 月前 · |
|
|
10000组近似任务里,agent 是怎么实现快7.5倍的? AI帝国 · 公众号 · · 1 月前 · |
|
|
跑了几千次实验后发现:AI Agent搭流水线很行,验证自己最薄弱 AI帝国 · 公众号 · · 1 月前 · |
|
|
用小模型参数预测大模型最优数据配比,这篇论文做到了 AI帝国 · 公众号 · · 1 月前 · |
|
|
多轮自进化三轮就崩?LLM Agent经验内化的三个关键选择 AI帝国 · 公众号 · · 1 月前 · |
|
|
后训练推理数据到底怎么用才对? AI帝国 · 公众号 · · 1 月前 · |