|
|
预训练4B token就能上RL? AI帝国 · 公众号 · · 1 月前 · |
|
|
AUTOLAB实测,11家旗舰模型谁能做长程自动科研? AI帝国 · 公众号 · · 1 月前 · |
|
|
开箱即用agent能筛数据,但想超越强基线还得靠脚手架 AI帝国 · 公众号 · · 1 月前 · |
|
|
均匀混合就够用?数据受限和SFT时未必 AI帝国 · 公众号 · · 1 月前 · |
|
|
模型靠自己生成的文本就能进步?前提是这些数据得"配得上"它 AI帝国 · 公众号 · · 1 月前 · |
|
|
给闭源agent装个"外脑":不训练模型,能治好长任务健忘症不 AI帝国 · 公众号 · · 1 月前 · |
|
|
Mellum2 Technical Report AI帝国 · 公众号 · · 1 月前 · |
|
|
LLM预训练后期可用合并再降损失 AI帝国 · 公众号 · · 1 月前 · |
|
|
不看文笔也能识破AI小说:5个大模型留下的叙事指纹 AI帝国 · 公众号 · · 1 月前 · |
|
|
Agent Harness Engineering综述 AI帝国 · 公众号 · · 1 月前 · |