|
|
从 Attention 到 Relation:深入理解 Token 到底应该怎么流动? 青稞AI · 公众号 · AI · 10 小时前 · |
|
|
直播预告!从 Harness 看 AI4AI 如何实现 青稞AI · 公众号 · AI · 昨天 · |
|
|
从 LR(学习率) 到 ELR(有效学习率),重新理解大模型预训练的调度策略 青稞AI · 公众号 · AI · 昨天 · |
|
|
终局奖励之后:从 Apodex 1.1 看长程 Agentic RL 如何分配 credit 青稞AI · 公众号 · AI · 2 天前 · |
|
|
直播预告!从"如何生成"到"如何验证",探讨物理一致世界建模如何支撑可规模化机器人学习 青稞AI · 公众号 · AI · 3 天前 · |
|
|
大模型知识机理探索:知识编辑与持续学习 青稞AI · 公众号 · AI · 3 天前 · |
|
|
当 Harness 也能被 AI 自动设计:AI4AI 正在重写小模型变强的方式 青稞AI · 公众号 · AI · 4 天前 · |
|
|
分级缓存 + 投机解码 + 正交分片:Macaron-V1 的长上下文推理实践 青稞AI · 公众号 · AI · 5 天前 · |
|
|
华为 & 港中文最新开源 Lego-RL:让 Coding Agent 的强化学习训练真正"长稳可靠... 青稞AI · 公众号 · AI · 6 天前 · |
|
|
Harness 基座模型 JIT-27B,为每个任务写一套“Claude Code” 青稞AI · 公众号 · AI · 1 周前 · |
|
|
从 Infra 角度看,为什么去掉 Encoder 更好? 青稞AI · 公众号 · AI · 1 周前 · |
|
|
直播预告!到底模型的“什么经验值得被看见”?一起聊聊 LOPD:不再手动设计 OPSD 特权信息 青稞AI · 公众号 · AI · 1 周前 · |
|
|
关于 RSI 的一些思考:Test-Time 沉淀与 Training-Time 演化的架构终局 青稞AI · 公众号 · AI · 1 周前 · |
|
|
聊聊 Agentic RL 中的多轮 rollout、上下文重建与 RL 训练 青稞AI · 公众号 · AI · 1 周前 · |
|
|
Infra 也能自进化?Φ-Bench 深度评测:大模型距离“AI 工程师”还有多远? 青稞AI · 公众号 · AI · 1 周前 · |
|
|
自回归模型写错了就再也改不了?EchoChange 另辟蹊径,把遥感变化描述变成"可以反复修改的填空... 青稞AI · 公众号 · AI · 1 周前 · |
|
|
自进化也能“左脚踩右脚”?Google 最新提出 EnvHarness:环境自进化,倒逼 Agent... 青稞AI · 公众号 · AI · 1 周前 · |
|
|
将 Harness 引入评测领域!HarnessEval 开启评测新时代,让 Agentic Ben... 青稞AI · 公众号 · AI · 1 周前 · |
|
|
直播预告!聊聊 TriAttention:面向长上下文推理的三角级数式 KV Cache 压缩 青稞AI · 公众号 · AI · 2 周前 · |
|
|
唐杰|关于缩放定律的思考:参数不是唯一旋钮 青稞AI · 公众号 · AI · 2 周前 · |