|
|
AI Infra 面试问题QA 总结——大模型推理 吃果冻不吐果冻皮 · 公众号 · · 3 月前 · |
|
|
大模型 RL 训练:计算流程全解析 吃果冻不吐果冻皮 · 公众号 · · 3 月前 · |
|
|
全网最全!四足机器人RL部署流程:URDF解析、域随机化、摩擦补偿等(含4个项目实践) 吃果冻不吐果冻皮 · 公众号 · · 3 月前 · |
|
|
大模型知识蒸馏:On-Policy Distillation(原理篇) 吃果冻不吐果冻皮 · 公众号 · · 3 月前 · |
|
|
特斯拉开源硬件,中国公司回应来了:直接把机器人大脑开源了 吃果冻不吐果冻皮 · 公众号 · · 3 月前 · |
|
|
Harness 工程及设计模式 吃果冻不吐果冻皮 · 公众号 · · 3 月前 · |
|
|
深度解析:Harness Engineering 吃果冻不吐果冻皮 · 公众号 · · 3 月前 · |
|
|
Claude Code 模型 RL训练中的Reward Hacking 吃果冻不吐果冻皮 · 公众号 · · 3 月前 · |
|
|
刚刚,梁文锋被曝史上首次融资!DeepSeek V4彻底摆脱英伟达 吃果冻不吐果冻皮 · 公众号 · · 3 月前 · |
|
|
深度讲解两种 KL 散度:Forward 与 Reverse,以及在实际应用中如何选择? 吃果冻不吐果冻皮 · 公众号 · · 3 月前 · |
|
|
硬核实战!从0建模,搭建一套机器人导航系统 吃果冻不吐果冻皮 · 公众号 · · 3 月前 · |
|
|
SkillReducer:为Skills瘦身,破解Token低效难题 吃果冻不吐果冻皮 · 公众号 · · 3 月前 · |
|
|
AI工程范式的三次演化:Prompt Engineering → Context Engineeri... 吃果冻不吐果冻皮 · 公众号 · · 3 月前 · |
|
|
AI智能体全栈开发实战 吃果冻不吐果冻皮 · 公众号 · · 4 月前 · |
|
|
SGLang Overview:设计哲学与关键机制 吃果冻不吐果冻皮 · 公众号 · · 4 月前 · |
|
|
Agentic能力从哪里来?拆解基座大模型的训练过程 吃果冻不吐果冻皮 · 公众号 · · 4 月前 · |
|
|
聊聊 Gemma 4 的架构和训练 吃果冻不吐果冻皮 · 公众号 · · 4 月前 · |
|
|
「同事.Skill」冲上热搜,离职同事已被炼化! 吃果冻不吐果冻皮 · 公众号 · · 4 月前 · |
|
|
机器人版GPT-3来了:任务成功率99%,「涌现」过后能临场发挥 吃果冻不吐果冻皮 · 公众号 · · 4 月前 · |