|
|
浅谈AI编译器趋势:从更快的kernel到重新定义执行边界 吃果冻不吐果冻皮 · 公众号 · · 2 月前 · |
|
|
深度学习模型推理部署实战:CUDA开发与TensorRT量化加速 吃果冻不吐果冻皮 · 公众号 · · 2 月前 · |
|
|
Harness 工程及设计模式 吃果冻不吐果冻皮 · 公众号 · · 2 月前 · |
|
|
一文搞懂如何极致的使用Codex「最佳实践」 吃果冻不吐果冻皮 · 公众号 · · 2 月前 · |
|
|
从 KL 的方向看 SFT 与 RL:大模型到底是在”学会做”,还是在”学会选”? 吃果冻不吐果冻皮 · 公众号 · · 2 月前 · |
|
|
LLM近期重大架构进化一览:从Gemma 4到DeepSeek V4 吃果冻不吐果冻皮 · 公众号 · · 2 月前 · |
|
|
重构大模型推理网络:ZCube 如何避免结构性网络拥塞 吃果冻不吐果冻皮 · 公众号 · · 2 月前 · |
|
|
如何合成 Agentic 事实性 SFT / Mid-train 数据? 吃果冻不吐果冻皮 · 公众号 · · 2 月前 · |
|
|
大语言模型为什么能像人一样说话和思考? 吃果冻不吐果冻皮 · 公众号 · · 2 月前 · |
|
|
DSv4放弃MLA了吗? 吃果冻不吐果冻皮 · 公众号 · · 2 月前 · |
|
|
OpenAI 翁家翌:“启发式学习”的强化学习新范式 吃果冻不吐果冻皮 · 公众号 · · 2 月前 · |
|
|
Agent Harness 解析:智能体架构深度拆解 吃果冻不吐果冻皮 · 公众号 · · 2 月前 · |
|
|
下一个范式诞生?OpenAI翁家翌:不练网络不调参,全靠Agent改代码破解灾难性遗忘死局 吃果冻不吐果冻皮 · 公众号 · · 2 月前 · |
|
|
LLM 预训练数据工程的关键实践! 吃果冻不吐果冻皮 · 公众号 · · 3 月前 · |
|
|
DeepSeek-V4 的并行策略和计算通信遮掩 吃果冻不吐果冻皮 · 公众号 · · 3 月前 · |
|
|
AI Infra新探索:克服Coding Agent推理的Scaling Pain 吃果冻不吐果冻皮 · 公众号 · · 3 月前 · |
|
|
从 DeepSeek V4 的多专家 on-policy Distillation 反观人类学习模式 吃果冻不吐果冻皮 · 公众号 · · 3 月前 · |
|
|
高效搞定学术公式!利用LlamaFactory微调实现 LaTeX 精准转换 吃果冻不吐果冻皮 · 公众号 · · 3 月前 · |
|
|
大模型高效推理新答案:ICLR 2026提出Balanced Thinking,精度提升10.0的同... 吃果冻不吐果冻皮 · 公众号 · · 3 月前 · |