|
|
OpenAI o1: 合成数据与推理搜索 包包算法笔记 · 公众号 · AI · 1 年前 · |
|
|
蹭蹭o1的热度,再聊一聊AGI的远方 包包算法笔记 · 公众号 · AI · 1 年前 · |
|
|
· 公众号 · AI · 1 年前 · |
|
|
OpenAI o1 self-play RL 技术路线推演 包包算法笔记 · 公众号 · AI · 1 年前 · |
|
|
谈谈OpenAI o1的价值意义及RL 的Scaling Law 包包算法笔记 · 公众号 · AI 科技创业 科技自媒体 · 1 年前 · |
|
|
OpenAI震撼发布o1大模型!RL深度思考,技术差距拉开 包包算法笔记 · 公众号 · AI · 1 年前 · |
|
|
大模型对齐技术,各种什么O:PPO,DPO, SimPO,KTO,Step-DPO, MCTS-DP... 包包算法笔记 · 公众号 · AI · 1 年前 · |
|
|
大模型“题库刷榜”排行榜,Qwen模型位居榜首 包包算法笔记 · 公众号 · AI · 1 年前 · |
|
|
· 公众号 · AI · 1 年前 · |
|
|
人人都能看懂的DPO数学原理 包包算法笔记 · 公众号 · AI · 1 年前 · |
|
|
ACL2024 | LLM+RAG可能要毁了信息检索,一份深入研究 包包算法笔记 · 公众号 · AI · 1 年前 · |
|
|
有了大语言模型后,知识图谱该何去何从? 包包算法笔记 · 公众号 · AI · 1 年前 · |
|
|
将 MOE 塞到 LoRA: 一篇文章的诞生 包包算法笔记 · 公众号 · AI · 1 年前 · |
|
|
全网被Reflection 70b狠狠耍了,竟是LLama 70B的Lora微调 包包算法笔记 · 公众号 · AI · 1 年前 · |
|
|
· 公众号 · AI · 1 年前 · |
|
|
如何解读 Yann LeCun 建议学生不要在大模型方向工作? 包包算法笔记 · 公众号 · AI · 1 年前 · |
|
|
大模型 VS 小模型 包包算法笔记 · 公众号 · AI · 1 年前 · |
|
|
· 公众号 · AI · 1 年前 · |
|
|
55个大模型比赛汇总 包包算法笔记 · 公众号 · AI · 1 年前 · |