|
|
当 Agent 尝试接管浏览器,连“我是人类”都证明不了?上海交大开源发布交互评测基准 HLL 深度学习自然语言处理 · 公众号 · · 2 周前 · |
|
|
GPT-5.4 仅 11.36%!当大规模工具生态变成迷宫,LLM Agent 还能完成长程规划吗? 深度学习自然语言处理 · 公众号 · · 2 周前 · |
|
|
新一代科研范式:基于大模型智能体的自动化,科研工作流构建与应用实战 深度学习自然语言处理 · 公众号 · · 3 周前 · |
|
|
如果你是LLM训练的研究者,这篇ACL 2026腾讯混元论文会彻底改变你对SFT的认知 深度学习自然语言处理 · 公众号 · · 1 月前 · |
|
|
ACL 2026 | 推理资源的帕累托改进:E-GRM高效奖励建模技术深度拆解 深度学习自然语言处理 · 公众号 · · 1 月前 · |
|
|
如何用 Agent 全面重构你的科研全流程? 深度学习自然语言处理 · 公众号 · · 1 月前 · |
|
|
突破分词器边界:面向跨模型家族的 On-Policy Distillation 深度学习自然语言处理 · 公众号 · · 1 月前 · |
|
|
【第四届(2026)上海计算机视觉大会】 大会日程发布 深度学习自然语言处理 · 公众号 · · 1 月前 · |
|
|
ICML 2026 | 爱丁堡大学联合UIUC、普林斯顿等机构联合定义Agent的下半场:智能体理论 深度学习自然语言处理 · 公众号 · · 1 月前 · |
|
|
见微知著:LLM 奖励建模的「Analytic Rubric」范式全面综述 深度学习自然语言处理 · 公众号 · · 1 月前 · |