「论文价值」共找到 1654 篇相关文章
为AI智能体选型、验收、优化提供量化依据:首部评估标准公开征集中
AI智能体成2025年十大战略技术趋势之首,到2028年至少15%日常工作决策将由其自主做出。但企业面临信任鸿沟,缺乏评估规范。首部聚焦AI智能体应用的团体标准公开征集起草单位与起草人,适用于多方,有核心内容与价值。
GAIR 2025 世界模型分论坛:从通用感知到视频、物理世界模型的百家争鸣
第八届GAIR全球人工智能与机器人大会世界模型分论坛上,五位青年学者围绕世界模型展开精彩演讲,话题涵盖通用感知、三维技术等。他们的研究为世界模型领域带来不同启发,目前该领域研究尚处起步阶段,共识未形成。
GPT-5.2发布即降智?背后华人被挖出,清北校友核心贡献
OpenAI发布GPT - 5.2,官方称其基准测试碾压Gemini 3 Pro,擅长完成有经济价值任务。但发布后实测有翻车情况,也有提前测试者称其很强。此外,背后多位核心贡献者为华人,如北大校友Yu Bai等。
EMNLP2025 | SFT与RL的结合,vivo AI Lab提出新的后训练方法
vivo AI Lab 算法团队提出新的大模型后训练框架 GTA,综合 SFT 和 RL 优点,解决文本分类场景中 RL 收敛慢问题。论文已被 EMNLP 2025 录用,介绍了 GTA 框架设计思路、实验结果等,未来还将探索更多场景和大模型。
真·博士水平!GPT-5首次给出第四矩定理显式收敛率,数学教授只点拨了一下
在数学教授引导下,GPT - 5首次将定性的第四矩定理扩展为带有显式收敛率的定量形式,明确了收敛速率。研究人员还引导其将结果推广到泊松情形,作者起初想将其列为论文共同作者但被 arXiv 政策禁止。
斯坦福提出新的RL范式,让3B模型的Agent超越Claude、GPT-4
斯坦福提出新的RL范式,让小模型Qwen2.5 - 3B经训练后性能超越Claude - 3.5 - Sonnet等大模型。论文解决了RL在代理环境中可变时长动作优化偏差和稀疏奖励两大挑战,为AI代理发展指明方向。
大模型竞赛转向:决胜关键为何是“后训练”?
大模型价值主战场正向后训练转移。xAI发布的Grok 4通过后训练取得强大性能,在多项测试中领先。后训练可解决通用模型产业落地难题,不同公司探索新方法,且后训练有五大关键要素,阿里云提供一体化支撑。
垂直赛道 Agent 闷声发财指南:如何实现一年超千万营收?
本文围绕垂直赛道的2B Agent展开,分享了语核科技创始人的产品理念与经验,探讨了如何找到有价值的场景、构建高价值闭环。还介绍了客户的应用情况、对Agent的看法及选型考量,强调其商业价值与落地挑战。
LLM已能自我更新权重,自适应、知识整合能力大幅提升,AI醒了?
近期,AI自我演进话题研究讨论渐热。OpenAI奥特曼畅想AI自我改进未来,有爆料称其内部运行递归式自我改进AI。MIT论文提出SEAL框架让LLM自我更新权重,引发热议,实验显示其有提升但也有局限。
GPT-6第1天直接攻破5道Erdős难题!Fable 5.1交了白卷
Epoch AI和曼彻斯特大学发布FME基准测试论文,让68道未解数学难题成5个顶级AI的考场。GPT - 6 Astra成唯一得分非0分模型,放宽预算共解开5道,其余4个AI全交白卷。该测试是对陶哲轩批评的回应。