顶会论文」共找到 2334 篇相关文章

推荐文章7

中年人的认知坍塌

Andrej Karpathy在播客提到模型持续用合成数据训练出现‘认知坍塌’,能力退化。他认为人类随年龄增长和经验固化,也从无限可能收敛到固定思维模式,像极了中年人的认知坍塌。

newtype AI
开源动态8

智源:ArXiv CLI重磅开源!2亿+开放论文,即将化身科研智能体的技能包

智源研究院联合高校与社区开发者研发的 DeepXiv 开源并免费开放。它是面向智能体的科技文献综合性工具集,提供数据接入、一站式能力集成、丰富接入形式等核心能力,还通过实战演示展示其在科研任务中的价值。

机器之心
新闻资讯7

刚刚,全球最难考试惊天大反转!黑马AI冲破36%,流模型集体翻车

ARC-AGI-3测试中,级大模型Opus 4.6仅得0.2%,人类获满分。而Symbolica公司用Agentica框架首日就取得36.08%的成绩。该框架有独特技术路径和策略,但成绩未经验证,ARC-AGI-3被视为通向AGI的‘北极星’。

新智元
算法论文8

谁说Scaling Law到头了?新研究:每一步的微小提升带来指数级增长

很多人质疑扩大计算规模训练模型的做法,因Scaling Law面临收益递减。但新研究发现,模型单步准确率的微小提升能使完成任务长度指数级增长,还探讨了长程执行能力的衡量及影响因素。

机器之心
新闻资讯8

中国中文信息学大模型与生成专委2025大模型战略研讨成功举办

2025年6月27日,中国中文信息学大模型与生成专委2025大模型战略研讨在哈尔滨举办。议探讨技术革命、交流成果、发布基金,多位专家作报告、参与思辨讨论,聚焦大模型多方面话题。

深度学习自然语言处理
新闻资讯8

图灵奖得主领衔,中国大模型第一梯队集结!2026智源大,看懂AI下一程

2026年6月12 - 13日,第八届智源大将在北京举办。多位图灵奖得主、40余位AI企业CEO等将齐聚,探讨超级模型等关键方向。大还关注世界模型、智能体等核心方向,设25场论坛,首次实现“智能体听”。

量子位
开源动态8

GitHub 上 6.4 万标星的 Hermes Agent,比 OpenClaw 响应快太多!还成长进化!

AI Agent领域热闹,OpenClaw有响应慢等问题。Nous Research今年2月开源的Hermes Agent爆火,获64.8K Star。它是自学习型AI智能体,有六大核心特性,支持换模型,更新快,还支持一键安装。

开源星探
算法论文8

ACL 2025杰出论文!用能力显著向量让大模型下游任务性能预测更精准

上海人工智能实验室与复旦大学联合研究成果《Capability Salience Vector》获ACL 2025杰出论文奖。提出能力显著向量(CSV)解决验证损失与下游任务能力脱节问题,实验验证其提升了下游任务表现可预测性。

OpenMMLab
算法论文7

思维链推理是一种脆弱的‘海市蜃楼’,一旦超出训练分布,它便消失。| 直播预约

思维链提示能提升LLM在多任务上的表现,让人感觉模型在深思熟虑。但研究从数据分布角度剖析,发现思维链推理是脆弱的‘海市蜃楼’,超出训练分布就消失,强调实现通用推理能力挑战大。

深度学习自然语言处理
算法论文8

基础模型已颠覆科研,进入第五范式!港科大综述113篇论文 | NeurIPS'25

港科大论文指出,随着科学问题复杂度提升,传统科研范式显露出局限。基础模型(FMs)横空出世,具备通用性、规模与知识覆盖、推理与生成能力,可能引领科学进入第五范式,但也面临偏见、幻觉等问题。

新智元