多步推理」共找到 5613 篇相关文章

8

量子芯片离商用还有远?解读半导体的下一代革命

本文深度拆解量子芯片全产业链,指出其成突破半导体产业天花板核心方向。全球技术路线并行研发,虽有进展但距商用有差距。其商用面临三重壁垒,将分阶段落地,普及后会重塑产业与社会,与传统芯片互补。

芯师爷
算法论文8

竞赛编程Agent进入全球前十!南大、清华新模型CF rating超3500

大语言模型在竞赛编程场景易失败。南大、清华等研究者提出Solvita框架,由四个角色形成闭环,构建可训练图结构知识网络积累经验。实验显示其在评测中表现强,提升不靠增加token。

新智元
新闻资讯7

MMLU已死?「人类最后考试」登Nature:全球AI模型集体不及格!

AI发展迅猛,现有基准测试难以跟上其伐。近1000名研究人员组成的全球联盟创建「人类最后的考试」(HLE),涵盖领域难题,目前最强AI准确率不足50%,凸显AI与人类专家的差距。

新智元
新闻资讯8

情人节最硬核“Kiss”!中国AI突破300年亲吻数难题,连刷维度纪录

中国AI打破300年的亲吻数难题。上海科学智能研究院等团队提出PackingStar系统,刷新维度世界纪录。它将难题转化为智能体博弈,成果获高度评价,还体现了AI for Science 2.0特质。

量子位
开源动态8

社区供稿丨如何抑制大模型的“过度反思”:Yuan3.0 Flash 中的强化学习范式

大模型在企业落地时存在“过度反思”问题,浪费算力。YuanLab.ai团队在Yuan3.0 Flash模型中提出RIRM与RAPO,前者奖励“思考过程”,后者优化训练框架,实现推理效率提升,适用于企业场景。

Hugging Face
算法论文8

Transformer已死?DeepMind正在押注另一条AGI路线

谷歌团队借鉴人类联想记忆,提出嵌套学习,解决AI「灾难性遗忘」问题。强调优化器与架构协同进化,构建联想记忆系统。HOPE架构在任务表现出色,或开启AI从被动训练到主动进化大门。

新智元
新闻资讯7

华人40%霸榜!2026 IEEE Fellow名单出炉,清华国内第一

美国电气电子工程师学会公布2026年Fellow名单,约40%是华人。国内所高校和机构有学者入选,如清华、北大等。IEEE Fellow是学会最高等级会员,表彰专业领域杰出成就者,每年晋升比例不到0.1%。

新智元
产品应用7

AI+直播的新玩法! StreamDiffusionV2让创意零延迟

生成模型改变直播行业,但此前模型难保证时间一致性、有延迟等问题。加利福尼亚大学推出StreamDiffusionV2,通过智能调度和缓存机制优化,支持GPU并行,可灵活调画质和延迟,实现实时直播。

带你学AI
算法论文8

NIPS2025 | A-Mem让Agent拥有动态自我记忆功能,达到新SoTA

近年来,LLM代理需长期内存系统,但现有系统缺乏灵活性。论文提出A - Mem能动内存系统,受Zettelkasten启发,能让记忆‘自我整理’和‘自我更新’,在基准测试领先,也指出了局限性和未来方向。

深度学习自然语言处理
新闻资讯8

马斯克“巨硬计划”新动作曝光!从0建起算力集群,6个月完成OpenAI&甲骨文15个月的工作

马斯克“巨硬计划”新动作曝光,6个月从0建起算力集群,完成200MW供电规模。“巨硬”将基于Grok构建智能体系统,自动化完成软件开发。Colossus II为此提供算力,马斯克亲自督战。

量子位