数学理论研究」共找到 2269 篇相关文章

新闻资讯8

LLM将是又一个“惨痛教训”?强化学习之父Sutton再放炮:万亿美金AI泡沫可能破裂

强化学习之父Sutton在采访中认为,LLMs过度依赖人类知识,违背‘惨痛教训’原则,发展将遇瓶颈,当前投资和期望或致泡沫破裂。讨论还涉及LLM与强化学习、人类模仿方式差异及AI领域经济动态等。

AI寒武纪
7

奥特曼「一张脸」引爆全球狂欢!Sora 2冲上APP榜第三,邀请码炒到1250元

Sora 2上线不到24小时冲上苹果商店榜单前三,其「1换4」邀请码机制和「Cameo自我上传」玩法引发社交传播热潮,邀请码被黄牛炒作。同时,它也引发OpenAI内部争议,CEO奥特曼为其辩护。

新智元
产品应用8

Anthropic发布Claude Sonnet 4.5:编程能力再登顶,新产品试图颠覆Windows操作系统

今日凌晨Anthropic发布Claude Sonnet 4.5,该版本在编程、计算机使用等能力上显著提升,开放Claude Agent SDK,还推出多项产品功能更新及“Imagine with Claude”研究预览,或对AI编程和Agent产品洗牌。

花叔
新闻资讯7

谁是最强“打工AI”?OpenAI亲自测试,结果第一不是自己

OpenAI发布新研究,提出GDPval基准衡量AI模型在有经济价值任务上的表现。Claude Opus 4.1表现最佳,GPT - 5次之。OpenAI开源优质子集并提供自动评分服务,还指出了GDPval的局限。

量子位
开源动态8

腾讯开源智能体构建框架

腾讯开源智能体构建框架 Youtu-Agent,灵活高性能,验证性能出色,开源友好成本低。有自动智能体生成等亮点,适用于不同用户群体,涵盖研究、开发等场景,还介绍核心概念,附项目地址。

GitHubStore
开源动态8

重磅!Thinking Machines开山之作:大模型输出随机的根本原因被揪出,并开源终结方案

由OpenAI前CTO创办的Thinking Machines宣布上线技术研究博客,开篇文章揪出LLM输出随机的根本原因是负载及批次大小的非确定性变化,并给出系统性解法,还开源方案。

AI寒武纪
新闻资讯7

Anthropic承认模型降智后仍放任其偷懒?Claude Code用户信任崩塌中

此前大模型厂商未正面承认‘降智’,OpenAI 研究科学家称是心理错觉。但 Anthropic 公开承认旗下 Claude Opus 4.1 和 Opus 4 质量降级,然而问题未解决,Claude Code 用户信任崩塌,纷纷转向 GPT - 5。

机器之心
开源动态8

打破瓶颈,让RAG学会思考:中科大、智源等发布推理检索框架BGE-Reasoner

人工智能浪潮下,推理密集型信息检索是RAG和AI Agent技术发展瓶颈。中科大、智源等机构联合研发推理检索框架BGE - Reasoner,在BRIGHT基准测试中刷新纪录,还将开放相关代码等推动研究

机器之心
推荐文章8

对「学习」的一切认知都错了

曾被认为不可能的超大模型如今成功驱动ChatGPT等,改变了对学习的理解。彩票假说解释其成功:大网络有中奖子网,能提供更多找简单解的机会,调和了经验与经典理论

AI寒武纪
算法论文8

破解「长程智能体」RL训练难题,腾讯提出RLVMR框架,让7B模型「思考」比肩GPT-4o

腾讯混元AI数字人团队提出RLVMR框架,将‘元认知’理论引入RL,通过奖励‘好的思考过程’解决长程任务中智能体的低效探索与泛化难题,经其训练的7B模型表现出色。

机器之心