学而思学习机」共找到 987 篇相关文章

新闻资讯8

刚刚,马斯克发布Grok-4,在各大基准测试上表现太猛了。

马斯克的 xAI 发布 Grok - 4,在各大基准测试表现出色,如 AIME25 拿满分、GPQA 领先等。第三方测评显示其登顶,编码和数指数居首。价格与 Grok 3 相同,今日上线但价格高,甚至有已售罄情况。

AI进修生
8

老罗数字人爆火背后,百度做对了什么?

6月15日,罗永浩数字人在百度电商直播超6小时,吸引超1300万人次观看,带货破5500万元。它动作、语调等生动,能与弹幕互动。百度基于文心4.5T,从形、音、神让数字人“神形音容”一致,还实现行业首次多数字人同场及头部主播数字人整场带货。

特工宇宙
推荐文章8

对谈 DeepSeek-Prover 核心作者辛华剑:Multi Agent 天然适合形式化数 |Best Minds

文章是对 DeepSeek-Prover 核心作者辛华剑的访谈。他认为强化习是 AGI 关键解法,Multi Agent 适合形式化数。还探讨了 DeepSeek Prover 进展、数与 AGI 关系、评测基准等,指出未来有全才模型和自主 Agent 出现。

海外独角兽
新闻资讯7

AI七个月突破数家“围剿”反超人类!14位数家深挖原始推理token:不靠死记硬背靠直觉

大模型o3 - mini - high在7个月内,于FrontierMath基准测试中,答题得分从2%提升到22%,超人类团队平均水平。数家分析其推理记录,发现它靠直觉非死记硬背解题,但也存在缺乏创造力等局限。

量子位
算法论文8

ICML 2025 | 注意力机制中的极大值:破解大语言模型上下文理解的关键

ICML 2025新研究揭示,在使用旋转位置编码 (RoPE) 的现代Transformer模型中,注意力机制的查询 (Q) 和键 (K) 表示存在集中极大值,值 (V) 表示无此模式。研究通过实验揭示其与上下文知识理解的关键联系。

机器之心
推荐文章8

对话 IDEA 张磊:「不以动作为输入条件,就不叫世界模型」

本文是对IDEA研究院张磊的深度访谈。张磊在计算机视觉领域成就斐然,他指出具身智能落地需攻克成功率、泛化性等挑战,大脑比本体更关键。还阐述了世界模型概念及应用,定义其应具备动作依赖等内容。

AI科技评论
新闻资讯8

为什么AI大厂的人,都跑去做生命科了?

越来越多AI人才投身生命科,创办数十亿美元估值公司。这是因训练通用模型门槛高,生命科技术可迁移、产业愿付费且有成功先例。新一代公司AI位置、融资、技术目标有变化,但仍面临数据和临床验证问题。

DeepTech深科技
新闻资讯7

人形机器人设计正在向仿真器低头!40年机器人从业老兵发出警告

人形机器人行业现怪象,为让仿真系统和强化习更顺,一些有机械优势的结构因‘仿真麻烦’被排除。40多年经验的Scott Walter质疑设计变得‘S.T.U.P.P.I.D.’,指出仿真应服务设计非主宰。

机器之心
新闻资讯8

刚刚,美国AI霸主换了!Anthropic年收300亿,碾压OpenAI

外媒披露Anthropic年化营收达300亿美元,超越OpenAI的240亿。Anthropic由OpenAI前员工创立,15个月营收翻30倍,训练成本仅为对手四分之一。其80%收入来自企业端,OpenAI陷入‘增收不增利’怪圈,内部也矛盾重重。

新智元
算法论文8

喂给AI的Skill正让它变笨!清华团队发现大模型经验复用的黄金法则

清华大与EvoMap团队研究发现,给大模型提供详尽纠错Skill会使基准测试通过率下跌,精简控制指令可提升性能。他们提出将程序化Skill转化为策略基因,经实验证实其更适合驱动智能体测试时演化。

AIGC开放社区