观测的暴露度」共找到 10530 篇相关文章

算法论文8

阿里+清华发现80/20法则:LLM只靠20%token就能学会Reasoning

阿里与清华研究发现,训练大语言模型(LLM)推理时,真正关键是20%高熵token,其余80%低熵token几乎无用。仅用20%高熵token做强化学习,效果超全量训练,还提出RLVR训练策略提升效率。

深度学习自然语言处理
新闻资讯7

2050大会 | 「AGI4Science·新生论坛——正在生长科学地图 」嘉宾阵容全览!

2026年4月25日上午9点,2050大会将迎来“AGI4Science·新生论坛”专场。该论坛由王婷召集,以“三幕剧”展现AI for Science从理论到产业图景,涵盖多领域,17位专家将探讨AI4S生长与变革。

深度学习自然语言处理
新闻资讯7

AI 找到了六个 Erdos 数学问题,陶哲轩:AI + 人类专家才是真正改变科学研究方式

菲尔兹奖得主陶哲轩分享,AI 在 Erdos 问题网站实验中,帮数学家发现六个原本标记为「未解决」问题其实已被解决。他认为 AI 有价值应用是处理枯燥日常工作,如文献搜索。

AGI Hunt
推荐文章7

抄作业了!让AI产品告别“上线就崩”CC/CD框架,6步搞定,拿走不谢。

文章指出AI产品因大模型不确定性,易上线翻车。介绍海外流行CC/CD开发框架,阐述AI产品不确定性原因,强调自主与控制平衡,还给出该框架落地6步工作流。

探索AGI
算法论文8

坏了,我成AI乙方了!Anthropic论文爆火,谁还敢无脑Copy?

Anthropic开年论文实锤AI让程序员变傻,用AI辅助人比纯手写只快2分钟,且测验平均分低17%。研究将工程师使用AI交互行为归纳为五种模式,指出主动拷问AI才能进化,高分者会主动制造障碍。

新智元
推荐文章8

Lilian Weng:Harness才是模型自我迭代现实起点和关键,而不是直接重写权重

Thinking Machines Lab联合创始人Lilian Weng发文指出,实现AI递归式自我改进(RSI),设计围绕模型执行系统“Harness”才是现实起点。文中详述Harness设计模式、优化路径,也指出自我改进面临瓶颈。

AI寒武纪
算法论文8

AI发现医生看不见隐藏心脏病风险,近90%准确率远超人类专家|Nature子刊

登上《Nature》子刊研究显示,约翰霍普金斯大学团队开发多模态AI模型MAARS,用深度学习处理原始MRI图像,实现对心源性猝死风险高精度预测,准确率达89%,还能辅助制定个性化医疗方案。

量子位
新闻资讯7

马斯克Grok-4卖货创收碾压GPT-5!AI卖货排行榜曝光,AGI尽头是卖薯片?

新智元报道,「Vending Bench」榜单让大模型经营自动售货机一较高下。Grok - 4卖货能力超GPT - 5,销量约高2倍,营收增31%。此测试揭示AI长周期决策挑战,引发AGI定义讨论。

新智元
算法论文7

研究表明:资深开发者在使用AI工具时,完成任务时间比不使用时延长了19%。

研究通过随机对照试验,发现2025年初资深开源开发者使用AI工具完成任务时间比不使用时延长19%。当前衡量AI能力多依赖标准化评测,可能高估或低估其真实能力,研究旨在更准确评估。

宝玉AI
产品应用8

九章云极发布AI工厂体系:破解140万亿Token时代落地悖论|甲子光年

九章云极于6月17日发布Alaya NeW AI工厂体系,锚定十万P算力、十万亿Token、千个模型、千倍降本四大目标。该体系是智能工业化必然产物,能解决资源难转生产力难题,还具备技术效能、生态范式和商业飞轮三大支柱。

甲子光年