「观测的暴露度」共找到 10709 篇相关文章
ACL 2026|打破推理同质化!阿里达摩院新作让RLVR从重复采样走向有效探索
阿里达摩院智能决策团队提出面向RLVR后训练的探索增强框架I²B-LPO,改进rollout策略,在关键节点生成更具区分度的推理轨迹,结合信息瓶颈自奖励机制,在多个数学基准上提升准确率与语义多样性。
AlphaGo之父找到创造强化学习算法新方法:让AI自己设计
谷歌DeepMind团队在Nature发表论文,探索AI自主发现强化学习算法的可能。团队负责人是“AlphaGo之父”David Silver 。方法是基于智能体经验元学习,实验显示自动发现的规则表现优异,未来强化学习算法或无需人工设计。
拿下3D生成行业新标杆!昆仑万维Matrix-3D新模型鲨疯了,一张图建模游戏场景
昆仑万维推出3D世界生成框架Matrix - 3D,能从单图像生成高质量、轨迹一致的全景视频并还原可漫游3D空间。它优势明显,还突破多项技术难题,背后是昆仑万维对空间智能的战略布局。
Thinking Machines Lab获20亿美元,没发布任何产品
前OpenAI首席技术官Mira Murati创立的Thinking Machines Lab获20亿美元种子轮融资,对该保密公司估值达120亿美元。投资者众多,公司将在未来几个月推出含开源组件的首款产品,还会分享科研成果。
这个AI能救命!提前6个月发现胃癌病灶,突破医学影像认知,达摩院做成了
国内成果登《自然·医学》,全球首个用平扫CT识别早期胃癌的AI模型DAMO GRAPE诞生。它突破传统影像限制,提升胃癌检出率。此前达摩院还研发出筛查胰腺癌的DAMO PANDA,未来探索‘一扫多查’。
突发!Claude挑战黎曼猜想「失败」,却意外刷新37年数学纪录
AI向黎曼猜想发起挑战,Anthropic的Claude研究版本虽未攻克该猜想,但将黎曼ζ函数中已知至少位于临界线上的零点比例下界,由41.6%提高到了67.2%,这可能是解析数论领域重大进展。
逆天! Claude Opus几小时攻破C++大神4年死磕Bug
Reddit上有30多年C++开发经验的大神ShelZuuz,被一个困扰四年的Bug折磨,投入约200小时未解决。用Claude Opus几小时就找到症结,而此前GPT - 4.1等模型都失败。大神认为AI在编写新代码上像初级开发者。
GPT-6 Astra 省 Token & 使用技巧大全
本文原创分享GPT-6 Astra的Token节省与实战使用技巧,通过实测对比不同模型搭配的配额消耗效果,给出排雷指南,还介绍了一款开源工具可将普通ChatGPT网页版爆改成全功能Codex,干货充足实用性强。
十分钟出结果,陶哲轩用Gemini Deepthink帮人类数学家完成Erdős问题论证
Erdős问题网站专注数学研究与解答,收录厄尔德什提出的各类数学问题。11月20日,Wouter van Doorn提出反例,陶哲轩提交给Gemini 2.5 Deep Think,十分钟得到证明,他半小时转为基础证明。之后Boris Alexeev用Harmonic的Aristotle工具完成形式化。
Office已然成了AI插件,传统软件即将被颠覆
开源项目 OfficeCLI 上线数月获 2.9 万星,可让 AI 读写 Office 文件并自查。它将操作封装成命令行,解决 AI 办公不能交付的问题,还能处理多种实际工作,兼容 Office 365 和 WPS。最后探讨了命令行接管软件的可能性。