猜数偏好」共找到 461 篇相关文章

新闻资讯8

全球首个IMO金牌AI诞生!谷歌Gemini碾碎奥神话,拿下35分震惊裁判

谷歌DeepMind官宣Gemini Deep Think在IMO获官方认证金牌,4.5小时解5题得35分。它用纯英语解题,结合并行思考与强化学习训练。谷歌后续将向部分测试者及订阅者推出模型,还公开了解题过程。

新智元
算法论文8

北大腾讯突破奖励模型瓶颈!让AI理解人类偏好,泛化能力比肩GPT-4.1

北京大学知识计算实验室联合腾讯等机构提出RewardAnything,突破奖励模型瓶颈。它让奖励模型理解自然语言评判原则,降低成本,泛化能力比肩GPT - 4.1,还能用于定制AI行为模式。

量子位
新闻资讯7

学思维到AI睡眠,于大川在千亿赛道的第二次“白魔法”创业|甲子光年

于大川曾创办豌豆思维,“双减”后他“半退休”。如今他重启创业,创立豌豆智能,想用AI改善人类睡眠。该公司已获君联资本天使轮融资,于大川分享了创业思路、产品模式、团队组建等内容。

甲子光年
算法论文8

百个虚拟人在线逃生!天大等发布:首个实时在线多智能体模拟方法

天津大学联合清华和卡迪夫大学推出RESCUE系统,把「大脑感知 - 决策 - 行动」循环搬进电脑,让百虚拟人在线逃生。该系统能实时呈现地形等信息,还能标记身体碰撞力,可用于公共安全场景演练。

新智元
开源动态7

代码暴减99.9%!独立开发者仅用500行代码做出安全版OpenClaw,GitHub星狂飙

近日,独立开发者 gavrielc 制作的开源 AI 助手 NanoClaw 火了。它核心代码仅约 500 行,实现 OpenClaw 同等核心功能。相比原版 Clawdbot 代码量大减,还解决了 OpenClaw 安全架构问题,是其安全替代方案。

AI前线
新闻资讯8

韦东奕论文登学顶刊,将散焦方程的爆破性研究扩展至d≥4

韦东奕和北大学者章志飞、邵锋合作的论文发表于学顶刊《Forum of Mathematics, Pi》。他们将散焦方程的爆破性研究扩展至d≥4,成果填补空白,证明方法可推广到其他方程。

量子位
新闻资讯7

复读一年,AI 把高考学成绩从及格线提到 145 分!AI 学能力发生了什么?

今年媒体让AI做高考学题,Gemini 2.5 Pro获145分排第一。从去年到今年,AI学能力指级增长,这得益于推理模型。推理模型用思维链和强化学习解题,未来高考学或难区分模型能力。

宝玉AI
开源动态8

o3绞尽脑汁仅答对40%的题目,开源模型基本乱?MMSI-Bench:多图空间智能试金石

文章介绍了MMSI - Bench,这是用于评估MLLM多图像空间推理能力的VQA基准。它人工构建样本、全面分类任务、采用多样真实据。实验显示MLLM在多图像空间推理有短板,还开发自动化错误分析流程助力改进。

量子位
产品应用8

打破56年学铁律!谷歌AlphaEvolve自我进化实现算法效率狂飙,堪比AlphaGo“神之一手”

谷歌DeepMind联合顶尖科学家打造「通用科学人工智能」AlphaEvolve,打破矩阵乘法领域56年效率基准,将4x4矩阵乘法标量乘法次从49次降至48次,还在谷歌内部加速了运算、缩短训练时间。文中介绍其原理与技术。

量子位
算法论文8

独、烧蜡烛都不翻车了?浙大&阿里让AI先三思再下笔|ACL 2026

当下视觉生成中,开源模型在逻辑推理生成任务上频频翻车,与闭源模型有差距。浙大与阿里团队提出Unified Thinker,将思考与执行解耦,构建据集、采用创新算法,实验显示其有效提升逻辑执行准确度。

量子位