人类最后的考试」共找到 1455 篇相关文章

新闻资讯8

科学家要失业了?GPT-5仅用18分钟解出黑洞方程,效率碾压人类数月!

2026年AI成科学家新战友,从破解优化难题到重现黑洞对称性,加速科学发现。数学家与ChatGPT合作完成证明,物理学者用GPT-5 Pro快速解黑洞方程,OpenAI还助力攻克生物学难题。

新智元
新闻资讯7

连OpenAI都在偷偷重仓!大模型的下一站,是「入侵」人类大脑

AI巨头入局使脑机接口升温,格式塔科技获1.5亿融资刷新中国纪录。全球超声赛道投资热,OpenAI等参与。超声波路径优势多,格式塔聚焦医疗,产品有望落地,AI融合是关键,未来脑机接口或成基础设施。

新智元
新闻资讯8

姚顺宇谷歌首秀,Gemini新模型刷爆SOTA:人类仅剩7人捍卫碳基编程

面对Claude Opus 4.6和GPT Codex 5.3的攻势,谷歌升级Gemini 3 Deep Think,在多项基准测试刷爆SOTA,推理成本降低82%。它还走进科研工程领域,其研发团队有不少华人,如姚顺宇、Yi Tay。

量子位
新闻资讯8

Sam Altman与开发者的一小时对话:我们在“梦游般”走向风险,人类经不住Agent诱惑

Sam Altman在与开发者生态交流会上,针对GPT-5写作能力下降问题坦率回应,还发出一系列重磅信号,如警告生物安全风险、披露招聘计划等,并就软件工程、AI Agent等多个话题分享看法。

AI寒武纪
算法论文8

首个3D动作游戏专用VLA模型,打黑神话&只狼超越人类玩家 | ICCV 2025

淘天集团未来生活实验室团队提出首个3D动作游戏专用VLA模型CombatVLA,已被ICCV 2025接收。它能处理视觉输入输出动作指令,在战斗理解准确率和执行速度上表现优异,还构建了评测基准等。

量子位
新闻资讯8

全球独家首测Genie 3,实验室细节曝光超震撼!AGI最后一块拼图已实现

谷歌DeepMind的Genie 3发布,Youtuber全球独家首测,揭秘实验室细节。前谷歌研究员称其将颠覆游戏行业,它有诸多亮点,但也存在物理、社交交互等未解决问题,代表娱乐未来。

新智元
新闻资讯7

英伟达曾命悬一线!特朗普亲口承认想拆分英伟达,最后却被黄仁勋「说服」

特朗普在活动中回忆,得知英伟达近乎垄断时想拆分它,但顾问称拆分难,且追上英伟达至少需十年。黄仁勋成功说服其政府允许向中国售芯片,特朗普放弃拆分,此前拜登政府曾调查英伟达。

新智元
算法论文8

北大腾讯突破奖励模型瓶颈!让AI理解人类偏好,泛化能力比肩GPT-4.1

北京大学知识计算实验室联合腾讯等机构提出RewardAnything,突破奖励模型瓶颈。它让奖励模型理解自然语言评判原则,降低成本,泛化能力比肩GPT - 4.1,还能用于定制AI行为模式。

量子位
算法论文8

英伟达笑到最后!训练2000步,1.5B逆袭7B巨兽,Scaling真来了

英伟达团队提出ProRL训练法,将强化学习扩展到超2000步。用此方法训练的15亿参数模型媲美70亿参数的Deepseek - R1 - 7B,在多任务中表现出色,解决了熵崩溃和训练不稳定问题。

新智元
新闻资讯7

让GPT-4.1「头皮发麻的考试」!OpenAI给大模型上强度,AI能赢吗?

OpenAI 公布 MRCR 评测标准数据集,其针对 AI 模型上下文能力进行「奥运会」级别测评。MRCR 提升了测试难度,能揭示 AI 能力边界,推动模型发展,帮助更合理应用技术。GPT4.1 在一些测试中表现出色,未来 AI 能力上限充满可能。

新智元