新闻资讯8
谷歌Gemini:AI攻入科研,刷爆数学难题
新智元
AI 摘要
谷歌旗下具里程碑意义!AI数学家Aletheia背靠Gemini,在IMO - ProofBench测试表现优异,独立撰写几何论文,评估700个开放问题,Gemini还联手专家攻克18大研究难题,变革科研工作流。
阅读原文 · 新智元
谷歌AI连发6篇数学论文!Gemini攻入博士级科研,91.9%刷爆SOTA
谷歌DeepMind放出多篇重磅论文,Gemini Deep Think成「科研合伙人」,攻克多领域难题。谷歌打造基于Gemini的「AI数学家」Aletheia,在博士级难题获科研里程碑,首批6篇论文成果斐然。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
新闻资讯7
谷歌Gemini 3.8来袭,AI混战升级
最新爆料,Gemini 3.8 Flash明日登场,谷歌已放弃Gemini 3.5 Pro。其编程实力强悍,之前还为Gemini植入智能体视频理解功能,降本提效,可应对多种高难度场景。近期多家AI发布计划撞车,混战升级。
新智元
算法论文8
ClawBench:AI agent真实网站任务集体翻车
ClawBench让AI在144个真实网站执行153个日常任务,结果惨烈,如Claude Sonnet 4.6每三任务翻车两个,GPT - 5.4仅完成10个。它还揭示AI在真实环境的问题,为评估模型提供标尺。
机器之心
产品应用7
谷歌 GR2 模型:让机器人有了‘腿’
谷歌发布 Gemini Robotics 2(GR2),能将相机图像和文字指令转为机器人关节控制命令,可同时控制人形机器人腿、躯干、手臂和手部,简化模型训练和设计,不过谷歌未公布其基础模型等信息。
DeeplearningAI
算法论文7
Gemini、GPT进《我的世界》评测,新框架破瓶颈
国立清华与英伟达团队研究《VLM-AR3L》,把Gemini 2.0、GPT-4.1等拉进考场,评估视觉裁决能力。结果显示Gemini综合最稳,开源小模型特定场景反超。还提出VLM-AR3L框架破使用瓶颈,实战超人类手写奖励。
AI科技评论