非编程领域」共找到 3248 篇相关文章

新闻资讯8

马斯克发布“地球最强AI模型”Grok 4:横扫所有榜单,在“人类最终测试”超越人类博士”!

北京时间7月10日,马斯克团队发布Grok 4,其基准测试成绩惊人,在‘人类最终测试’等表现出色。它成功源于多智能体协作、追求真相哲学和高算力投入,还在多领域展现应用潜力,同时公布定价并坦言短板。

AI科技大本营
算法论文8

AST | 西交大牛笑天、陈刚等:基于多尺度网格融合技术的复杂三维构型流场时空智能推理方法

文章针对复杂三维外形的强线性定常流场推理难题,提出MSGF数据预处理方法与DTECAU - 3D模型联合框架。MSGF解决数据提取难题,DTECAU - 3D解决传统U - net问题,经测试验证该框架效果良好。

力学与人工智能
算法论文7

大模型刷数学题竟有害?CMU评估20+模型指出训练陷阱

CMU团队评估20多个大模型,发现只有强化学习(RL)训练的模型能将数学推理技能广泛迁移到其他任务,监督微调(SFT)训练的模型迁移有限甚至无迁移。研究还探索差异原因,表明RL微调更具优势。

量子位
新闻资讯7

创新中心深度支持:20支队伍、300位观众、7小时PK,国内首档AI竞技综艺收官

5月10日,国内首档AI竞技综艺“AI极客争霸赛·奇点市·脑洞嘉年华”在北京收官。20支参赛团队覆盖AI多垂直领域,带来各具特色的脑洞项目,最终《狗眼看世界吧》获冠军。活动由北京AIGC视听产业创新中心等支持。

郎园Station
开源动态7

The Batch: 948 | GLM 5.1:面向长时任务的能力提升

Z.ai将旗舰开源权重大语言模型升级为GLM - 5.1,可在单个任务自主运行八小时。它专为编程和智能体任务设计,有推理等特性,在多榜单表现佳,但推理和数学能力落后闭源模型,价格有提升。

DeeplearningAI
算法论文8

北大团队让AI学会考古!全球首个古希腊陶罐3D视觉问答数据集发布,还配了专用模型

北大团队推出全球首个面向古希腊陶罐的3D视觉问答数据集VaseVQA - 3D,配套专用视觉语言模型VaseVLM。传统模型面对文化遗产复杂对象有不足,新数据集和模型让AI迈向‘文化考古Agent’,未来将拓展到更多领域

量子位
新闻资讯8

云计算一哥,给 Agentic AI 工程做“减法”

2025 年亚马逊云科技 re:Invent 大会聚焦 Agent,其首席执行官提出未来各领域将运行数十亿 Agent。该公司欲在 Agentic AI 上重构,推出系列工具,如 Amazon Strands Agents SDK、Amazon Bedrock AgentCore 等,还在模型训练和工程化方面做减法。

InfoQ
新闻资讯7

DeepMind AlphaProof 前负责人谈2025年IMO

前Google DeepMind AlphaProof项目联合负责人Rishi Mehta发布关于2025年IMO结果的分析。今年OpenAI和Google DeepMind双双宣布达到金牌水平,解法各有特点。Mehta预测前沿大语言模型明年或开箱即用获奖牌,未来6个月内或攻克平凡开放数学问题。

AGI Hunt
新闻资讯7

DeepSeek被曝融资20亿…可幻方一年就挣50亿啊?

DeepSeek被曝计划首次融资,目标估值超100亿美元,计划融资至少3亿美元。但此前多次融资传闻均被辟谣,且其母公司幻方量化盈利能力强。若融资,或为锚定股权价值、激励人才及获财务价值。

量子位
算法论文8

智能体系统如何「边做边学」?斯坦福团队探索在线优化的新范式

斯坦福等校团队提出 AgentFlow 框架及 Flow - GRPO 算法,让智能体系统能「边做边学」。它由多个智能体模块协作,在多领域基准测试中表现出色,小模型也能超越大模型,为智能体训练提供新思路。

机器之心