Agents4Science 2025」共找到 3489 篇相关文章

新闻资讯8

英伟达周末双炸!CUDA二十年最大更新,顺手屠榜AGI比赛

本周末英伟达有两大动作。一是推出CUDA 13.1,这是CUDA平台诞生二十年来最大更新,引入CUDA Tile编程模型等。二是在Kaggle ARC Prize 2025竞赛中,团队用4B小模型变体夺冠,靠合成数据等策略。

新智元
产品应用7

深度体验DeepSeek Harness,我原谅它涨价了

本文深度体验了DeepSeek Harness,它已发布并开源代码。其一切如模型、工具等皆为可插拔积木,官方内置超百个插件。介绍了安装方法、使用特点,还对比了与Codex差异,认为它是Agent时代的安卓,有望推动自进化。

量子位
新闻资讯7

美国模型长期霸榜的LMArena,出现了一个国产模型

2025 年底,中美 AI 阵营发展路径有区分,美国多是强模型加工具链,中国在多方面发力。12 月 23 日 LMArena 更新文本榜,百度文心新模型 ERNIE - 5.0 - Preview - 1203 以 1451 分登上榜单,成中国第一且是前 20 名里唯一非美国模型。

MacTalk
产品应用8

“不爱龙虾爱马仕”,为什么Hermes比OpenClaw更值得

文章对比了Hermes Agent和OpenClaw,Hermes由Nous Research出品,开源免费,安装便捷,支持多模型。其核心是闭环学习循环,能自我进化,技能可自动生成和更新,记忆系统更优,在多场景有优势,安全设计好。

鲸选AI
7

别让故障复盘流于形式:用AI挖掘每一次“跌倒”的价值

文章指出传统故障复盘存在诸多问题,借助AI能力可解决专业性和深度问题。介绍了智能复盘Agent,包括其核心使命、目标用户、核心价值和解决方案,还阐述了核心技术架构、实现方式及评测机制等,最后给出实战案例。

阿里云开发者
新闻资讯8

谢赛宁开炮,现场打脸CVPR评审!Sora开山之作DiT被拒,怒斥AI学术圈畸形

在CVPR 2025上获年轻研究者奖的谢赛宁批判AI学术界畸形,回顾DiT、SiT论文被拒却成Sora等奠基成果的经历。他借“无限游戏”与“有限游戏”概念谈AI研究,指出应坚持“无限游戏”,打破当前困境。

新智元
新闻资讯7

不再“纸上谈兵”:大模型能力如何转化为实际业务价值

InfoQ《极客有约》X AICon 直播栏目邀华为云郑岩、蚂蚁集团杨浩、明略科技吴昊宇,探讨大模型驱动业务提效。分享场景探索、技术落地经验,如选模型考量因素、AI Agent 创新等,还提及 MCP 应用与未来展望。

AI前线
产品应用8

文心新出的推理大模型,给了我们信心

在 WAVE SUMMIT 2025 大会上,百度发布文心大模型 X1.1,是 X1 升级版,发布即上线可免费体验。它在事实性、指令遵循、智能体等能力显著提升,全方位测评表现出色,还开源新模型,展现百度全栈 AI 实力。

机器之心
算法论文7

英伟达新研究:小模型才是智能体的未来

英伟达最新论文指出,大模型在Agent任务中消耗大量计算资源,成本高、效率低、灵活性差,而小模型能在性能够用前提下让任务执行更经济灵活。小模型通过优化硬件资源和任务设计高效执行任务,但落地面临挑战。

量子位
新闻资讯7

机器人浓度最高的一届春晚后,具身智能离走进千家万户还有多远?

InfoQ《极客有约》X QCon 直播栏目邀请专家探讨具身智能落地卡点。专家认为其虽面临模型泛化、数据采集等难题,但发展乐观。工业场景对通用性需求不大,Agent 架构或成关键,数据和物理交互等方面也有挑战。

AI前线