Agent 3」共找到 4458 篇相关文章

新闻资讯7

打穿 AI 智商测试!GPT-6 Astra 的符号世界模型,是突破还是钞能力刷分?

OpenAI的GPT-6 Astra亮相,在ARC - AGI - 3测试成绩逼近100%,远超GPT - 5.6 Sol。它生成的符号世界模型被认为是AI迈向高级推理必经之路。不过出题人指出其靠Harness加持,离AGI还远。

AI科技评论
产品应用8

Deepseek V4 Pro发布,除了多模态,满足我对模型的所有想象

DeepSeek官方文档更新模型日期,意味着DeepSeek V4 Pro正式版来临,已在官方API提供。它采用MoE设计,接口能力强,Agent能力得到大幅强化,评测成绩亮眼,价格实惠且有API兼容性,不过有并发限制,近期还将上调价格。

鲸选AI
新闻资讯7

谷歌风雨飘摇,市值蒸发数千亿美元!Gemini Spark能救场吗?

近期谷歌接连流失核心人才,资本市场反应强烈,市值蒸发数千亿美元。同时产品节奏不佳,Gemini 3.5 Pro疑跳票。在此背景下,谷歌推出Gemini Spark,它能跨应用完成任务,但定价遭质疑,谷歌能否靠它破局存疑。

新智元
算法论文8

Yann LeCun非生成世界模型前瞻:开年三篇论文展示JEPA工程化拐点

2026年Yann LeCun团队3篇论文展示基于JEPA框架的非生成世界模型工程化拐点。Rectified LpJEPA让表示更省力,GRASP将长时域规划并行求解,EB - JEPA把方法写成代码,为非生成式世界模型提供技术路线。

AIGC开放社区
开源动态8

开源仅一周,鹅厂文生图大模型强势登顶,击败谷歌Nano-Banana

腾讯混元团队开源的原生多模态生图模型混元图像 3.0,开源仅一周就在国际权威评测榜单 LMArena 上超越谷歌 Nano - Banana 等,位列文生图综合和开源榜单第一。实测表现出色,技术上也有诸多创新。

机器之心
新闻资讯8

OpenAI总裁透露GPT-5改了推理范式,AGI实现要靠现实反馈

OpenAI总裁Greg Brockman在访谈中透露AGI之路,包括技术上转向强化学习推理范式,资源上持续投入计算资源,落地时封装成Agent。还提到GPT - 5改变推理范式,强调计算对AGI的重要性及模型落地等内容。

量子位
推荐文章7

Notion CEO Ivan Zhao:好的 AI 产品,做到 7.5 分就够了

Notion CEO Ivan Zhao 在播客采访中分享打造 AI 产品的观点。他认为 Notion 整合 SaaS 成生产力工具,数据库是核心。好产品做到 7.5 分即可,构建 AI 产品像“酿啤酒”,知识工作领域 Agent 未真正出现。

Founder Park
新闻资讯8

全球顶尖大模型一夜惨遭血洗!最难测试人类拿满分,AI第一名得0.2%分

全球最难AGI测试ARC - AGI - 3上线,人类满分通关,最强模型Opus 4.6仅得0.2%。测试从静态题变为互动游戏,评分看效率。前沿大模型得分低,非LLM方案表现更好,AI缺乏元认知能力。

新智元
推荐文章8

阿里云 CIO 蒋林泉:AI 大模型时代,我们如何用 RIDE 实现 RaaS 的首次落地?

阿里云 CIO 蒋林泉分享大模型落地实践,指出 AI 是时代“大电梯”,企业需迅速搭乘。介绍阿里云数字人多场景应用成果,提出 RIDE 方法论助企业落地,还剖析翻译与 Agent 模式要点及 E2E 落地关键。

阿里云开发者
算法论文8

字节&MAP重塑大模型推理算法优化重点,强化学习重在高效探索助力LLM提升上限

强化学习虽提升大语言模型表现,但面临探索难题。字节跳动等团队提出FR3E框架,分两阶段重建探索机制,在多数学推理基准实验中显著优于强基线,为大模型强化学习提供新范式。

量子位