大模型Agent」共找到 10602 篇相关文章

新闻资讯7

时隔9个月Meta全新模型Muse Spark发布:闭源,原生多模态,一发布就落后?

时隔9个月,Meta推出Muse家族首款模型Muse Spark,原生多模态推理,但能力表现一般,编程领域落后于opus 4.6和GPT 5.4等。它有沉思模式,致力于成个人超级智能,技术亮点多,性能高效。

AI寒武纪
新闻资讯7

卡帕西李飞飞辛顿都投了的Transformer专用芯片,签下10亿美元

Etched是只做Transformer专用芯片的创业公司,获卡帕西、李飞飞、辛顿投资。它宣布流片成功,筹集8亿美元,获10亿美元客户单,还推出一整套面向前沿模型推理的集群系统。

量子位
产品应用8

从 Chat 到桌面 Agent:我在一台旧 Windows 上,看见了办公的未来

本文作者作为Mac老用户,为体验昆仑天工研发的Skywork桌面Agent,找来旧Windows电脑测试。该产品定位是接管电脑工作世界,解决办公任务处理和安全隐私问题,还介绍了其功能和使用效果。

MacTalk
开源动态8

AI能自己打红警了!经济拉满零交战惨遭打脸,玩家笑疯

Hugging Face推出OpenRA-RL,将《红色警戒》改造成模型Agent训练场,50个MCP游戏工具全量暴露,25Hz实时状态流推送,打通三条训练路线,原生接入OpenEnv生态。实战中,Agent经济满分但战斗零分。

新智元
推荐文章8

为什么 2025 的基模公司都押注 Interleaved Thinking?

本文探讨 2025 年基模公司押注 Interleaved Thinking 的原因。从模型迭代说起,介绍其在多模型中的体现,阐述该思维链对 Agent 的重要性,还提及 MiniMax 在推动其成行业标准上的诸多努力及带来的影响。

MacTalk
推荐文章7

AI们数不清六根手指,这事没那么简单。

作者测试发现Grok4、OpenAI o3等多模态模型都将六指图数成五指,仅Claude 4偶尔答对。研究揭示模型看图片用记忆而非视觉,易受刻板印象影响,在工业等场景或引发严重后果。

数字生命卡兹克
新闻资讯8

AI最尴尬的短板,中国科学院出手了

7月24日,中科院计算所“知境”团队发布知境社会心智模型技术体系,为现有模型补社会心智短板。其建评测体系SoMBench,设计训练系统Zing,用部署架构Actio,在多评测超越GPT - 5.5等,应用前景广。

量子位
新闻资讯7

代码碾压一切!OpenAI神秘模型o3-alpha一夜刷屏,却遭41岁神绝地反杀

OpenAI神秘模型o3 - alpha曝光,代码能力强,疑似在编程赛获亚军,不敌人类选手Psyho。ChatGPT Agent也实力惊人。比赛组织者指出AI代码优化强,但缺人类创造力。

新智元
新闻资讯8

从“卷模型”到“算总账”:AI 产业竞争开始拼什么 | 请回答 WAIC 2026

WAIC 2026热度高涨,InfoQ直播间追问‘AI正在重写什么’。与会嘉宾讨论AI产业新阶段变化,如从‘看能力’到‘算总账’,认为模型重要性方式已变,还探讨了AI原生产品定义、AI Infra影响及未来关注方向。

InfoQ
推荐文章7

AI x 前端性能稳定性:快手亿级 DAU 下的智能诊断实践

本文整理自快手移动端稳定性负责人李锐在 2025 年 QCon 会的分享。介绍快手前端性能稳定性挑战,阐述借助「柯南 AI」赋能排障的实践,含根因排障和应急处置案例,还谈了开发中思维切换等认知。

InfoQ