「系统级Agent」共找到 4583 篇相关文章
会解题不等于懂人心,腾讯混元提出Sentient Agent,提高高阶社交认知能力
过去评判LLM像考核‘做题家’,但会解题不等于懂人心。腾讯团队提出SAGE框架,用会闹情绪的agent评委评估模型高阶社交认知能力。实验显示不同模型表现差异大,未来需懂人心的AI。
Notion 3.0 |AI转型最成功的互联网产品是怎么做的?
Notion更新3.0,可视为有所有上下文的通用Agent产品,能调用顶尖模型。它有基础AI能力,如选模型、加上下文等,还升级了Agent创建、MCP等功能,依托生态让提示词可变现。
用 Codex 拯救我的 Mac
作者从2008年开始用Mac办公研发,历经系统更迭未重装。现因系统更新,不少程序是Intel版,用Rosetta 2转接,很混乱。介绍用Codex清理开发环境、更换M芯片版本Homebrew的方法。
AI x 大前端性能稳定性:快手亿级 DAU 下的智能诊断实践
本文整理自快手移动端稳定性负责人李锐在 2025 年 QCon 大会的分享。介绍快手大前端性能稳定性挑战,阐述借助「柯南 AI」赋能排障的实践,含根因排障和应急处置案例,还谈了开发中思维切换等认知。
EMNLP 2025 | T2R-bench: 业内「首个」工业级表格生成报告评测基准
中国电信人工智能研究院推出业内首个面向真实工业场景的“表格到报告”基准T2R-bench,涵盖多领域真实表格、问题与人工标注关键点,配套创新性三维度评测体系。实验显示主流大模型在该任务上表现欠佳,提升空间大。
DeepSeek新大招曝光:下一步智能体
知情人士爆料,DeepSeek正开发有更强AI Agent能力的新模型,预计年底推出。此前DeepSeek-V3.1已具备更强Agent能力,在工具使用与智能体任务中表现提升。业内对其入局智能体看法不一。
扣子官宣开源,掀桌大动作背后如何决策?扣子负责人独家披露
7月26日,字节将AI Agent平台「扣子(Coze)」旗下Coze Studio与Coze Loop开源至GitHub,采用Apache 2.0许可证。文章披露开源决策背后故事,探讨开源版目标、定位,以及团队对Agent开发未来的思考。
The Batch: 870 | 手机上的主动式AI助手
谷歌发布Pixel 10,搭载Magic Cue AI系统。它基于新版Gemini Nano,运行在Tensor G5处理器上,能预判用户需求,自动提供相关信息。谷歌早就在手机推AI,此次将其深度融入系统和应用。
理解归 AI,正确归引擎:从一句话到一条实时数据链路(0代码搭建实时任务)
文章分享直播数据团队搭建AI辅助、指标驱动的实时数据端到端开发系统的实践与思考。从案例介绍用户使用流程,再深入系统内部讲链路构建与演进,阐述设计方法论,最后提出未来规划。
AI能自己打红警了!经济拉满零交战惨遭打脸,玩家笑疯
Hugging Face推出OpenRA-RL,将《红色警戒》改造成大模型的Agent训练场,50个MCP游戏工具全量暴露,25Hz实时状态流推送,打通三条训练路线,原生接入OpenEnv生态。实战中,Agent经济满分但战斗零分。