「agent能力」共找到 5313 篇相关文章
颜水成领衔,给AI分段位!超100款多模态模型,无人达到L5
十所顶尖高校联合发布General - Level评估框架和General - Bench基准数据集,用五级分类制明确多模态通才模型能力标准。评估超100款模型,发现多数在L2 - L3,无L5模型,揭示当前模型不足。
DeepSeek Harness背后的“心脏”:Cordis 到底是什么
文章介绍Cordis框架,它原服务第三方QQ机器人,现是DeepSeek Harness心脏。阐述其设计初衷、核心机制,如插件、上下文等概念,还提及在DSH中的应用,展示了插件槽位和生态,最后介绍相关论文和该框架的生态情况。
今起Codex每天重置一次!Tibo义父:首次3小时后发放,重置时间可自选
今起付费却无法用GPT - 6 Astra的用户,每天能重置额度一次,首个额度不到3小时发放,可自选重置时间。还提到GPT - 6做长程任务超272K tokens部分不增额度消耗倍率,开放时间待定。此外介绍在其开放前可做的3件事。
2026夏季崇礼论坛五大看点,AI如何走进生活|甲子光年
2026年9月12 - 13日,2026夏季崇礼论坛将在崇礼·太舞小镇举行,主题为“未来此刻”。有五大看点,包括俞敏洪等探讨AI能力与入口,揭晓“AI NEXT 20”榜单,多场硬件、内容等相关圆桌及产品展示。
Meta发最强模型打响价格战,小扎对谷歌贴脸开大!北大校友立大功
九月刚过3天就有五个前沿模型发布,Meta发布Muse Spark 1.3踢馆谷歌Gemini 3.8 Flash。它跑分提升大、成本低,性价比高,但也遭质疑,大模型下半场或比拼系统架构和智能体工程能力。
首次曝光!OpenAI新一代旗舰Astra换上“循环深度”推理架构:用计算深度换参数规模
9月2日消息,OpenAI将推出的旗舰模型Astra采用“循环深度”新技术,用较小模型实现庞大模型性能,降低成本。但该技术会让AI推理过程不可读,加重安全担忧,此前奥特曼已因Astra“能力过强”踩刹车。
刚刚,GPT-6代号再泄露!或将周四见
据传GPT - 6本周将发布,OpenAI「义父」爆料Codex接入最强Astra模型,其内部代号「mewfour」泄露。Astra内部版已解决多个数学难题,成本仅约2000美元,还或达网络安全最高能力阈值,可能开启多智能体原生时代。
WorkSwarm:引领办公智能体新范式,让AI从一个助手,进化为一支与你并肩作战的团队
办公智能体成热门赛道,openJiuwen推出WorkSwarm蜂群办公智能体,将多智能体协作引入个人办公场景。它有单Agent和集群两种模式,能自主组队、共享成果等,还支持多平台,openJiuwen社区也在招募开发者。
马斯克Grok 4.6重回一梯队!更低价格反超Fable 5,这Cursor是真没白收购
马斯克携Grok 4.6让SpaceXAI重回大模型牌桌。它跑分超GPT - 5.6 Sol和Fable 5 Max,价格更低。此次升级聚焦长程agent任务,还发布了Grok Bot智能体,后续Grok 4.7也将登场。
从“卷模型”到“算总账”:AI 产业竞争开始拼什么 | 请回答 WAIC 2026
WAIC 2026热度高涨,InfoQ直播间追问‘AI正在重写什么’。与会嘉宾讨论AI产业新阶段变化,如从‘看能力’到‘算总账’,认为模型重要性方式已变,还探讨了AI原生产品定义、AI Infra影响及未来关注方向。