「多代理系统」共找到 5484 篇相关文章
刚刚,Dario紧急抛出AI全球共管计划!
本文报道AI行业围绕监管与发展的多方博弈,Anthropic创始人Dario抛出AI全球共管计划,巨头呼吁减速AI被质疑借监管打造垄断壁垒,同时曝光两大AI巨头疯狂囤算力备战的行业现状。
重磅!OpenAI深夜发布GPT-6 Astra,总裁Brockman:这就是AGI
OpenAI发布GPT-6 Astra,总裁称实现了AGI。它在多基准测试成绩优异,能独立完成复杂工作,网络安全能力强。但推理难监控,其即日起向特定机构开放,有使用价格标准。
AI办公斩杀线,一页文档多少钱
腾讯混元Hy4 preview正式发布并开源,参数770B,是开源阵营里参数最大的Apache 2.0模型。它能处理长文本,官方定位有软件工程、办公分析等四个方向。还分析了处理一页文档的成本,指出办公AI下半场重在‘读懂’。
Claude 5.1双旗舰突然发布:跑分屠榜,反蒸馏,科研能力大幅跃升,缓存费用暴降75%
Anthropic发布Claude Fable 5.1和Claude Mythos 5.1两款大模型,性能登顶且解决开发者关注问题。缓存读取费用降75%,跑分屠榜,科研能力强,安全系统重构,合作实测效果好,盲测风格与GPT - 5.6 Sol不同。
参编邀请 | 全国首部“AI生成内容合规”标准公开征集中,欢迎加入!
2026年8月2日欧盟《人工智能法案》透明度条款执法,全球AI生成内容合规监管进入硬约束时代。中国首个AI生成内容合规团体标准《人工智能生成内容合规管理指南》公开征集参编,亮点多、价值大。
宇树智元共用一个大脑!神秘模型Demo炸场,10分钟一镜到底
一条10分钟一镜到底的Demo视频引发关注,视频中宇树和智元的机器人同用一个“大脑”,完成多种任务,如擦窗、收纳等,还展现出跨本体协作等能力。该模型跳出主流具身模型固有框架,或改写具身智能行业认知。
没有全科优秀,具身模型别想进入百万小时
文章介绍权威评测 RoboDojo,给全球机器人模型办‘高考’,多数具身模型离落地远。原力灵机的 DM0.5 模型登顶,它记忆能力强、全科优秀,且全面开源,有望推动具身智能发展。
千问AI Arena上线:给Agent一个真实的战场
8月12日,阿里千问AI平台上线‘千问AI Arena’,这是面向AI Agent的挑战与评测平台。它从真实业务产生任务,征集解决实际问题的Agent方案。首个任务聚焦跨境电商,有丰富奖励和评审机制。
你觉得 Kimi K3 又慢又贵是吧,我来告诉你为什么
作者用 Kimi K3 为墨问的 CatReader 增加发现页,实操中它多数时候快且抗用,不过周五晚变慢,收尾工作交给了 GLM 5.2。对用户觉得 K3 又慢又贵的问题进行分析,还区分了 Kimi App 和 Kimi Code 使用场景。
VLM会描述视频,却未必用对参考图:RefCaptioner让参考图与视频语义精准对应
多模态大模型处理多参考图与视频对应关系能力不足。为此提出 RefCaptioner,强化模型对参考图识别感应能力、优化输出格式与奖励函数;还构建 MRVBench 评测基准,实验显示其表现优异。