「多代理场景」共找到 5415 篇相关文章
如何让Agent更符合预期?基于上下文工程和多智能体构建云小二Aivis的十大实战经验
文章围绕云小二Aivis项目,分析Agent不按预期输出的原因,从预期和技术层面展开。还总结十大优化经验,如清晰预期、精准投喂上下文等,为构建和调优Agent提供参考。
明星AI编码助手涨价10倍惹怒开发者!CEO 回应:有人花千元薅了我们10多万,不挣钱不可持续
10月16日,AI代码助手Augment Code更新定价模式,按AI使用量计费,用户称成本涨超10倍。CEO称原模式不可持续,举例有用户带来高额成本。行业内多家公司也调整定价,反映AI编码助手成本和定价难题。
刘鹏飞组提出Agent领域的少即是多:智能不在于数据堆砌,78个样本训练出超强Agent,128倍效率提升
刘鹏飞组论文《LIMI: Less is More for Agency》提出颠覆性观点,认为Agent智能培育关键在数据质而非量。LIMI用78个样本在AgencyBench得分超基线模型,实现128倍数据效率提升,为Agent开发提供新路径。
不写代码、不裁员、15人团队爆改 AI 应用!ChatGPT、Claude死忠粉的暴利玩法:打造多个爆款,实现七位数营收
AI 原生创业公司 Every 仅 15 人,工程师几乎不写代码,却发布多款 AI 产品,运营咨询部门年收入数百万。其联合创始人 Dan Shipper 分享工作流程,称 AI 不会大规模抢岗,通才更吃香,还盛赞 Claude Code 等工具。
突发!windsurf被谷歌收购
一直传言OpenAI要收购Windsurf的交易关闭,Windsurf转投谷歌DeepMind团队。其CEO和员工将专注代理编码工作,从事Gemini项目,谷歌获部分技术非独家许可。
Qwen 3-235B Aider编程能力击败Claude3.7,成本便宜百倍
Qwen3-235B-A22B在Aider多语言编码基准初步测试中击败Sonnet 3.7 Thinking和OpenAI o1,成本便宜150到600倍。Qwen3-32B准确率超GPT-4.5和GPT-4o ,代码编辑格式正确率达100%。
π0.7的泛化能力有多强?零样本纯靠口述就能用空气炸锅,演示完换个机械臂也能叠衣服
2026年4月16日,美国明星机器人AI公司Physical Intelligence发布模型π0.7。它具组合泛化能力,借助多模态提示框架,能零样本完成新任务。在空气炸锅、叠衣服等实验中表现出色,有望推动具身智能发展。
入职仅一年,套现5000多万后背刺马斯克搬走 Grok 核心代码库!业内专家:拥有菜谱不等于能做出同样的菜
xAI起诉前员工Xuechen Li窃取商业机密,指控其复制代码库,可能使对手受益。业内专家认为大模型核心竞争力不全在代码,xAI可通过加强管控、研发等修复竞争力,还探讨了数据防泄漏系统问题。
自动化评测的九九归一——评测agent
本文提出统一评测Agent架构,实现评测全链路自动化。它能学习标注标准,完成自动标注等工作。还介绍架构、解耦方法、模型优化及训练方案,解决多模态幻觉等问题,提升机审率,节省标注成本。
单卡搞定万帧视频理解!智源研究院开源轻量级超长视频理解模型Video-XL-2
智源研究院联合上海交通大学等机构发布新一代超长视频理解模型Video-XL-2。它单卡能处理万帧视频,编码2048帧仅需12秒,在效果、长度和速度上全面优化,已开放模型权重。