智能体评测」共找到 3877 篇相关文章

产品应用7

智能请求暴增9.4倍,token账单却没涨:Uber 公开AI软件工厂省钱方法

Uber 在 2026 年 AI 工程师大会分享软件工厂愿景。其 AI 工具嵌入开发各阶段,2 至 8 月智能请求增 9.4 倍,成本稳定。介绍智能会话四层、成本公式及优化手段,如选优模型、优化 token 等。

AI前线
开源动态8

「虾马」之后,openJiuwen社区发布JiuwenSwarm,引领蜂群智能新架构,开启「养蜂」时代

华为支持的开源AI Agent平台社区openJiuwen发布并开源蜂群智能JiuwenSwarm,按下“群智能”加速键。它基于Coordination Engineering理念,有全栈技术系,在多领域实战效果好,且单Agent能力强。

机器之心
推荐文章7

智能工程的隐形技术债:10分钟造出一个 Agent,公司却要为它养一个平台团队

如今构建智能容易,但投入生产后会面临诸多问题。文章围绕智能绘制出集成、上下文湖等七个基础设施模块,分析各模块隐性技术债务,并指出不同阶段债务表现,还提及应对措施及相关会议推荐。

AI前线
开源动态8

第二代PPTAgent来了!中科院软件所开源首个本地通用幻灯片智能,9B参数打平GPT-5

中科院软件所开源第二代PPTAgent -- DeepPresenter,将幻灯片智能模型与智能沙箱环境一同开源。它解决了AI制作PPT的痛点,以9B参数打平GPT - 5,在消费级显卡上有出色表现。

机器之心
推荐文章7

自构建智能:一项 LangChain4j 实验

作者将LangChain4j文档交代码助手,让其参照构建智能,设计多智能系统编写、测试和调试代码。实验展示了LangChain4j优势,还对比监督者和工作流两种智能实现模式,揭示速度与自主性权衡关系。

InfoQ
推荐文章8

突破泛化瓶颈:阿里云智能运维 Agent 评测系实践

大模型 Agent 在智能运维场景落地常遇泛化难题。阿里云李也博士介绍利用评测集验证和提升智能运维算法泛化性的实践,阐述评测集重要性、构建方法,还展示其在提升智能运维 Agent 能力上的成效。

InfoQ
推荐文章8

智能在「燃烧」Token!Anthropic公开发现的一切

Anthropic发布多智能研究系统构建解释,解决多智能研究困惑。多智能系统优势明显,在特定任务中表现出色,但token消耗大。其架构独特,还介绍了提示词工程、评估方法、面临的工程挑战等内容。

机器之心
新闻资讯7

Devin CEO:别搞多智能!Anthropic:我们性能提升90%!

最近,开发Devin的Cognition CEO发文称不要构建多智能系统,而Anthropic分享构建多智能研究系统,性能提升90%。Cognition认为多智能协同难,坚持单线程线性Agent;Anthropic用工程设计绕开瓶颈。二者因任务类型不同观点有别。

探索AGI
产品应用8

告别胶水代码,5倍飚速!无问芯穹首次揭秘,Infra智能蜂群登场

无问芯穹推出基础设施智能蜂群,这是新一代基础设施智能化解决方案。它封装多个智能模块,构建全生命周期智能闭环,提升资源利用率等。在重点客户业务流程落地效果好,能让开发者解放价值。

新智元
产品应用8

百度文库网盘发布 GenFlow2.0,支持同时调用超 100 个专家智能

8月18日,百度文库联合百度网盘发布全球首个全端通用智能「GenFlow2.0」。它支持超100个专家智能并行工作,解决描述难、等待久等问题,还打通百度生态资源,兼容MCP协议,接入荣耀智能助理。

InfoQ