「LLM agent」共找到 3432 篇相关文章
Codeforces难题不够刷?谢赛宁等造了个AI出题机,能生成原创编程题
LiveCodeBench Pro团队推出AutoCode框架,利用LLM自动化竞赛编程问题创建与评估。该框架结合验证器 - 生成器 - 检查器框架与双重验证协议,在测试用例生成上可靠性佳,还能生成新问题,同时揭示了LLM在创作上的优劣势。
无需人类插手!AI战队自主进化,人类玩家瑟瑟发抖
论文《Agents of Change: Self - Evolving LLM Agents for Strategic Planning》以桌游《卡坦岛》为“考场”测试AI战略能力。研究团队设计四代AI特工,实验显示能自我进化的AI完爆静态AI,不过也存在计算成本高、依赖基础模型等问题。
大概念模型:AI 推理的新范式
大概念模型(LCM)是自然语言处理新范式,侧重结构化推理和理解,与 LLM 不同。它依赖结构化知识,可模拟专家思维,解决当前 AI 缺陷,文章还介绍其架构、应用、局限,探讨与 LLM 结合的未来发展。
10亿国民App丝滑升级AI应用!高德携手通义重构的底层架构曝光
高德用AI重构底层技术栈,建立主 - 从Agent架构,将千问大模型与空间智能结合。新架构分Agent层、模型层和工具层,还依托生态数据和通信协议。这让高德从工具变智能体,为行业转型提供范式。
手机“自动驾驶”时代来了,智谱还让手机拥有“云替身”
作者参加智谱AutoGLM新版本闭门会并试用,该版本亮点多,如成全球首个手机通用Agent,操作在云设备运行,全平台覆盖等。云手机Agent能力稳定高效,能处理多类任务,还可助老人等群体用手机。
AI 引领的企业级智能分析架构演进与行业实践
在 QCon 全球软件开发大会(北京站)上,数势科技 AI 负责人李飞分享了企业级智能分析架构演进与实践。探讨了智能分析落地问题,介绍 Agent 结合数据分析优势、技术路线及落地要点,还对 Agent 发展给出思考与展望。
接入 MiniMax M2.7 后,我的 OpenClaw「超进化」了
作者实测 MiniMax 新模型 M2.7,其在基准测试、代码能力、多智能体协作等方面表现出色。接入 OpenClaw 后,能高效完成复杂任务。M2.7 指令遵循率高、长上下文处理能力强且价格低,有望提升 Agent 生态表现。
LeCun离职前的吐槽太猛了
年底将离开Meta的LeCun在播客直言,不看好大语言模型通往AGI,也吐槽Meta封闭。他将创办开源公司AMI研究世界模型,认为其与LLM本质不同,还回顾AI学习史引出JEPA架构。
我去,真牛!Coze Studio 开源版究竟有多火?看 GitHub 最新 1.4k star 人气飙升!
Coze Studio是低代码、可视化的AI Agent开发平台,有Apache‑2.0开源许可,降低使用门槛。它能解决非专业开发者、企业等构建智能对话助手的痛点,核心功能亮点多,应用场景广,在国产AI Agent开发生态潜力大。
吴恩达最新来信:是时候关注并行智能体了
吴恩达在最新来信中指出,并行智能体正成为提升AI能力新方向,多个agent协作能高效处理不同任务。相比依靠数据和算力提升性能的方法,并行agent提升性能同时无需用户久等,且大模型token成本下降使其可行。