LLM智能体」共找到 4230 篇相关文章

算法论文8

大模型Agent的下一阶段:可自我进化的AI-Agent

在人工智能飞速发展下,研究者探索让AI自我反思改进。本文作者构建自我进化AI智能系统,设计四层渐进式架构,经《卡坦岛》实验,证明自我进化能力,不同模型表现有差异,代码级进化潜力惊人。

AINLPer
新闻资讯8

具身数据来了实战派!40天2轮融资数千万,瞄准物理AI基础设施

近日,具身智能数据基础设施公司元点科技完成数千万元融资。其创始人郭江亮认为具身智能竞争进入下半场,本质是数据竞争。元点用MatrixOS构建数据基础设施,业务与生态全面铺开,团队实力强,瞄准2027 - 2029窗口期。

量子位
新闻资讯7

又一家首店落地东城!机器人咖啡师,24小时不打烊→

近日,京东旗下七鲜咖啡首家24小时智能无人咖啡店落地北京银河SOHO。饮品全流程由机器人执行,单杯制作超不过30秒,还能并行制作多杯。它兼顾标准出品与个性验,也切中现代城市生活痛点。

故宫以东
产品应用7

追觅CES亮剑:一台AI具身机器人的洗衣革命|甲子光年

2026年CES上,追觅推出首款AI具身洗护机器人,可完成洗衣全流程。它整合多系统,展示新创新逻辑。具身智能分阶段发展,追觅结合制造与技术,欲降低用户洗护成本,但落地仍面临挑战。

甲子光年
推荐文章8

《动手写AI Agent》50 行代码,你的第一个 Agent

文章教你用50行代码打造能读文件、跑命令、自主决策的AI Agent Ling。介绍用JSON Schema给LLM装工具,通过循环让LLM按需调用工具,还给出运行示例及与Claude Code的对照。

AI Reading Hub
算法论文8

北大团队发布首篇大语言模型心理测量学系统综述:评估、验证、增强

随着大语言模型(LLM)能力迭代,传统评估方法难满足需求。北大宋国杰教授团队论文首次系统梳理LLM心理测量学研究进展,革新评估原则,扩展测量构念与方法,还给出增强方法与未来研究方向。

机器之心
新闻资讯7

AI 硬件新物种:七位从业者对消费级 AI 硬件的答案

2026 年 CES 落幕,释放中国 AI 硬件集出海信号。蚂蚁集团等主办的活动上,7 位从业者分享消费级 AI 硬件产品,涵盖养成宠物、智能戒指等。他们认为 AI 硬件竞争焦点正从模型能力转向场景理解。

特工宇宙
新闻资讯8

OpenAI新模型GPT-5.1发布,不跑分不刷榜,主打一个说人话

OpenAI发布GPT-5.1,主打更智能、更具对话性,无跑分打榜,有人设说人话。包括Instant和Thinking两个子模型,简单问题快,复杂问题智能。本周逐步向用户免费开放,还更新了语气风格等功能。

量子位
开源动态7

如何“驯服”你的Agent?这可能是你见过最优雅与可控的Agent框架 | 深度

文章聚焦对话式Agent,指出LLM不确定性是企业应用Agent的障碍。介绍Parlant框架,它用ABM方法控制交互,能降低LLM负担、处理边缘场景。还通过构建10086客服助手展示其使用,最后与LangGraph对比。

AI大模型应用实践
算法论文8

别被室内基准高分骗了:大模型是在推理空间,还是在「背答案」?

2025年,空间智能成大模型竞争新热点,模型在室内基准上分数飙升。但因训练与测试数据同源,其提升或只是“背答案”。中科院大学等机构发布OSI - Bench重新审视大模型空间能力,评测显示当前提升可能是虚假繁荣。

机器之心