「规划与执行」共找到 7172 篇相关文章

算法论文8

在失败中进化?UIUC联合斯坦福、AMD实现智能体「从错误中成长」

伊利诺伊大学厄巴纳 - 香槟分校等团队发布论文,剖析LLM智能体失败机制,提出可自我修复的创新框架AgentDebug。研究指出智能体常见失败类型,构建错误分析体系、数据集,实验显示该框架效果显著,为AI可靠性提供方案。

机器之心
推荐文章8

Agent项目最头疼的不是技术,这可能是近期最棒的Agent调研。

MMC深入访谈多家AI Agent创业公司创始人和企业用户,撰写《State of Agentic AI: Founder’s edition》。调研显示创始人头疼的多是非技术问题,还分析了准确率与主动性、定价策略等情况。

探索AGI
新闻资讯7

OpenAI 又发布了一个新的AI Agent~

OpenAI发布新AI Agent Aardvark用于找代码漏洞,流程包括监控Git提交等,测试能发现92%已知漏洞。还公布AI浏览器Altas技术架构,采用进程隔离和IPC通信,启动快,但维护成本高。

探索AGI
产品应用8

AI百科全书SciencePedia:当马斯克Grokipedia遭遇滑铁卢,有个中国团队默默把活儿干了

在知识爆炸时代,传统互联网平台难以满足用户获取深度见解的需求,马斯克的Grokipedia也未达预期。深势科技等团队推出SciencePedia,它能理解知识关系,追踪科学脉络,让真知高效抵达用户。

量子位
8

全球首个AI Agent操作系统FlowithOS跑分超Atlas,网友:它「杀死」了比赛

AI应用初创企业Flowith推出全球首款专为AI Agent打造的操作系统FlowithOS。它能改写交互方式,功能超AI浏览器,跑分超竞品,还具记忆能力,适配多系统,已公测,或引发“AI操作系统”竞争。

机器之心
算法论文7

AI人格分裂实锤!30万道送命题,撕开OpenAI、谷歌「遮羞布」

Anthropic联合Thinking Machines研究,用30万个场景和压力测试拷问OpenAI、谷歌等前沿大模型。发现模型规范有矛盾漏洞,不同模型价值优先模式不同,如Claude重道德,Gemini重情感等。

新智元
产品应用7

OpenAI的Atlas,全网都没有提到的产品细节在这

作者本期待Gemini 3,结果体验Google AI Studio产品后觉得拉胯。此时OpenAI发布Atlas,作者体验后细节感满满,将其设为默认浏览器。文中介绍了Atlas负责人履历及诸多用户体验细节,也指出其功能尚不完善。

AI产品黄叔
新闻资讯7

Claude Code 网页版曝光, 留给 Lovable 和 Manus 们的机会,可能,不多了

网友发现Claude Code网页版选项,虽被Anthropic撤回,但功能已曝光。它有三种安全级别,处于研究预览阶段,界面功能完整,欲打造云原生开发平台,或改变编程方式,也让竞品压力增大。

AGI Hunt
算法论文7

GPT-6要「活」了?MIT新作曝光,AI「自进化」不远了

麻省理工学院推出全新自适应大模型框架「SEAL」,让模型从「被动学习者」变为「主动进化者」。网友猜测GPT - 6可能整合其能力,成为能自主学习的模型,研究虽有局限,但为大模型自进化提供新路径。

新智元
新闻资讯7

寒武纪,成为“寒王”之后

寒武纪由天才兄弟创立,曾给华为提供NPU技术,后转型推出思元系列芯片。2024年四季度首盈,2025年业绩起飞、股价超茅台。但它依赖单一客户、内外竞争大、开发者生态不完善,问题交织难短时间解决。

芯师爷