「超级智能Agent」共找到 5510 篇相关文章
马斯克Grok 4正式发布:世界最大AI超级计算机就训练了这?
Grok 4公开基准测试有进步,但在高级推理测试表现差,视觉理解仍是短板。性能提升多靠整合符号工具,无重大技术创新,‘幻觉’问题没实质进展,xAI官方对道德对齐信心不足。
月之暗面刚开源多模态Kimi-2506:智能体、视觉理解,重磅大升级
国内月之暗面平台对开源多模态模型Kimi-VL-A3B-Thinking升级到2506版本。该版本性能、视觉理解等能力提升,支持更高分辨率,在多领域表现出色,还介绍了模型组成与优化器改进。
让chrome浏览器变成你的智能助手,浏览器转变为强大的 AI 控制自动化工具
Chrome MCP Server是基于chrome插件的模型上下文协议服务器,能让大模型或chatbot接管浏览器。它有chatbot/模型无关、用原本浏览器等特性,与同类项目比优势明显,还介绍了使用步骤、工具及示例。
西湖 & 浙大 | PiFlow:让AI拥有“科学直觉”,Agent用于科学发现的新范式!
西湖大学团队提出PiFlow,一个基于信息论的自动化科学发现框架。它将科学发现视为结构化的不确定性降低过程,由科学原理指导,通过Min - Max优化机制平衡探索与利用,在多领域实验中效果显著,应用前景广。
谷歌CEO劈柴震撼预言:2030年AI直逼超人智能,80亿人认知被颠覆
谷歌CEO劈柴在采访中称AI是人类历史上影响最深远的技术,进步极快且能力上限未知。他谈到AI会释放80亿人认知潜能,还从多方面阐述了AI对各领域的影响及未来发展。
大模型从“胡说八道”升级为“超级舔狗”,网友:再进化就该上班了
从 Coding 到 Agent:QCon 北京 2026 全景复盘,优秀出品人 & 明星讲师名单揭晓
4月16 - 18日QCon全球软件开发大会·北京站(2026)圆满举办,超2000人参与。多位技术领袖围绕AI与工程实践分享见解,大会还设25大专题。最后揭晓17位优秀出品人和29位明星讲师。
刷榜风波惊动OpenAI后,这家中国团队拿回Agent硬核榜单第一
在OpenAI主导的MLE - Bench基准测试上,百度伐谋2.0击败对手登顶。此前有团队刷榜引发风波,官方新增清洁赛道。伐谋2.0在多方面优化,还在汽车、金融、科研等产业落地解决难题。
黄仁勋刚讲完AI「五层蛋糕」,他们就跑通了!算力、模型、Agent一次打穿
英伟达CEO黄仁勋提出「AI的五层蛋糕」架构,易鑫结合汽车金融场景构建全栈式AI体系,从基础设施到业务应用层层推进,解决行业痛点,还开源模型推动共赢。
OpenClaw代码越改越崩?新研究EvoClaw揭示:Agents持续开发成功率仅13.37%
USC邓港大等联合发布评估基准EvoClaw,揭示AI在持续开发场景下表现不佳,成功率仅13.37%。研究还指出当前评测易高估AI能力,提出DeepCommit重构演进历史,分析各模型在持续演进中的局限与问题。