超级智能体」共找到 5676 篇相关文章

算法论文8

HaluMem:让AI记忆系统的“幻觉”现形——首个面向记忆系统的操作幻觉评测基准

过去一年,AI Agent的‘记忆能力’成热门话题,但AI记忆存在幻觉问题。为此发布操作幻觉评估基准HaluMem,它能精准定位幻觉来源,评估主流记忆系统,为构建可靠记忆系统提供方向。

PaperAgent
推荐文章7

实战·Agentic 上下文工程(下):实现一个可自我学习与进化的智能体原型

文章参考ACE论文架构与提示词设计,实现可自我学习与进化的ACE智能体原型。介绍整体架构、各模块实现逻辑、工作流组装测试,也指出当前问题如LLM表现波动大等,并给出改进方向。

AI大模型应用实践
算法论文8

清华校友出手,8B硬刚GPT-4o!单一模型无限工具调用,终结多智能

MIT等机构推出TIM和TIMRUN组合拳,突破模型token天花板。TIM将推理建模为任务树,TIMRUN优化内存管理。二者结合支持长程推理,实现单模型高效推理,简化智能体构建,在多方面表现出色。

新智元
开源动态8

2天1k多星!BAGEL横空出世:字节跳动发布全球首个多模态全能AI,开启智能新纪元!

字节跳动推出开源多模态基础模型BAGEL,有70亿活跃参数。它在多模态理解排行榜顶尖开源模型,文本到图像质量与SD3媲美,还具备世界建模等能力,文中介绍其方法、特性及使用说明。

GitHubStore
产品应用8

打造全球首个强化学习云平台,九章云极是如何做到的?

AI正从语言模型走向智能体,强化学习成关键技术,但训练面临困难。2025年6月九章云极发布全球首个工业强化学习云平台AgentiCTRL,实现系统重构,其智能基础设施战略布局领先,具产业赋能优势。

机器之心
算法论文8

横扫八大数学竞赛:清华微软联合提出STAR-PólyaMath,Apex基准GPT-5.5 13.5%

清华大学与微软亚洲研究院团队提出推理多智能体系统 STAR - PólyaMath,构建探索 - 推理 - 验证框架,解决大模型长程数学推理瓶颈,在八大数学竞赛基准获最优成绩,还可泛化到其他推理场景。

机器之心
新闻资讯8

刚刚,OpenAI发布GPT-5-Codex:可独立工作7小时,还能审查、重构大型项目

凌晨1点,OpenAI发布针对编程优化的GPT-5-Codex,它能独立工作7小时,可审查、重构大型项目。还宣布Codex升,包括新CLI和IDE插件等,同时介绍安全保护措施、价格及可用性。

机器之心
新闻资讯8

谷歌量子计算重磅突破登上Nature:首次实现可验证量子优势,比最快算快13000倍

谷歌量子AI团队宣布里程碑式算法突破,其Willow芯片运行“量子回声”算法,首次在硬件上实现可验证量子优势,执行特定任务比最快算快13000倍,为多领域应用铺平道路。

AI寒武纪
产品应用7

刚刚,DeepSeek-V3.1「终极版」重磅发布!最大提升36%,V4/R2还远吗?

DeepSeek最新模型DeepSeek-V3.1-Terminus发布,解决了此前输出随机带「极」字、中英文混杂等问题,在多个基准测试中成绩提升,最大提升36%,Agent能力也有进步,还引发网友对V4/R2的期待。

新智元
新闻资讯8

李开复陆奇重仓同一家Harness智能体公司,李笛带队,4个月2轮融资3-5年粮草

成立仅四个多月的AI初创公司明日新程宣布连续完成两轮融资,资金储备够未来三到五年创新。其由李笛带队,获李开复、陆奇等投资,聚焦Harness群体多智能体,还将推出新版“小冰岛”。

量子位