超智能与未来」共找到 6621 篇相关文章

算法论文8

仅100种子题,合成数据质量GPT-5,阿里、上交提出Socratic-Zero框架

阿里巴巴与上交大联合提出 Socratic-Zero 框架,仅从 100 个种子问题出发,通过三智能体协同进化生成高质量课程。该框架合成数据质量 GPT - 5 等,Solver 性能提升显著,工程友好,开启零数据自进化新路径。

机器之心
算法论文8

北大卢宗青团队新作: 70% 实机成功率,支持语言指令的功能性抓取系统

现有抓取研究多在稳定性层面,而功能性抓取更接近真实世界的智能。北大卢宗青团队提出DemoFunGrasp方法,对功能性抓取重新建模,在仿真与真实场景均70%成功率,还引入视觉语言模型让机器人理解语言指令。

AI科技评论
推荐文章7

AI正在重塑商业,信任决定未来商业能走多远丨Visa大中华区总裁张文翊

Visa大中华区总裁张文翊认为,AI正重塑商业,智能体改变商业决策,信任决定其规模化。文章阐述AI重塑商业的三个转变、需关注的三个关键词,点明中国市场重要性及Visa探索方向。

量子位
开源动态8

MIRIX重塑AI多模态长期记忆:Gemini 410%,节省99.9%内存,APP同步上线

UCSD和NYU团队推出开源的MIRIX,全球首个多模态、多智能体AI记忆系统。它表现亮眼,在多任务中越传统方法,有类人记忆系统等特点,还上线Mac端应用,开启大模型从对话生成到长期记忆驱动心智的新周期。

机器之心
产品应用7

神秘模型排名 Gemma 4 31B:不跟 Qwen 硬刚,主打“快”和“省 token”

OpenRouter的Elephant模型Trending榜排名Gemma 4 31B。它是100B参数隐身模型,主打‘智能效率’,在速度、token消耗、指令遵循等方面与其他100B级别模型对比各有优劣,代表极致轻量路线。

AI前线
新闻资讯8

震撼,世界模型第一次真实地模拟了真实世界:谷歌Genie 3昨晚抢了OpenAI风头

昨晚谷歌DeepMind宣布Genie世界模型到第3代,能通过单个文本提示词创建交互式、可玩环境。它在多方面优于前代及其他模型,具备构建完整世界能力,但也存在动作空间有限等局限,未来应用值得期待。

机器之心
算法论文8

挑战Claude4的8B Agent!NUS提出AgenTracer:面向多智能体系统的失败归因

随着大语言模型发展,多智能体系统潜力大但有系统脆弱性问题。NUS研究者在论文中提出AgenTracer框架,构建标注管线,设计AgenTracer - 8B模型,在失败归因任务上大型闭源模型,还能助力系统自我提升。

PaperAgent
算法论文8

HyperEyes:从「搜得更深」到「搜得更宽」,并行多模态搜索智能体的效率革命

小红书研究团队提出 HyperEyes 模型,打破现有多模态搜索智能体串行处理模式困局。通过全栈设计实现并行多模态搜索范式跃迁,在多基准测试中表现优异,证明准确率与效率可协同进化。

机器之心
算法论文8

挑战Claude4的8B Agent!NUS提出AgenTracer:面向多智能体系统的失败归因

随着大语言模型发展,多智能体系统潜力大但失败率高。新加坡国立大学等机构研究者提出AgenTracer框架,构建标注管线、设计轻量级追踪器,在失败归因任务上大型闭源模型,还能助力系统自我提升。

深度学习自然语言处理
新闻资讯8

Cursor终结者?Grok 4正式登顶!马斯克扬言编程碾压,20万N卡年赚47亿美金!

时隔5个月,xAI发布通用模型Grok 4,后续还将推三款模型。Grok 4上线,有三个订阅版本。马斯克称其智能博士生,多项基准测试领先,编码或Cursor。其性能强大源于训练投入和计算扩展。

AI前线