「研究方向」共找到 2478 篇相关文章
HaluMem:让AI记忆系统的“幻觉”现形——首个面向记忆系统的操作级幻觉评测基准
过去一年,AI Agent的‘记忆能力’成热门话题,但AI记忆存在幻觉问题。为此发布操作级幻觉评估基准HaluMem,它能精准定位幻觉来源,评估主流记忆系统,为构建可靠记忆系统提供方向。
奥特曼下注27岁神秘青年,「复活」世界最顶级实验室
27岁的路易斯·安德烈获奥特曼、孙正义等投资,成立Episteme公司,欲打造现代版贝尔实验室。该公司旨在支持科研者,让其摆脱压力专注研究,虽面临诸多挑战,但也有成功可能。
65岁图灵巨头离职创业!LeCun愤然与小扎决裂,Meta巨震
FT爆料,65岁Meta首席AI科学家LeCun将在未来几个月离职创业,推进「世界模型」研究。他任职12年,因与小扎战略分歧而决裂,此前MetaAI业务改革,战略重心转移,FAIR被边缘化。
AI 也有长久记忆了!谷歌Nested Learning让AI拥有持续学习的生命力
Google Research科学家研究直指AI领域难题,其论文《Nested Learning: The Illusion of Deep Learning Architectures》已提交NeurIPS 2025。Nested Learning打破认知框架,提出三大核心贡献,构建HOPE架构,性能优越,将改变终身学习应用领域。
我给在上学的弟弟做了个论文版抖音
作者弟弟被海量论文困扰,作者为其做了像刷短视频一样刷论文的工具,用了 Claude Code 和星辰 Agent 社区版,还介绍了系统逻辑、搭建过程,对比了不同平台,最后工具开源,鼓励按需改进。
多模态大模型理解物理工具吗?PhysToolBench提出了衡量多模态大模型对物理工具理解的基准
香港科技大学等团队提出 PhysToolBench,用于衡量多模态大模型对物理工具的理解。它将理解分为三个等级,测试 32 个模型,揭示了大模型在工具理解上的不足,也为未来发展指明方向。
AEPO:智能体熵平衡策略优化,让探索更稳,推理更深!
中国人民大学与快手团队联合提出 AEPO 算法,解决熵驱动式智能体强化学习训练不稳等问题。它设计两项核心机制,在 14 个基准上优于主流算法,在 X 等平台获高关注。
OpenAI 推出 GPT-5 驱动的安全卫士Aardvark:Codex 绝佳搭档
OpenAI推出由GPT - 5驱动的自主安全研究智能体Aardvark,用于软件安全保障。它能持续分析代码仓库,识别并修复漏洞,目前在内部及合作伙伴代码库效果良好,正处私有测试阶段。
推理时扰动高熵词,增强LLM性能
香港科技大学(广州)研究团队发现LLM推理时,一小部分高熵词显著影响输出正确性。基于此提出MTI方法,含Selective CFG intervention与Lightweight negative - prompt guidance,无需额外训练,能提升模型推理能力。
AI 六小龙近况:零一万物迎来三位新高管,李开复提出“一把手工程 ”
AI六小龙中的零一万物进行新一轮高管任命,沈鹏飞等三人加入。同时提出“一把手工程”核心战略,以“一横多纵”打法构建新格局,推动大模型ToB解决方案落地,探索AI商业化新方向。