「概念理解」共找到 1093 篇相关文章
腾讯混元数字人团队发布Moral RolePlay基准,揭秘大模型的「道德困境」
腾讯混元数字人团队和中山大学推出「Moral RolePlay」测评基准,评估大模型扮演多元道德角色能力,揭示顶尖AI模型演不好反派,暴露模型理解社会心理复杂性的局限,还给出未来对齐技术方向。
创业一年后,李飞飞推出首款可商用世界模型 Marble,任意模态都可生成 3D 世界
李飞飞创业公司 World Labs 推出可商用世界模型 Marble,支持多模态输入,生成的 3D 世界更丰富细致。李飞飞认为空间智能是 AI 下一个前沿,当前 AI 在这方面能力不足,而 Marble 正推动其发展。
内存直降50%,token需求少56%!用视觉方式处理长文本
在NeurIPS 2025论文中,南京理工大学等校研究团队提出VIST框架,为大语言模型长文本高效推理提供视觉解决方案。它模仿人类阅读机制,让模型具备选择性阅读能力,减少Token需求和内存使用。
最火VLA,看这一篇综述就够了
ICLR 2026爆火领域VLA全面综述来了!作者Moritz Reuss是2025年Apple AI/ML学者奖得主。文中明确VLA概念,介绍八大趋势,指出评测失真问题,还提及未来需重视数据质量与上下文学习。
8 个月做到 1 亿美元 ARR,Lovable 增长负责人:免费用户不是成本,是营销渠道
Lovable增长负责人Elena Verna分享产品增长经验,指出增长团队核心是解决分发问题,PLG概念被过度炒作,传统增长策略失效,应把免费产品当营销预算,还给出未来增长的8个关键策略。
突发!OpenAI深夜推出浏览器ChatGPT Atlas:一文深度详细解析「率先支持mac OS」
OpenAI推出人工智能驱动的浏览器ChatGPT Atlas,集成对话式AI改变上网方式。它有随行聊天、浏览器记忆、代理模式三大核心功能,面向全球macOS用户上线,更高级功能对付费用户开放,还注重安全与用户控制。
大模型追逐星辰大海,GPT和Gemini国际天文奥赛夺金
新论文以国际天文学和天体物理学奥林匹克竞赛 (IOAA) 为基准测试,证明 GPT - 5 和 Gemini 2.5 Pro 能在天文奥赛获金牌。研究还分析不同模型表现、与人类成绩对比及错误类型,强调需全面评估模型科研潜力。
Google封神,计算机视觉的GPT3时刻来了!
Google Deepmind称在CV领域做出类似GPT-3的成果,Veo 3经大规模训练涌现通用视觉理解和推理能力,能以图片+提示词完成复杂视觉任务,还具备感知、建模等四大超能力。
从上下文工程到 AI Memory,本质上都是在「拟合」人类的认知方式
文章结合胡塞尔现象学,探讨从上下文工程到AI Memory,指出它们本质在‘拟合’人类认知。介绍二者概念及构建方法,对比人类与AI记忆异同,还通过与胡塞尔对话,思考AI意识等哲学问题。
号称视频编辑领域的开源nano banana来了,用文字就能改视频
DecartAI开源Lucy Edit模型,号称视频领域开源Nano Banana,能理解自然语言指令改视频。如输入指令可精准换服装等,渲染快,有身份保持和动态适配亮点,有多个版本,应用场景广。