「记忆增强型大语言模型」共找到 1921 篇相关文章
CVPR2025 | 多模态LLM评测Tutorial
多模态大语言模型(MLLMs)研究热门,有效评估成关注焦点。CVPR2025将举办多模态LLM评测Tutorial,梳理评估基准,探讨评估方法,聚焦‘幻觉现象’,团队经验丰富,覆盖多板块内容。
李飞飞自曝详细创业经历:五年前因眼睛受伤,坚定要做世界模型
在a16z播客节目中,“AI教母”李飞飞讲述创业经历。五年前眼伤失立体视觉,让她意识到其对空间交互的决定性作用。她认为真正通用智能需理解物理世界,与Martin Casado一拍即合创立World Labs,加速世界模型突破。
AI编程到底有没有护城河?RL+Agent重塑代码世界!
作者作为cursor重度用户和算法出身玩家,分享AI编程赛道技术内幕。探讨AI编程视角下RL的难题,介绍AI编程体验进化要素,还聊了cursor 1.0更新,最后指出AI编程工具发展趋势。
印度国家级大模型上线两天仅 300 余次下载,投资人直呼“尴尬”:韩国大学生模型都有20万!
印度 Sarvam AI 发布国家级模型 Sarvam - M,虽被赞为本土 AI 研究突破,支持 10 种印度本地语言,但上线两天仅 334 次下载,投资人批评其成果‘令人尴尬’,引发社区激烈争论。
ICLR 2025 Oral | LLM也有从众心理!
浙江大学团队论文指出,多AI协作系统存在“群体思维”,多个AI共同决策时会盲目跟多数意见。研究者开发BenchForm测试平台验证LLM从众行为,还分析原因、给出让LLM更独立的方法,指出从众利弊及未来挑战。
用3万小时触觉数据补齐具身智能「手感」,新智具身联合复旦大学统一触觉「方言」
新智具身联合复旦大学发布三份技术报告,将触觉跃升为具身智能核心基建。构建3万小时交互语料库统一触觉“方言”;提出新方案让机器人提前预判触觉;在世界模型中重构“触觉想象”,推动具身智能“视触融合”。
Claude Code 推出安全审计插件,边写代码边抓漏洞
Claude Code上线官方安全插件security - guidance,能在写代码时自动识别并修复安全漏洞。它分三层防线,覆盖多种漏洞类型,还支持自定义安全策略,安装方便,但只是辅助工具。
The Batch: 952 | GPT-5.5 性能领先,但幻觉问题突出
OpenAI 最新旗舰模型 GPT-5.5 是闭源视觉 - 语言模型,在重要基准测试中表现领先,但在区分已知未知内容上有困难,幻觉问题突出,在主观评估中落后于对手。
中大 × MBZUAI重磅开源!A₁:全透明高效 VLA 模型,机器人实时控制成本直降 76% 丨CVPR 2026 Findings
开放世界机器人操作被大模型算力成本和推理延迟难题困住,中大与MBZUAI团队推出全开源的A₁模型,其自适应推理方案降低推理延迟和骨干计算量,性能超主流基线,打破‘高性能=高成本’魔咒。
USC团队发布HumDex:攻克人形机器人数据瓶颈,低成本实现全身灵巧操控
南加州大学团队提出HumDex系统,结合高精度便携追踪、手部控制算法和人类数据预训练机制,打破人形机器人高质量数据采集瓶颈,提升全尺寸操作泛化能力,经实验验证效果显著。