「LLM框架」共找到 2432 篇相关文章
扩散语言模型扛把子LLaDA迎来新版本,数学、代码、对齐能力均提升
中国人民大学与蚂蚁集团团队基于前期 8B 扩散语言模型 LLaDA,提出方差缩减的偏好优化方法 VRPO,推出 LLaDA 1.5。它在数学、代码、对齐任务上性能提升,VRPO 为扩散语言模型对齐提供框架。
CVPR 2026|1分钟单图变4D视频!AI看图直接脑补物理规律
北京理工大学和理想汽车等团队提出全新框架PhysGM,引入DPO实现端到端快速前馈推理,能1分钟内将单图生成为4D动态视频,在速度和评价指标上超越主流模型,相关工作被CVPR 2026接收且代码已开源。
新研究重新评估 AGENTS.md 文件在 AI 编码中的价值
苏黎世联邦理工学院新论文指出,`AGENTS.md` 文件可能常阻碍 AI 编码智能体。研究构建 AGENTbench 数据集测试,发现 LLM 生成文件降低性能,人类编写文件有边际收益但也增加成本,开发人员对此研究看法不一。
变更即指标:用交付信号度量系统可靠性
系统变更是生产事故主因,本文提出聚焦变更可观测性的指标框架,介绍可扩展架构采集展示指标。定义业务和技术指标,构建以事件为中心架构获取数据,还阐述以数据驱动改进变更交付过程。
无需奖励函数!我们意外构建了自我进化的AI系统
牛津大学发现LLM可通过“部署 - 验证 - 再训练”循环自我进化,绕开人工奖励函数设计瓶颈。在三个经典规划领域实验效果惊人,还在理论上证明其与强化学习的数学等价关系,有优势也有隐患。
让 Claude/Codex/Cursor 少读文件、多懂代码:Serena 体验
Serena是“编码代理工具箱”,能让LLM像IDE一样理解和改代码,有符号级检索等亮点。适合大型代码库任务,10分钟可上手,有多种接入方式,还有提示词模板,能让AI操作更专业。
吴恩达最新发声:大模型通往AGI还得好几年,做好长期苦战准备
吴恩达发表关于LLM现状与未来的观点,指出其虽通用但不及人类,榨干公网数据后进步难,相比人类还很‘笨’。强调推动发展需大量人工决策和数据工程,要做好长期苦战准备。
AGI前夜重磅:RL突破模型「认知上限」,真·学习发生了!
AI研究圈争论RL能否赋予模型超越基础模型的推理能力。UC Berkeley等团队提出DELTA框架,观察到“RL grokking”现象,还设计新任务验证,提出两阶段奖励调度,总结两种模式等,为争论带来新依据。
EMNLP2025 | 解耦视觉与推理,港大探索视觉语言模型"眼智分离"新范式
当前大视觉语言模型处理复杂推理任务时,常过分依赖语言知识,忽视图像关键信息。港大等团队提出ProReason框架,其蒸馏的ProReason - VL和ProReason - Q3模型性能提升显著,为LVLMs发展提供方向。
16K星 Zep凭一张“动态记忆图”吊打一众Graph RAG
现有的RAG框架多依赖静态文档检索,无法满足企业对动态知识整合的需求。本次分享的Zep提供新型智能体记忆层服务,通过核心组件Graphiti动态整合数据,在LongMemEval基准测试中表现出色。