「历史编辑轨迹」共找到 414 篇相关文章
DeepMind揭示Reasoning内在机制
近年来大型推理模型在复杂任务表现出色,但推理机制成谜。本文提出用推理图解码其‘思考轨迹’,分析环状结构、直径大小和小世界特性,发现蒸馏模型等特点,为理解AI推理及模型优化指明方向。
思维锚点:破解LLM Reasoning黑箱的关键句
文章提出思维锚点概念,指推理轨迹中影响后续步骤和答案的关键句。开发三种归因方法,系统论证高级组织句影响力更大,锚点主导错误修正。研究为理解LLM推理机制开辟新途径,开源工具支持可视化分析。
何恺明CVPR最新讲座PPT上线:走向端到端生成建模
今年CVPR闭幕,何恺明现身会场并做了主题为‘走向端到端生成建模’的分享,近日其个人网页上传了该分享PPT。PPT回顾识别模型演进,探讨生成模型能否重演历史,还介绍了MeanFlow方法及成果。
谷歌Gemini火力全开!实测:原生图像生成新升级确实强
谷歌Gemini原生图像生成功能升级,图像质量更好、文本渲染更准、生成速度更快。可融合图片元素、实时编辑等,能免费试玩,开发者可集成API。实测表现惊艳,也有翻车情况,还能搭配Gemini 2.5 Pro。
港科大(广州)联合腾讯AI平台部开源VibeWorlding,3D世界构建迎来Vibe Coding时刻?
香港科技大学(广州)联合腾讯AI平台部提出VibeWorlding,是可通过多轮对话等自主构建和编辑交互式3D世界的多模态智能体框架。团队开源多项数据,其模型经强化学习后表现超GPT - 5.5等。
ECCV 2026 | 北大团队提出 Atomic Dance:基于原子动作的可解释音乐舞蹈生成框架
北大团队提出 Atomic Dance 框架,以原子动作作为舞蹈基本单元,建立有明确语义和结构的舞蹈表示,设计“动作规划 — 舞蹈生成”两阶段框架,让生成的舞蹈更符合音乐节奏和编舞逻辑,具备可解释性和可编辑性。
陶哲轩最新演讲:数学正在进入“工业时代”
当地时间7月24日,菲尔兹奖得主陶哲轩在2026年国际数学家大会上发表演讲,指出AI参与数学研究,或使数学站在类似历史节点,研究方式和价值体系受挑战,还探讨了AI对数学研究各方面的影响及应对方向。
行为记忆+认知记忆,中科大MemWeaver重构LLM个性化记忆
论文MemWeaver被The Web Conference 2026接收,它聚焦用户从隐式到显式文本交互时个性化生成的升级问题。提出将用户历史升级为层次化记忆,构建行为与认知双记忆模块,主实验表现优,消融实验验证其结构设计关键。
5.1K Star!Codebuff 把整个 AI 编程团队装进你的终端!
Codebuff是开源AI编程助手,获超5.1k stars。其多智能体架构让不同智能体分工协作,理解代码上下文更好、编辑更准。官方测试中完成率61%,超Claude Code。它免费且上手简单,还能创建自定义智能体。
GRPO遭遇瓶颈?G²RPO-A让自适应指导为小模型推理能力「开外挂」
大模型推理能力难迁移到小模型,现有强化学习方法如GRPO在小模型上性能提升有限。香港中文大学(深圳)唐晓莹教授团队提出G²RPO - A算法,缓解小模型奖励稀疏问题,在多模型实验中表现优于vanilla GRPO。