「重思考模式」共找到 2362 篇相关文章
V-RAE:把「看懂视频」的能力带入生成,重新思考视频模型的潜空间
近日,新加坡国立大学 Minghui Guo 与牛津大学 Shengqiong Wu、Hao Fei 在论文中提出视频表征自编码器 V-RAE。它以冻结的视觉基础模型为编码器压缩视频特征,还引入轻量级模块聚合信息。经实验验证,其在视频生成和预测上性能出色。
从亚百毫秒级启动到生产级部署,腾讯云为何重构 Agent 沙箱?
2026 年初,OpenClaw 掀起本地终端 Agent 热潮,但也带来安全风险,让 Agent 沙箱受关注。腾讯云 4 月开源 Cube Sandbox,InfoQ 采访金峰,了解其从 Serverless 到 Agent 沙箱过程及团队对下一代 Agent Infra 的判断。
机器人需要一个「思考系统」:τ0-VLA让具身智能迈向长程任务时代
2026 WAIC落幕,具身智能成焦点。当前VLA模型在长程任务中有局限,上海创智学院和智元机器人联合发布τ(0)-VLA,提出分层架构和新推理机制,用大量真机数据训练,在长程任务表现出色。
TRM思考奖励模型上线,大模型推理质量终于能量化了 | ICML‘26 Oral
大模型推理评测多只看答案,忽略推理过程。上海多校团队提出TRM,用ME² principle刻画推理质量,DAG-based pairwise evaluation还原结构,训练奖励模型,让推理质量可度量、训练和优化。
当「提示词工程师」开始像制片人一样思考,Seedance 2.0 Skill OS 深度解析!
AI 视频工具圈存在模型强但使用方式单一、信息孤岛和提示词‘玄学化’问题。`seedance - 2.0` 仓库搭建‘操作系统’,将‘提示词’升级为可审计制作流程,还给出各岗位产出表和使用方式。
明略科技吴明辉:企业级Agent的“精度陷阱”与人机协同重构之路
2025 年 12 月 19 日,明略科技创始人吴明辉在 AICon 大会分享《可信 Agent 的规模化之路》。他指出企业级 Agent 存在“精度陷阱”,建议重新设计人机分工,让 AI 执行 Task,人定义目标、校验结果、审计逻辑。
武大文科教授硬核跨界AI:半年项目量猛涨4000%,重构AI图表生产力
武汉大学王琼教授团队推出全球首个AI图表智能体“爱图表”,解决AI做图表的行业痛点。它不止生成,更可深度编辑,实现从“模板驱动”到“内容驱动”转变,秉持“白盒”理念,商业价值爆发。
别让米其林主厨削土豆!英伟达用「小脑指挥大脑」,重构AGI生产力
英伟达推出8B模型Orchestrator,通过组合工具降本增效。在HLE等测试中超越GPT - 5,成本仅为其30%左右。它还能泛化到未见工具,具有可定制调度能力,标志着复合AI新范式的兴起。
重新思考RLVR中的熵正则:从探索不足到探索过度的破局之路
2024年以来,RLVR使大模型在推理任务有显著突破,但实践中探索机制易失衡。传统熵正则化在LRM场景易走向极端,研究团队提出SIREN方法精准调控探索,实验显示其在多模型和数据集上性能提升显著。
ICLR神秘论文曝光!SAM3用「概念」看世界,重构视觉AI新范式
2023年Meta推出SAM,后SAM 2扩展到视频分割。近日,SAM 3现身ICLR 2026盲审论文,带来「基于概念的分割」新范式,强调按「语义概念」理解和分割图像,还构建数据引擎提升性能。