「高质量输入」共找到 2443 篇相关文章
CVPR 2026 | 给扩散模型装上「物理引擎」: 北大彭宇新团队提出NS-Diff,使扩散模型学会流体与刚体力学
北大彭宇新团队提出 NS - Diff,将物理约束与强化学习结合,解决视频生成物理失真问题。它通过多模块提升视频物理真实感,实验表明在多数据集上超现有方法,降低物理运动误差。
将注意力旋转 90 度!今天,Kimi 的「注意力残差」火了
Kimi团队发布技术报告Attention Residuals,用依赖输入的注意力机制取代标准深度递归,解决传统残差连接的信息稀释和隐藏状态爆炸问题。实验显示其有计算优势,下游任务表现佳。
当 AI 写了几乎所有代码,软件工程会怎样?
文章探讨 AI 写大部分代码时软件工程的走向。最新模型让开发者有‘顿悟时刻’,如 Google 工程师用 Claude Code 一小时完成去年的工作。AI 编程能力在 11、12 月迎来拐点,专业知识贬值,软件工程师核心能力更重要,也带来诸多挑战。
Qwen3.5实战教程:从0到1掌握本地部署与微调
阿里通义千问团队发布Qwen3.5系列小模型,打破“大模型=高成本”惯例。本文全面剖析该系列模型,涵盖核心特性、本地部署实战、模型微调实战,还给出技术细节与问题解决办法。
爆火的OpenClaw怎么玩?谷歌老哥40天打磨终极配置单开源:让你的龙虾越养越聪明,自动打怪升级
OpenClaw正掀起AI狂潮,谷歌高级AI产品经理Shubham Saboo经40天实战打磨出OpenClaw Agent终极落地方案。其系统架构分身份、操作、知识三层,文件不断进化,文末附实操路线图。
Nature子刊:攻克医疗器械「看不清」难题,赋予自动驾驶视觉
MicroSyn-X首创无需真实数据的AI合成影像技术,让机器在无标注虚拟X光中学会追踪微型手术器械,突破医疗数据稀缺瓶颈,为自动化微创手术提供新路径,且代码和数据已开源。
ICLR 2026|在「想象」中进化的机器人:港科大×字节跳动Seed提出WMPO,在世界模型中进行VLA强化学习
香港科技大学 PEI - Lab 与字节跳动 Seed 团队提出 WMPO 新范式,可让具身智能在‘想象中训练’,解决传统 VLA 训练瓶颈,目前论文、代码与模型均已开源。
真机RL杀疯了!机器人自学20分钟100分,数字孪生封神
至简动力等提出数字孪生协同强化学习框架 TwinRL,可在真机高效执行在线强化学习。它用手机构建数字孪生,让机器人先探索再真机操作,20 分钟达 100%成功率,比现有方法快 30%,还降低人类干预。
Agent当上群主后,群聊变成办事大厅了
文心APP内测“多人、多Agent”群聊功能,像微型“办事处”,能替人办事、支招,效率高。百度文心团队提出Group - MAS攻克技术难关,此功能是全栈技术验证,还将有新玩法。
13 万人收藏的 Openclaw 登顶GitHub No.1!附上超绝性价比部署指南!(保姆级)
Openclaw在GitHub上Star数近13万,登上多榜单TOP1。作者介绍用GitHub Codespaces零成本搭建其服务,搭配Kimi K2.5模型和Discord应用,还给出部署步骤、常见问题解决办法及功能演示。