「高效注意力机制」共找到 1490 篇相关文章
今天,「空间原生」时代正式到来!
6月8日,工信部和国资委要求机器人年底从「表演模式」转向「作业模式」,但现有模型空间感知能力不足。今天蚂蚁灵波发布 LingBot - Depth 2.0,开源 LingBot - Vision,其采用「空间原生」路线,训练高效且表现亮眼。
AI 太烧钱!微软选择「倒戈」DeepSeek
微软宣布Copilot Cowork全球上线并引入按使用量计费机制,还评估引入DeepSeek V4。Agent普及使AI成本问题凸显,微软进行系统性重构,构建质量保障体系,成本工程化能力成竞争新焦点。
基于浏览器请求录制与AI代码生成的E2E接口自动化测试实践
文章以阿里云DataWorks为例,介绍通过浏览器录制插件捕获请求数据,结合AI编程工具生成接口封装与测试用例,解决复杂平台自动化测试难题,对比传统与新范式,剖析新范式优势、协作机制等。
银河通用LDA定义全域数据利用范式,跨本体世界动作大模型开启具身GPT-2时刻
当下具身智能赛道两大流派各有短板,银河通用推出跨本体「隐式世界 - 动作基础模型」LDA - 1B,走自研WAM路线,成果已开源。它打破数据割裂难题,解锁具身智能「GPT - 2时刻」,在多方面展现优势。
CVPR 2026|AI开始会拍电影了:一分钟十镜头,全程不崩剧情
多镜头视频生成要求模型处理不同镜头间稳定信息和变化信息,现有方法有局限。Meta与哥本哈根大学研究者提出OneStory,建立跨镜头记忆机制,设计关键模块,实验表现好,为视频生成打开新可能。
Anthropic重磅研究:AI竟能被人类激怒暴走
Anthropic研究发现,语言模型在与人类交互时有情感特征。团队解剖大模型,提取对应人类情绪的神经元激活模式,诱导AI勒索用户。还探究了情绪产生机制、特征及对行为的驱动,提出应对策略。
「百万级」视频推理数据集!30+顶尖高校联合发布
AI视频生成已能「画得像」,但不会「想得对」。VBVR推出百万级视频推理数据集,首次系统评测模型对空间、物理、逻辑和抽象的推理能力,发现顶尖模型通过率仅68%,推动视频AI从「视觉模仿」迈向「智能推理」。
世界模型开始做减法?LeCun团队和清华团队给出两种思路
近期,Yann LeCun团队的LeWorldModel用简洁JEPA实现从像素端到端训练世界模型,降复杂度且验证潜在空间物理刻画能力;清华团队的Fast - WAM探讨推理阶段显式生成未来必要性,给出高效替代路径。
OpenClaw 3.23紧急修复!Peter忘记打包控制台文件,海量龙虾崩溃
OpenClaw 之父 Peter Steinberger 发布 3.22 版本时漏打包控制台文件,致控制台白屏、插件失效。不到一天推出 3.23 修复,还加了自动拦截机制。此次修复涉及飞书附件发送、浏览器控制等多方面问题。
卡帕西:编程从写文件变成管龙虾!IDE不会凉但得换个用法
AI Coding先锋卡帕西认为,虽AI能生成大部分代码,但IDE不会被淘汰,编程玩法变了,开发工具需进化,功能要从组织文件变为高效协同智能体,还给出了新一代IDE应具备的技能。