「联合自注意力」共找到 2250 篇相关文章
加速200倍,单显卡1.8秒生成5秒高清视频!清华与Vidu解开了视频扩散模型的速度枷锁
清华、生数科技与伯克利联手用TurboDiffusion解开视频扩散模型速度枷锁。它改造注意力机制、引入步数蒸馏和量化策略,在多模型测试中加速100 - 205倍,且画质几乎无损。
彻底告别VE与VAE!商汤硬核重构多模态:砍掉所有中间编码器
商汤科技联合南洋理工大学发布NEO - unify,这是“原生、统一、端到端”多模态模型架构,砍掉VE和VAE,用混合变换器架构打通视觉与语言能力,提升数据与算力利用效率,为跨模态智能系统奠基。
OpenAI「自首」!联手MIT证明:ChatGPT用得越多越孤独
OpenAI联合MIT进行四周随机对照实验,追踪981名受试者超30万条聊天消息。结果显示,ChatGPT用得越多,人越孤独,信任度越高伤害越深,语音模式长期副作用大,超120万用户心理亚健康。
居然 11.5K star 了,这个一人公司的秘密项目有啥魔力!
做自媒体和内容运营重复工作多、效率低。开源项目`AiToEarn`用AI+自动化整合内容创作、发布等环节,支持多平台,有11.5k+ star,还介绍了安装使用方法。
在 OpenClaw 的冲击下,Cursor 已经要过时了
Insight Partners 联合创始人 Jerry Murdock 接受访谈,认为自主 Agent 是 AI 浪潮核心,Cursor 已过时。还提到会有自主 Agent 专属技术栈,软件未来将由 Agent 购买,劳动力市场会受冲击,现在是创办新基金的最佳时机。
VLA动作预测必须经过LLM吗?TurboVLA仅0.2B参数,RTX 4090上跑出32Hz在线动作预测
近年来,VLA模型成通用机器人控制重要路线,但模型大、动作更新慢的矛盾凸显。华中科技大学联合华为提出TurboVLA,绕开大语言模型,形成V+L→A路径,降低成本,保持操作能力。
一篇双引擎进化的长程Agents系统性综述
人大、北大、清华等联合发表149页长时程Agent综述,给出首个统一形式化定义,梳理出‘外化Harness工程×内化模型优化’双螺旋共演化主线,用六个视角串起技术版图。
AI Spot 学术分享会丨ICLR 2026 深度推理专场
当大模型走向深度推理,ICLR 2026 汇聚全球顶尖成果。OpenMMLab 等联合发起 AI Spot ICLR 2026 学术分享会,5 月 14 日 19 点直播,聚焦模型‘慢思考’,嘉宾将解读四大核心技术。
马斯克刚刚官宣了“芯片美国梦”
美国当地时间3月21日,马斯克联合SpaceX、Tesla、xAI发布TERAFAB项目,启动超大规模芯片制造设施,目标年产1太瓦计算能力,80%产能服务太空任务,虽面临诸多挑战,但意义深远。
DeepSeek之后:中国开源人工智能生态的架构选择
自2025年1月“DeepSeek时刻”,中国开源社区有历史性进展,讨论焦点从模型转向架构与硬件选择。技术架构多元,多模态能力扩展,开源许可宽松,小模型走红,本土硬件采用加快。