交互革命」共找到 765 篇相关文章

算法论文8

训练成本暴降99%,35秒出1分钟高清视频!英伟达MIT等引爆视频AI革命

英伟达联合MIT、港大团队提出SANA - Video架构,其核心是创新的全局线性注意力Diffusion Transformer训练框架和全局显存恒定的KV缓存机制。它训练成本低、速度快、可部署,重新定义AI视频生成效率极限。

新智元
新闻资讯7

90%打工人「自费买AI上班」,开启To P革命!每月花20刀效率翻倍

面对AI淘汰焦虑,大量职场人主动自费买AI工具,开启「自我拯救」运动,催生出To P新赛道。文章分析其发展快的原因,也提及To B和To C赛道后续发展的条件。

新智元
产品应用8

隼瞻科技重磅发布DSA处理器敏捷开发平台ArchitStudio,引领RISC-V专用处理器设计革命

第五届RISC - V中国峰会,隼瞻科技发布DSA处理器敏捷开发平台ArchitStudio。它是全栈式平台,集成深厚技术积累,提供完整支持,能解决传统设计痛点,让开发敏捷高效,推动行业发展。

芯师爷
产品应用8

大模型推理的“左右脑”革命!华为盘古Embedded凭昇腾之力,让快慢思考合二为一

传统大模型推理面临长链条深度思考与低时延反馈的矛盾,华为盘古团队提出盘古Embedded模型。基于昇腾NPU,其采用双系统认知架构,集成“快思考”与“慢思考”双推理模式,实现推理效率与精度协同提升。

机器之心
开源动态8

SIGGRAPH 2025 | CLR-Wire:曲线框可生成?可交互?深大VCC带你见证魔法

深圳大学黄惠团队推出 CLR - Wire 方法,将复杂三维曲线框结构编码到连续潜空间,解决传统难题,能实现高效生成与平滑插值,相关代码已开源,在多领域有应用前景。

机器之心
算法论文8

HyperEyes:从「搜得更深」到「搜得更宽」,并行多模态搜索智能体的效率革命

小红书研究团队提出 HyperEyes 模型,打破现有多模态搜索智能体串行处理模式困局。通过全栈设计实现并行多模态搜索范式跃迁,在多基准测试中表现优异,证明准确率与效率可协同进化。

机器之心
产品应用7

别再错过啦,AI Agent记忆革命:95.2%检索率的持久记忆系统深度解析

agentmemory是为AI编码Agent打造的持久记忆系统,能自动捕获操作上下文,有三层搜索与四层记忆架构。支持12+种主流AI Agent,有全平台覆盖、零外部依赖等优势,虽有局限但值得开发者一试。

小华同学ai
新闻资讯8

对话宋亚宸:从 3D 生成到世界模型,VAST想搭一套「可交互世界」的底座

VAST是一家专注通用3D大模型研发与落地产品建设的人工智能公司。创始人宋亚宸表示,3D生成未普及是缺3D UGC平台,所以从工具和模型入手。该公司核心产品Tripo Studio成果显著,今日还宣布完成5000万美元A轮融资。

AI科技评论
开源动态8

英伟达新架构引爆全模态大模型革命,9B模型开源下载即破万

英伟达推出全模态大模型OmniVinci并开源,其90亿参数规模性能超同级别甚至更高级别模型,训练数据效率是对手6倍,能精准解析视频和音频,在多模态应用场景中表现卓越,下载量破万。

新智元
新闻资讯8

每秒生成超30帧视频,支持实时交互!自回归视频生成新框架刷新生成效率

微软研究院与北大联合发布Next - Frame Diffusion (NFD)新框架,通过帧内并行采样、帧间自回归等方式,让视频生成在保持高质量的同时,效率大幅提升,还采用多项技术进一步优化。

量子位