「能力实现率(CRR)」共找到 4956 篇相关文章
CVPR 2025 Tutorial:从视频生成到世界模型 | MMLab@NTU团队&快手可灵等联合呈现
图像生成普及,视频生成也有高质量发展,可灵、Sora等模型不断拓宽边界。CVPR 2025 Tutorial将探讨视频生成能否成世界模型桥梁、具身智能核心能力等问题,汇聚一线研究者分享。
软银与英特尔合作,开发AI存储芯片
Nikkei消息,软银与英特尔宣布成立合资公司Saimemory,开发适用于AI的堆叠式动态随机存取存储器原型,目标两年内降低50%功耗,实现与高带宽内存相当性能。双方注资7000万美元,各有布局目的。
首个多人对话视频生成框架MultiTalk,角色有表情还能互动
现有音频驱动人体动画方法多聚焦单人,处理多音频流能力弱、指令跟随有局限。中山大学提出多人对话视频生成新框架MultiTalk,介绍了技术原理,演示效果显示其指令跟随能力强、伪影少。
扩散语言模型九倍推理加速!上海交大:KV Cache并非自回归模型的专属技巧
上海交通大学EPIC Lab团队提出免训练推理缓存机制dLLM - Cache,复用特征降低计算量。它即插即用,通用于主流dLLM架构,在多个基准测试中实现数倍推理加速,且不降低生成质量。
一个4000亿算力龙头将诞生?
海光信息与中科曙光联合宣布筹划重大资产重组,海光拟换股吸收合并中科曙光并募资。二者总市值超4000亿,此次并购有体量大、子并母、产业链纵向整合特点,或开启国内半导体并购潮。
模型越聪明越“不听话”?MathIF基准揭示AI服从性漏洞
上海人工智能实验室与香港中文大学研究团队发布论文,用MathIF基准揭示大模型“聪明”和“听话”有矛盾,越擅长推理越易忽略指令,还分析了原因并给出让模型更“听话”的方法。
星际之门内部惊人曝光:40万块GPU爆铺!奥特曼千亿豪赌险把电网干崩
记者深入阿比林基地,揭开「星际之门」超算神秘面纱。该项目由OpenAI、软银、甲骨文合作,已投1000亿美元,后续将达5000亿。它含8个建筑、40万块GPU,面临能源挑战,巨额投资也伴巨大风险。
Veo 3全网实测惊艳所有人!DeepMind CTO:规模是AGI全部吗?
谷歌推出视频生成模型Veo 3,一句提示词就能打造电影质感短片,还能音画同步,引发网友惊叹。DeepMind CTO在访谈中表示,规模非AGI唯一要素,还提及Deep Think模式及Veo 3进展等。
北大校友、OpenAI前安全副总裁Lilian Weng关于模型的新思考:Why We Think
北大校友Lilian Weng更新博客《Why We Think》,回顾利用测试时计算研究进展,探讨激励模型思考方式,介绍思维链、并行采样、序列修订等策略,还提及强化学习、外部工具使用及未来研究方向。
微软开源多智能体自定义自动化工作流系统,加速搭建基于AI的自动化系统
微软开源多智能体自定义自动化工作流系统,可助企业用AI智能体实现复杂组织任务自动化。该方案整合多项Azure服务构建管道,有聚焦核心价值等功能,还给出部署指南与成本估算。