「多未来预测」共找到 6124 篇相关文章
解决算力瓶颈,给多模态瘦身!Token压缩完整图谱与选型指南
给多模态大模型瘦身是解决算力瓶颈的关键。Token压缩技术可剔除视觉冗余,提升训练与推理效率。北大等团队剖析其全貌,给出完整图谱与选型指南,还揭示了未来演进路径。
美国视频生成老炮儿,入局世界模型
Runway发布首个通用世界模型GWM - 1及一系列变体,包括GWM Worlds、GWM Avatars、GWM Robotics,均基于Gen - 4.5构建。还对Gen - 4.5升级,新增原生音频生成、编辑和多镜头编辑功能。
微软开源新版Phi-4:推理效率暴涨10倍,笔记本可运行
今天凌晨微软官网开源Phi - 4家族最新版Phi - 4 - mini - flash - reasoning,它参数小性能强,适合边缘设备。采用自研SambaY架构,推理效率涨10倍,延迟降2 - 3倍,多场景测试表现优异。
Diffusion约2倍无损加速!训练-推理协同的缓存学习框架来了| HKUST&北航&商汤
HKUST、北航与商汤提出HarmoniCa框架,解决Diffusion模型推理慢、成本高问题。它通过SDT和IEPO机制,解决训练 - 推理脱节,在多模型上实现推理提速、质量提升,且训练推理开销低,已开源。
ACL 2025 | 让小说角色 「活」起来!复旦BookWorld打造沉浸式小说世界模拟系统
复旦大学团队主导的BookWorld系统,是ACL 2025论文成果。它能从小说提取数据构建AI世界,让角色AI互动创作故事。系统有自主和干预模式,实验表现出色,未来可成互动娱乐平台。
史诗时刻!AlphaGo神之一手突现,谷歌AI颠覆科研极限?
谷歌DeepMind推出AlphaEvolve,它取得多项数学成果,如改进4x4矩阵乘法、推进六边形填充问题研究等。它能自我进化,还可优化谷歌计算基础设施,预示人类与AI强大协作循环的未来。
AI 开发工具的隐形战场:新一轮 IDE 之争打响!
在AI开发工具领域,VSCode成主战场,但背后有技术和策略拉扯。开发者面临战略选择,VSCode有诸多限制,OpenVSX虽提供替代方案但插件不全,Cursor崛起引发微软动作,未来走向待察。
放弃开源、重组权力!扎克伯格掏出Muse Spark,杀回大模型主桌
Meta在AI发展遇阻后推出Muse Spark,它是MSL首个模型,定位为通向个人超级智能的第一步,性能表现出色,当前闭源,未来Muse系列或有开源变体,标志Meta AI权力结构重塑。
基础模型又一关键拼图,腾讯混元发布训练新范式「无相」:引入功能性记忆,打破静态权重枷锁
腾讯混元团队发布HY - WU范式,打破静态权重束缚,引入功能性记忆,实时生成个性化参数。应用于图形编辑基模效果好,在图像编辑任务表现优秀,还对未来AI架构提出多方面展望。
一等奖20万,大佬们出题,最硬核视频生成全球挑战赛开启!
首个AI视频生成全球挑战赛来袭,多位大佬发起,20万大奖待拿。大赛聚焦AI视频生成「一致性」挑战,设主赛道和创意赛道,分别面向技术派和创作者,旨在推动视频生成技术发展。