多模型融合」共找到 9955 篇相关文章

新闻资讯7

智能流体力学青年学者论坛第30讲~33讲

智能流体力学青年学者论坛第30 - 33讲将于2026年3月6日举办,由中国空气动力学会智能流体力学专委会主办。报告涵盖迈向大语言模型时代的自动化智能CFD工作流等主题,位学者将分享最新研究成果。

力学与人工智能
新闻资讯7

AI泡沫越大鱼越贵!YC合伙人复盘2025年AI创业

2025年底Y Combinator博客复盘该年AI四大变局,如Anthropic成最受欢迎大模型,使用率超OpenAI。创业者可在模型间套利,创建垂直AI应用。能源焦虑催生太空数据中心,AI泡沫或成应用层红利。

新智元
产品应用7

AI文本转语音进入“Next Level”!独角兽ElevenLabs发布Eleven v3:狠狠拿捏情感控制

独角兽ElevenLabs发布最新版TTS模型Eleven v3,支持70种语言,能进行人对话,生动展现情绪语气。官方称其为“迄今为止最具表现力的文本转语音模型”,网友实测好评居,但中文效果不如英文。

量子位
算法论文8

EMNLP2025 | LLM次回答一致就一定正确吗?非也

随着LLMs在高风险领域广泛应用,其输出的事实性错误引发安全质疑。中科院计算所和美团团队论文揭示自我一致错误,传统检测方法对此失效,提出跨模型探针法提升检测能力。

深度学习自然语言处理
开源动态8

清华SageAttention3,FP4量化5倍加速!且首次支持8比特训练

清华大学陈键飞团队提出针对BlackWell架构的SageAttention3,实现5倍于FlashAttention的推理加速,首次支持8比特训练。在种大模型上保持端到端精度,代码将分别于6、7月开源。

机器之心
算法论文8

OmniHuman-1.5:让数字人拥有“思考”的视频生成新范式

现有视频数字人模型难捕捉角色本质,字节提出 OmniHuman - 1.5 框架。其核心创新是用 MLLM 提供语义引导、提出模态 DiT 架构和伪末帧设计,使模型融合模态信号,生成高质量角色动画。

带你学AI
算法论文8

3D高斯泼溅,可输入视图量高达500!推理速度提升3倍,内存少80%

ZPressor能高效压缩3D高斯泼溅(3DGS)模型视图输入,解决其在处理密集视图时的性能瓶颈。它基于信息瓶颈原理,分三步压缩信息,降低内存占用和推理时间,提升3DGS在高视图输入下的性能。

新智元
算法论文8

内存直降50%,token需求少56%!用视觉方式处理长文本

在NeurIPS 2025论文中,南京理工大学等校研究团队提出VIST框架,为大语言模型长文本高效推理提供视觉解决方案。它模仿人类阅读机制,让模型具备选择性阅读能力,减少Token需求和内存使用。

新智元
算法论文8

比自回归更灵活、比离散扩散更通用,首个纯Discrete Flow Matching模态巨兽降临

近年来模态大模型采用自回归架构,推理缺乏灵活性。香港大学和华为诺亚方舟实验室研究团队提出FUDOKI,基于全新非掩码离散流匹配架构,能并行去噪、动态修正,为模态模型开辟新路径。

机器之心
算法论文7

OpenAI和Anthropic费尽心机加密的思维链,竟然能被轻松提取?

围绕大模型蒸馏争议已久,此前外部团队难获闭源模型完整推理。8 月 10 日研究者公开方法,可让弱模型读取旗舰模型密文并输出推理,还发现公开智能体轨迹存在隐私泄露问题,不过未为蒸馏指控提供决定性证据。

DeepTech深科技