「扩散大语言模型」共找到 8057 篇相关文章

新闻资讯7

一边秀肌肉,一边设围墙,NVIDIA 发布 OmniVinci,性能碾压 Qwen2.5-Omni,却被骂“假开源”

NVIDIA 推出多模态大语言模型 OmniVinci,结合架构创新与数据合成流水线,训练 token 仅为 Qwen2.5 - Omni 的六分之一,却在多项基准测试表现更佳。但采用限制商业用途的许可证,引发争议。

AI前线
算法论文8

NeurIPS 2025 Spotlight | 条件表征学习:一步对齐表征与准则

文章指出传统表征学习处理图片和商品信息时存在局限,针对性有监督训练成本高,多模态大模型使用成本也需考虑。为此提出即插即用的条件表征学习方法 CRL,实验显示其在下游任务表现优异。

机器之心
产品应用8

AI视频生成走向「演技生成」时代,生数科技Vidu全球发布Vidu Q2

9月25日,生数科技全球上线新一代图生视频大模型Vidu Q2,打破AI生成表情假、动作飘忽等问题,实现从“视频生成”到“演技生成”跨越,有AI演技生动、镜头语言丰富等亮点,已多端上线。

机器之心
开源动态8

CrowdStrike联手Meta发布AI安全基准,让AI在真实网络攻击中证明自己

美国网络安全巨头CrowdStrike与Meta在Fal.Con 2025大会联合推出开源基准测试套件CyberSOCEval,旨在评估AI大语言模型在真实SOC环境下的网络安全能力,它源于Meta之前框架,开源供全球开发者使用。

AIGC开放社区
算法论文8

告别海量标注!浙大团队提出GUI-RCPO,让GUI定位在无标签数据上自我进化

浙大等机构研究人员提出GUI - RCPO,这是自我监督强化学习方法,能让模型在无标注数据上提升GUI grounding能力。其通过迁移思想,利用区域一致性自我提升,实验表明该方法有效且有泛化能力。

量子位
新闻资讯8

梅花创投吴世春:AI不再卖工具,而是卖收益|甲子引力X

在「渡口——甲子引力X2025科技产业投资大会」上,梅花创投吴世春剖析AI创业投资逻辑。他认为大模型格局已定,资本兴奋点转向应用,AI价值锚点从技术转向商业结果,AI将成基础设施。

甲子光年
推荐文章7

Token成本下降,订阅费却飞涨,AI公司怎么了?

文章指出,虽模型训练成本下降,但 AI 公司运营成本尤其是推理费用猛增。以固定费率订阅和高 token 消耗的商业模式的公司面临困境,如 Windsurf、Claude Code 等,还给出避免亏损的三条出路。

机器之心
新闻资讯8

IMO 主席正式宣布:Google DeepMind在国际数学奥赛拿下金牌!

Google DeepMind的Gemini Deep Think模型在2025年IMO竞赛获金牌水平成绩。虽比OpenAI公布晚,但实现用自然语言解题质的飞跃。它采用增强推理模式,成绩经官方认证,后续将向用户开放。

AGI Hunt
新闻资讯7

小扎AI复仇进行时!OpenAI苏黎世办公室被端,650亿储备金狂烧不止

在AI模型发布趋缓时,科技巨头掀起人才争夺战。Meta从OpenAI苏黎世分部挖走三位顶尖研究员,扎克伯格亲自出马抢人,AI巨头间人才竞争白热化,Meta今年还计划投入650亿美元推进AI野心。

新智元
算法论文8

砍掉70%内存!陈丹琦团队破解LLM长文本瓶颈

大型语言模型处理长文本时,KV缓存占用内存巨大。陈丹琦团队提出KV足迹作评估标尺,推出分块驱逐与PruLong训练技术,在128K长文本任务中最高降低70%内存,性能损失仅10%。

深度学习自然语言处理