长内容合成」共找到 1619 篇相关文章

算法论文8

全新线性注意力范式!哈工深张正团队提出模感知线性注意力!显存直降92.3%!

哈工深张正团队联合多团队发布论文,提出 NaLaFormer 框架,解决线性注意力两大核心缺陷,保持线性复杂度同时精度超越,在多任务表现出色,如超分任务显存降 92.3%。

机器之心
算法论文8

LLM算力告急?把文本变图片,推理成本直接减半!

大型语言模型处理文本时计算成本高,本论文探索‘文本即图像’输入压缩策略,将文本渲染为图像输入多模态模型,可减少近一半令牌,且任务性能不受显著影响,在多任务中验证了其有效性。

深度学习自然语言处理
算法论文8

字节Seed提出M3-Agent:像我们一样"记住"与"思考"的视频理解新范式

字节Seed提出M3 - Agent,这是首个融合实时视听输入、类人记忆构建与自主推理的多模态智能体。它模仿人类记忆机制,解决视频理解痛点,已被CVPR 2025收录并开源代码,为通用人工智能奠定基础。

深度学习自然语言处理
开源动态8

不用额外缓存!英伟达开源大模型记忆压缩方案,128K上下文提速2.7倍

英伟达联合多机构推出TTT - E2E方法,在文本处理上提速显著且性能不打折。它基于标准Transformer,将文本建模转为「持续学习」任务,核心是上下文压缩,避免额外缓存,代码和论文已开源。

量子位
算法论文8

大模型推理上限再突破:「自适应难易度蒸馏」超越R1蒸馏,CoT语料质量飞升

本文从中兴通讯无线研究院「大模型深潜」团队切入,介绍了首创的「LLM自适应题目难度蒸馏」方法,该方法围绕「模型 - 数据动态匹配」提出了一条完整的CoT构建流程,显著提升了CoT语料的质量。

机器之心
产品应用8

百度网盘的阵势真不小

作者参加百度AI开放日,看到百度文库和网盘发布一系列AI新功能,已发展成一站式AI内容生产力平台。如全新AI相机功能多,GenFlow 2.0体验流畅,背后依托沧舟OS打通全链路。这反映泛内容创作降门槛趋势。

MacTalk
推荐文章7

这波AI淘金热里,卖“铲子”的公司正闷声发财,“征服"了几十家国内外巨头!

光轮智能联合创始人杨海波表示,AI发展让合成数据需求增大。该公司为具身智能行业提供3D合成数据,服务众多头部企业。其优势在于技术视野与路径独特,强调物理交互、人类示范等。还谈及创业要点与AI赛道变化。

AI前线
新闻资讯7

多模态爆发之后,谈 AI、IP 与漫剧

文章围绕AI漫剧展开,讲述其兴起动因,如技术突破、成本降低等;探讨IP创作该选成熟IP还是新IP;展望未来,认为它可能成主流,但要解决内容和技术难题;还提及工具平台与内容收益问题。

特工宇宙
产品应用8

当万相2.5刚开卷有声视频,7月已经发布音频一体化的百度蒸汽机又开卷视频了

百度升级MuseSteamer蒸汽机视频生成模型,可生成任意度视频,生成中能更新prompt交互创作。其技术规划前瞻体系化,成本低,在多行业有应用和商业化空间。

AI进修生
算法论文8

腾讯发布SpecExit算法,无损压缩端到端加速2.5倍!解决大模型思考效率难题

腾讯发布 SpecExit 算法,将思考早停与投机采样融合,利用轻量级草稿模型预测“退出信号”,在不引入额外探测开销的前提下,实现动态、可靠的思考早停,在 vLLM 上推理端到端加速 2.5 倍,准确性和推理效率得到双重保障。

机器之心