长文本翻译」共找到 1078 篇相关文章

产品应用8

当万相2.5刚开卷有声视频,7月已经发布音频一体化的百度蒸汽机又开卷视频了

百度升级MuseSteamer蒸汽机视频生成模型,可生成任意度视频,生成中能更新prompt交互创作。其技术规划前瞻体系化,成本低,在多行业有应用和商业化空间。

AI进修生
算法论文8

腾讯发布SpecExit算法,无损压缩端到端加速2.5倍!解决大模型思考效率难题

腾讯发布 SpecExit 算法,将思考早停与投机采样融合,利用轻量级草稿模型预测“退出信号”,在不引入额外探测开销的前提下,实现动态、可靠的思考早停,在 vLLM 上推理端到端加速 2.5 倍,准确性和推理效率得到双重保障。

机器之心
开源动态8

让世界模型推理效率提升70倍:上海AI Lab用“恒算力”破解时记忆与交互瓶颈

上海AI Lab联合多家机构开源Yume1.5,针对视频生成构建可交互“世界模型”的核心难题,提出时空信道联合建模(TSCM),实现近似恒定计算成本的全局记忆访问,展示了世界模型工程化落地的可行路径。

量子位
产品应用7

这个Skill可以消除文本中AI生成的痕迹,没了AI味的内容肯定会更受人喜爱。

AI创作大爆发,但其生成内容有“机械感”。介绍了可在Claude Code使用的Skill,能消除AI生成文本痕迹,还给出手动修改方法及原则,呼吁创作者用心改内容。

开源AI项目落地
开源动态7

可从表复杂文档中提取结构化数据的Python库agentic-doc,支持100+页PDF文档

LandingAI的Agentic文档提取API可从复杂文档提取结构化数据,Python库agentic-doc封装该API,支持100+页PDF文档,有自动重试、并行处理等功能,还能可视化调试。

GitHubStore
产品应用8

32倍加速,58秒搞定720p视频!字节发布离散自回归框架,统一视觉生成和视频生成

字节发布InfinityStar框架,将5秒720p视频生成时间从30多分钟缩至58秒,还支持多样任务。它基于对视频本质思考设计时空金字塔模型,将时空分离,通过多项技术优化,性能表现出色,不过也存在一些技术局限。

AIGC开放社区
算法论文8

ACL 2025 | 清华&港中文提出 MorphMark:全新理论视角破解大模型水印效力与文本质量的两难困境

随着大模型广泛应用,AI 生成内容追溯和版权保护成问题,现有水印技术面临效力与文本质量的矛盾。清华和港中文团队提出 MorphMark 自适应水印框架,动态调强度,在多模型实验中表现优。

深度学习自然语言处理
算法论文8

《TAML》好文推荐 | 来自清华大学张宇飞团队最新研究成果 基于文本生成翼型:FoilCLIP,一种语言驱动的气动设计新框架

传统翼型设计依赖CFD和风洞试验,成本高。清华大学张宇飞团队提出端到端双向映射框架FoilCLIP,通过对比学习建立文本与翼型几何双向映射,还提出数据增强策略,验证了其在语言驱动设计中的应用潜力。

力学与人工智能
产品应用8

DeepSeek-V4发布!高效百万上下文智能普惠时代来了

DeepSeek-V4发布,是开源社区关键分水岭。它解决超文本处理效率痛点,架构与优化有多项突破,降低算力消耗和成本,适配国产芯片,性能比肩顶级闭源模型,推动开源社区两大未来趋势。

AIGC开放社区
算法论文7

Transformer与RNN合体,谷歌打下显存门槛,解锁超上下文

谷歌论文提出 Memory Caching 技术,通过架构机制创新赋予 RNN「可生的记忆容量」,兼顾 Transformer 与 RNN 优势,能处理更文本、降低推理资源门槛,实验显示有良好效果。

机器之心