长文本翻译」共找到 1078 篇相关文章

开源动态8

国产类脑大模型适配国产沐曦GPU!序列推理提速超百倍,仅用2%数据匹敌主流模型

中国科学院自动化所李国齐、徐波团队发布类脑脉冲大模型SpikingBrain (瞬悉)-1.0,借鉴大脑信息处理机制,适配国产沐曦GPU,序列推理提速超百倍,仅用2%数据匹敌主流模型,探索构建国产自主可控类脑大模型生态。

量子位
产品应用8

大神Karpathy都投的AI实时视频生成模型:直播都能立即转,无限时几乎零延迟

AI初创公司Decart推出首个零延迟无限实时视频生成的AI模型MirageLSD,大神Karpathy都投资了。它能实时生成视频流,无时限制且延迟低至40毫秒以下,还攻克了传统模型‘误差累积’难题。

量子位
开源动态8

小红书hi lab首次开源文本大模型,训练资源不到Qwen2.5 72B 的四分之一

6月6日,小红书hi lab团队首次开源文本大模型dots.llm1,采用MIT许可证。该模型激活参数量140亿,总参数量1420亿,上下文度32K。训练资源不到Qwen2.5 72B的四分之一,在多个测评中表现出色。

AI前线
开源动态8

李飞飞50亿美金赛道被开源!浙大教授章国锋带队创业,打造无限时实时3D世界模型

2024年李飞飞创立的World Labs入局空间智能赛道,估值达50亿美元。近日影溯发布并开源实时帧生成模型InSpatio - WorldFM,由章国锋领衔,该模型突破2D局限,效率高、能无限时推理,展现出高工程可用性。

机器之心
算法论文8

视频世界模型跑序列不「崩」了!用光流约束+历史记忆+多步训练,让动态场景稳如磐石

现有视频世界模型在时间交互中易出现运动不合理与场景崩坏问题,核心原因是误差累积。MagicWorld提出面向时稳定性的交互式建模框架,通过光流约束、历史缓存检索和多步聚合训练,有效缓解误差累积。

量子位
开源动态8

阿里开源14B电影级视频模型!实测来了:免费可玩,单次生成时可达分钟级

昨夜阿里发布14B视频模型Wan2.2 - S2V,仅需一张图片和一段音频,就能生成电影级数字人视频。该模型发布即开源,可在通义万相官网免费体验,单次生成时可达分钟级。

量子位
算法论文8

让AI像人类一样认知真实世界!UCLA谷歌强强联手,时记忆+3D空间理解超越基线16.5%

如何让AI在3D环境中像人类一样思考,是具身智能领域难题。UCLA与谷歌团队带来3DLLM - MEM模型与3DMEM - BENCH基准,让AI有构建、维护和利用时记忆能力,实验超基线16.5%,但有依赖模拟器预设的局限。

量子位
算法论文7

视觉优势还是语义依赖?揭秘 DeepSeek-OCR 高压缩率背后的真相

中科院等团队论文剖析 DeepSeek - OCR,通过实验揭示其高压缩率下准确率高或依赖语言先验。去掉语言先验,准确率暴跌;下游任务推理崩塌,文本处理也有瓶颈。

深度学习自然语言处理
推荐文章7

中学生就能看懂:从零开始理解LLM内部原理【十二】|位置嵌入 - 给模型装上"GPS"

文章指出Transformer对词顺序不敏感,引出位置嵌入概念。介绍经典的函数编码、可学习位置嵌入法及新主流RoPE,还提及为让模型处理文本,在RoPE基础上用PI和YaRN等扩窗技巧。

AI大模型应用实践
算法论文8

北大DeepSeek论文或预定ACL Best Paper!梁文锋署名

北大DeepSeek联合发布的NSA论文已被ACL 2025录用且评分高,有望冲击最佳论文。该技术革新传统注意力机制,提升算力效率,是文本处理的突破。此外,张铭教授团队还有多篇论文上榜。

新智元