长文本生成」共找到 2952 篇相关文章

产品应用8

Google 发布首个全模态 Embedding 2 模型,文本图片音视频 PDF 统一到一个向量空间

Google发布Gemini Embedding 2模型,它是业界首个原生支持文本、图片、视频、音频和PDF五种模态的Embedding模型,可将这些数据映射到同一向量空间,在多模态RAG、跨模态搜索等场景有应用,还介绍了跑分、用法、竞品、价格等情况。

AGI Hunt
8

成本暴降99%!万人大会系统全是AI生成的,Vibe Coding终于真上战场了

百度世界大会2025上,无代码对话式应用搭建平台“秒哒”升级到2.0,能全栈应用一键生成,综合成本降99%。它靠多智能体协作,整合百度生态,后端能力强,还发起黑客松大赛,海外版也上线。

量子位
产品应用8

创业一年后,李飞飞推出首款可商用世界模型 Marble,任意模态都可生成 3D 世界

李飞飞创业公司 World Labs 推出可商用世界模型 Marble,支持多模态输入,生成的 3D 世界更丰富细致。李飞飞认为空间智能是 AI 下一个前沿,当前 AI 在这方面能力不足,而 Marble 正推动其发展。

Founder Park
算法论文8

BIGAI & 中科大团队提出 MILR: 测试时隐空间推理,让图像生成学会「边想边改」丨ICLR 2026

BIGAI与中科大等团队提出MILR,通过测试时隐空间推理,在不更新模型参数下优化图文表示,提升复杂图像生成能力。该方法在多基准测试达SOTA,还探讨了测试时扩展与奖励模型,未来有诸多拓展方向。

AI科技评论
产品应用8

美团龙猫LongCat技术升级!新注意力机制解码速度快10倍,还能处理1M超文本

美团龙猫LongCat系列发布全新稀疏注意力机制LoZA,重点解决文本任务难题。它在MLA机制基础改造,计算复杂度降至线性,处理128K上下文解码快10倍,性能不缩水,后续还计划支持动态稀疏比例。

量子位
开源动态8

国产类脑大模型适配国产沐曦GPU!序列推理提速超百倍,仅用2%数据匹敌主流模型

中国科学院自动化所李国齐、徐波团队发布类脑脉冲大模型SpikingBrain (瞬悉)-1.0,借鉴大脑信息处理机制,适配国产沐曦GPU,序列推理提速超百倍,仅用2%数据匹敌主流模型,探索构建国产自主可控类脑大模型生态。

量子位
7

视频实时生成可交互! 两位自动驾驶大牛创业世界模型:40毫秒/帧,无需任何游戏引擎,人人免费可玩

李飞飞押注的世界模型领域有新成果,Odyssey公司由两位自动驾驶大牛创立。其AI无需游戏引擎,40毫秒/帧实时生成视频,玩家能实时交互。虽处于早期预览版,但已展现潜力,世界模型或成竞争热点。

量子位
新闻资讯8

李飞飞团队发布新一代世界模型Atlas:从零训练,一次性打通视频生成、 3D重建与机器人仿真

李飞飞创办的 World Labs 发布新一代世界模型 Atlas,称其为‘全球首个多模态世界模型’。它从零训练,能同时完成视频生成、3D 重建和时空模拟,已向少数伙伴开放测试,未来将成 Marble 底层模型。

DeepTech深科技
算法论文8

ACL 2025 | 清华&港中文提出 MorphMark:全新理论视角破解大模型水印效力与文本质量的两难困境

随着大模型广泛应用,AI 生成内容追溯和版权保护成问题,现有水印技术面临效力与文本质量的矛盾。清华和港中文团队提出 MorphMark 自适应水印框架,动态调强度,在多模型实验中表现优。

深度学习自然语言处理
新闻资讯8

又一华为天才少年入局具身创业!用视频生成数据训家用机器人,首个模型登顶具身基模榜单

又一华为天才少年周凯文加入具身创企诺因智能。该公司成立不到一年,专注ToC家用具身智能机器人,用视频生成数据训练模型,其KnowinBrain模型登顶具身基模榜单,团队人才密度高。

量子位