「多模态数字人」共找到 2200 篇相关文章
大模型被曝传染病!可传递邪恶于无形
研究发现AI模型能通过数字序列把“性格特征”传染给其他模型,如动物偏好、恶意等。验证表明数字中无明显规律,且传染依赖模型深层相似性。此现象为AI开发敲响警钟,也引发对AI意识等的讨论。
AI修真的一年:学者们怎么看“真智能”?|甲子光年
甲子光年在年终盛典对话三位学者,探讨AI“真假智能”。学者们提及强化学习、推理、多模态等技术突破,分析研究路径,还谈选择标准与未来期待,指出AI是工程实践命题,真与假关乎信念选择。
RL训练总崩溃?R1-Reward稳定解锁奖励模型Long-Cot推理能力
多模态奖励模型对提升多模态大语言模型表现至关重要,但强化学习在奖励建模应用有挑战。快手等团队提出R1 - Reward,解决训练不稳定等问题,在基准上超SOTA模型,还在快手业务场景成功应用。
社区供稿 | Jina Embeddings V4: 为搜索而生,多模态多语言向量模型
Jina AI发布多模态向量模型jina-embeddings-v4,参数38亿,能同步处理文本与图像。内置LoRA适配器强化检索等任务表现,在多基准测试中展现顶尖性能,支持单/多向量表示。介绍了架构、上手指南等。
极客说|AI Sales Avatar 探索
本文介绍名品车AI数字导购Vendy搭建过程,以TEN平台为中枢,集成Agora、Azure等五大平台,构建具备听、说、想、演能力的AI数字销售助理,还给出后续扩展建议,推动企业AI转型升级。
vivo突破手机AI部署难题,绕开MoE架构限制,骁龙8 Elite流畅运行|ICCV 2025
在AI多模态时代,‘让大模型上手机’成焦点。现有MLLM在手机端部署有难题,vivo AI研究院等团队提出GenieBlue方案,绕开MoE架构限制,在骁龙8 Elite芯片手机流畅运行,保持语言性能同时实现多模态表现。
The Batch: 944 | Llama 之后的时代
Meta发布首个AI模型Muse Spark,是多模态推理模型,在部分健康和多模态测试领先,编程与智能体任务有不足。Meta披露技术细节少,该模型基准测试有竞争力,但其从开放转向封闭引开发者担忧。
【访谈】在黑箱中寻找自我显影——对话苏仲尧|三影堂厦门
苏仲尧个展《打开黑箱说亮话》聚焦摄影人机互动,引向对‘技术黑箱’思考。创作分三阶段,从文字照片到金属板,再结合AI。他将创作主导权回归自身,借作品探讨技术与人关系及当下处境。
谷歌痛失王座?港科大贾佳亚团队DreamOmni2开源,超强P图暴击Nano Banana
港科大贾佳亚团队开源DreamOmni2,该模型基于FLUX Kontext,能处理多参考图像,在多模态编辑与生成上表现出色,超越谷歌Nano Banana等模型,还构建了新测试集与数据构建范式。
英伟达给黄仁勋儿女涨薪了!年薪百万美元,“凭能力而不是身份”
英伟达向美国SEC提交的2026财年委托投票说明书显示,黄仁勋女儿Madison、儿子Spencer的总薪酬分别达123.2万和132万美元。英伟达称两人薪资评定与黄仁勋无关,二人能力出色,一路晋升。