「多模态数字人」共找到 2212 篇相关文章
Ray异构融合底座重构数据管道:架构演进与万卡落地实践
文章指出大模型发展下,传统大数据引擎在多模态数据处理局限性凸显。腾讯基于Ray构建新一代数据管道,介绍了云原生调度与计算范式融合架构,详述容错、资源利用等方面优化实践,展示了重构收益。
老黄All in物理AI!最新GPU性能5倍提升,还砸掉了智驾门槛
英伟达CEO黄仁勋在CES 2026发布AI新品,全力搞AI。推出下一代Rubin架构GPU,性能大幅提升;发布五大领域成果,含新模型家族、平台等;还开源训练框架与多模态数据集,国产开源模型被提及。
卡帕西推荐的AI Coding指南:3招教你效率翻倍
大神卡帕西和OpenAI总裁转发推荐的AI Coding指南,由Peter Steinberger撰写。指南给出三大关键策略,即按任务类型选对模型、重构工作流、做好人机分工,还分享实用小技巧。
12月,我们推荐这 7 款 AI 新品
极客公园创新大会为7款AI新品策划线下发布会。包括笔记产品flomo、AI相机Doka等,各产品创始人分享理念,如flomo不做AI润色,Doka让AI仅作拍照辅助等。
用了飞书aily新功能,我终于理解什么叫“AI不是聊天,是干活”
作者黄叔体验飞书 aily 工作助手的“任务模式”后赞不绝口。该模式能异步工作、深度结合飞书生态,可像数字员工一样交付多种成果,如竞品报告、网页、海报、播客等,虽有不足但非常实用。
思维链推理是一种脆弱的‘海市蜃楼’,一旦超出训练分布,它便会消失。| 直播预约
思维链提示能提升LLM在多任务上的表现,让人感觉模型在深思熟虑。但研究从数据分布角度剖析,发现思维链推理是脆弱的‘海市蜃楼’,超出训练分布就会消失,强调实现通用推理能力挑战大。
谷歌用Gemini 3同时革了OpenAI和英伟达两家的命
谷歌发布Gemini 3全家桶,打断英伟达和OpenAI双赢美梦。它实现原生多模态,对OpenAI构成代际优势;用TPU训练模型,摆脱CUDA依赖,冲击英伟达算力神坛。谷歌全栈自研,其发展或改变AI格局。
太炸裂了!全网实测Nano Banana Pro,网友:这模型里到底装了什么鬼东西!
谷歌Nano Banana Pro出世引发全网关注,它又名Gemini 3 Pro Image,整合多模态理解能力与知识库。普通用户可在Gemini应用免费体验,实测显示其实力强悍,还在网友手中玩出花,谷歌CEO也站台。
30秒,我用蚂蚁灵光复刻了个支付宝(doge)
蚂蚁集团推出全模态通用AI助手灵光,最快30秒生成私人定制小APP,可编辑交互分享。实测其功能丰富且专业,实现多模态输出和多智能体协作。还对比了与千问区别,介绍蚂蚁AGI布局。
将导游装在口袋里:AI 对景区游览新赋能
同程旅行研发的“同程伴游”AI助理,能为景区游客答疑解惑,实现原生数字化导览。它可按需讲解、避免走回头路,还能生成数字旅行日记。其基于高精度定位和大语言模型,未来还将持续升级。