多模态智能体」共找到 4175 篇相关文章

新闻资讯7

刚刚,「PyTorch之王」携15亿薪酬杀回Meta!史上最贵AI天才巨星诞生

WSJ爆料,Thinking Machines联创、「PyTorch之王」Andrew Tulloch回归Meta,本人已内部信官宣。他曾拒15亿美元薪酬,此前在Meta干11年,后加入OpenAI。Meta斥资猛攻AI,四处挖角重组团队。

新智元
新闻资讯8

刚刚,英伟达官宣向OpenAI投资1000亿美元!用至少400万GPU打造超级AI巨兽

芯片巨头英伟达与AI巨头OpenAI官宣「联手」,将建立战略合作伙伴关系。英伟达将投资1000亿美元帮OpenAI建10吉瓦AI数据中心,含数百万块GPU,首阶段系统2026年下半年运营。

机器之心
产品应用8

AI 模特时代到来:字节x清华推出商用级视频换装模型DreamVVT,保真度显著领先SOTA

字节跳动智能创作团队联合清华推出视频换装模型DreamVVT,基于Diffusion Transformer构建,用两阶段设计解决复杂场景痛点,支持多种输入,在保真度和时序稳定性上领先SOTA。

机器之心
产品应用8

人手一个顶级家教!OpenAI深夜重磅:ChatGPT「学习模式」上线

OpenAI推出ChatGPT「学习模式」,旨在支持真正的学习。该模式从答案机变导师,通过定制指令实现智能教学,有交互式提示等特性,测试反馈积极,未来还会有更多功能。

AI寒武纪
新闻资讯8

编码器-解码器架构的复兴?谷歌一口气发布32个T5Gemma模型

谷歌在xAI吸引眼球时更新Gemma系列模型,发布多模态模型MedGemma,还一口气推出32个T5Gemma模型。该模型基于适应技术,性能表现佳,引发编码器 - 解码器架构复兴讨论。

机器之心
算法论文8

AI"学霸"也解不出高中题?耶鲁、复旦发布MMSciBench,揭示AI理科推理能力短板

耶鲁、复旦等推出MMSciBench评测基准,揭示主流模型复杂科学推理短板。它有高质量数据、多模态多题型测试和精细知识分类系。测试发现模型图文融合及推理能力弱,英文推理或效果更好。

深度学习自然语言处理
算法论文8

破解「个性化学习」长尾难题,巧用神经坍缩理论 | ICML 2025

当前个性化学习方法基于数据高质量且类别平衡的假设,但现实教育数据呈不均衡分布。华东师范大学和浙江大学团队在ICML2025提出NCAL方法,将神经坍缩理论引入该领域,解决教育数据长尾分布问题。

新智元
开源动态8

文心大模型 4.5 系列正式开源,涵盖 10 余款模型

6月30日,百度正式开源文心大模型4.5系列,含10款模型,实现预训练权重和推理代码全开源。可在飞桨星河社区等平台下载,百度实现框架与模型“双层开源”,技术创新多,性能表现优。

AI前线
开源动态7

字节开源了一个了不得的模型!

字节跳动开源统一多模态基础模型BAGEL,一个模型能同时理解和生成文本、图像、视频。部署测试有亮点但效果不稳定,还分享该模型验Demo、地址及安装使用教程。

探索AGI
开源动态8

字节跳动&清华大学开源多模态时序大模型ChatTS,可实现时序数据对话与推理

字节跳动与清华合作开源多模态时序大模型ChatTS,可实现时序数据对话与推理。它用合成数据训练,解决了数据稀缺等问题,在评估中表现远超基线模型,未来可拓展至更高阶任务。

机器之心