「多模态智能」共找到 4107 篇相关文章
首家AIOS落地来自vivo:个人化智能复刻人类思维,手机还能这样用
2025年vivo开发者大会展示全新端侧AI能力,提出蓝心3B端侧多模态推理大模型,融入OS底层,实现系统级智能。其AI OS打造“个人化智能”体验,还开放生态,携手开发者推动AI应用落地。
两位95后打造“伴身智能”硬件,获商汤国香、奇绩创坛千万元级投资|甲子光年
两位95后Jasper和Xander成立弦指科技推出智能戒指Wilo,获商汤国香、奇绩创坛千万元投资。他们想定义“伴身智能”,用戒指采集数据形成个人世界模型,还将搭建开放生态。
林俊旸离职后首度发声:万字复盘,大模型下一站「智能体式思考」
前阿里千问负责人林俊旸离职后发文,复盘大模型行业演进,指出 AI 大模型未来主线是智能体式思考。文中分析推理模型崛起的启示,探讨思考与指令融合难题,还阐述智能体式思维含义、强化学习基础设施挑战等。
2026 开年 AI 巨作!超强搜索智能体模型 MiroThinker 1.5 开源,慢思考做到了极致!
2026年开局,MiroMind团队开源超强搜索智能体模型MiroThinker 1.5。它不是“秒回型AI”,会深入研究后输出有引用、数据和逻辑的研报,以“慢思考”机制在深度任务上表现出色。
堆了一仓库GPU,却生产不出专业智能?九章云极用AI工厂给出解答
企业接入通用大模型到业务系统,却发现它难以执行任务。九章云极在发布会上推出‘AI工厂’战略,通过训练工厂和Token工厂填平执行鸿沟,前者用强化学习造专业模型,后者让专业智能规模化流通。
清华、西交联合开源发布了Cheers : 一条更简洁、更高效的统一多模态路线
清华、西交联合开源发布CHEERS,提出面向统一多模态理解与生成的架构路线,在保持系统简洁前提下,统一理解与生成任务,继承开源预训练模型知识,在多项基准测试中表现优异,还实现4× token压缩。
全球首个AI智能体「自进化」开源框架来了!一次部署,终生可用
英国格拉斯哥大学团队发布全球首个AI智能体自进化开源框架EvoAgentX,打破传统多智能体系统构建与优化限制。它有自动化构建、自进化机制和系统性评估亮点,实验验证其性能提升显著。
科学能力太强,这个多模态推理「六边形战士」被严重低估!Intern-S1开源登顶
7月26日,上海AI实验室发布并开源「书生」科学多模态大模型Intern-S1,其多模态能力全球开源第一,文本能力比肩一流,科学能力国际领先。它开创「通专融合」新范式,重构科研生产力,引发国际关注。
ICLR 2026|滑铁卢大学联合可灵提出UniVideo:统一视频理解、生成、编辑多模态
滑铁卢大学与快手可灵团队提出 UniVideo,是支持视频理解、生成与编辑的多模态模型。它采用双流架构,结合 MLLM 与 MM - DiT 能力,统一 10 个多模态任务,在多项基准超现有方法,代码已开源。
GPT-5,AI的「登月时刻」来了!奥特曼现场发布,三位一体博士级智能体
GPT-5正式发布,它是融合模型,准确性大幅提升,编程、写作等能力飞跃,语音模式升级,还有个性化功能,已介入医疗。API含三款模型,价格有竞争力,标志AI竞争转向「智能发布」。