多模态体验」共找到 1618 篇相关文章

新闻资讯8

比豆包手机还狠!Gemini电视登场CES,谷歌打响客厅革命第一枪

2026年CES上科技新品频出,谷歌将Gemini AI引入Google TV,让电视具备自然语言内容发现与推荐、教育深度学习等功能,还增强语音控制能力,打响客厅AI革命第一枪,同时涂鸦智能展示了AI生活助手等产品。

新智元
新闻资讯7

AI翻译的「最后一公里」

文章指出文化差异成AI翻译难题,通用大模型数据不平衡,存在“算法霸权”。如处理低资源语言,AI易产生幻觉,还因无肉身难理解基于生理体验的隐喻,人机协作才是翻译未来。

新智元
开源动态8

搅局者来了!智谱重磅开源AutoGLM,让“豆包手机”人人可造!官方:AI手机不该掌握在少数厂商手中

智谱团队将核心AI Agent模型AutoGLM完整开源,它有手机操作能力,支持上百主流APP。智谱认为AI手机是趋势,不应被少数厂商垄断,开源还能解决隐私问题,复用技术经验。

AI前线
开源动态8

美团开源全模态,比肩顶级闭源模型,开源新SOTA

美团LongCat团队发布5600亿参数开源全模态模型LongCat - Flash - Omni,它有端到端全模态架构,能实现毫秒级实时音频 - 视觉交互。该模型训练采用渐进式策略,工程上有高效技术支撑,在多基准测试表现出色。

AIGC开放社区
算法论文8

AEPO:智能体熵平衡策略优化,让探索更稳,推理更深!

中国人民大学与快手团队联合提出 AEPO 算法,解决熵驱动式智能体强化学习训练不稳等问题。它设计两项核心机制,在 14 个基准上优于主流算法,在 X 等平台获高关注。

机器之心
开源动态8

超越谷歌Banana,字节联合香港中文大学等高校开源最强图像编辑生成系统DreamOmni2

香港多高校与字节跳动联合研发的DreamOmni2系统,实现图像编辑与生成领域SOTA。它用三步造出高质量数据,提出索引编码等方案,联合训练模型,实际效果超越部分商业模型,为AI创作带来新可能。

AIGC开放社区
新闻资讯7

不只是行业 Know-How,营销类 Agent 工程化落地难题有何解?|对话瓴羊副总裁、友盟+总经理毛波

今年是“AI Agent 元年”,营销 Agent 热门但有难题待解。InfoQ 对话瓴羊副总裁毛波,探讨营销 Agent 落地困境、工程化挑战、未来护城河及发展机会,友盟+推出产品并提供方案助力解决问题。

InfoQ
新闻资讯7

永别了,人类冠军!AI横扫天文奥赛,GPT-5得分远超金牌选手2.7倍

国际天文与天体物理奥赛(IOAA)中,GPT - 5和Gemini 2.5 Pro完胜人类选手。俄亥俄州立大学团队考察五大顶尖LLM,发现它们大多达金牌水平,但在几何、时空推理等方面有困难。

新智元
开源动态8

开源仅一周,鹅厂文生图大模型强势登顶,击败谷歌Nano-Banana

腾讯混元团队开源的原生多模态生图模型混元图像 3.0,开源仅一周就在国际权威评测榜单 LMArena 上超越谷歌 Nano - Banana 等,位列文生图综合和开源榜单第一。实测表现出色,技术上也有诸多创新。

机器之心
新闻资讯7

英伟达斥资50亿美元入股英特尔

18日,英伟达与英特尔宣布深度合作,联合开发产品。英伟达将斥资50亿美元入股英特尔,双方以NVLink技术连接架构,合作聚焦数据中心和个人计算领域,旨在提升运行效率,填补产品空白。

芯师爷