多模态信息」共找到 1533 篇相关文章

算法论文8

ACL 2026|打破推理同质化!阿里达摩院新作让RLVR从重复采样走向有效探索

阿里达摩院智能决策团队提出面向RLVR后训练的探索增强框架I²B-LPO,改进rollout策略,在关键节点生成更具区分度的推理轨迹,结合信息瓶颈自奖励机制,在多个数学基准上提升准确率与语义多样性。

机器之心
产品应用7

打工人五一自救指南:把活全甩给AI,准备免打扰出门

五一将至,为避免假期工作内耗,可安装百度智能云打造的AI助手DuMate。它支持多模态理解与生成,能跨应用完成复杂任务。经测试,它可高效处理整理文件、生成报告等工作,还能并行处理多项任务。

量子位
新闻资讯7

Meta 143亿挖角后首个作品来了:Alexandr Wang 推出闭源模型,杨立坤点赞

沉寂9个月后,Alexandr Wang带队的Meta发布新一代模型Muse Spark。它是原生多模态推理模型,性能媲美Gemini Pro和GPT 5.4,Meta还披露技术实现细节。不过闭源引争议,且模型在长时程智能体等方面有短板。

AI前线
产品应用8

Sora被拉下神坛:PixVerse这款AI视频工具用最低价拿下全球质量第一

所有人以为Sora是AI视频生成天花板,但现在质量排名第一的是PixVerse,它登顶Product Hunt日榜第一。其质量评分超Sora 168分,价格还低20%,且在多方面升级。大众仍认为Sora最强有认知、品牌、信息等因素。

AI Reading Hub
开源动态8

AI能帮忙厨房看火了!面壁智能开源全模态模型MiniCPM-o4.5,边看边听还能主动抢答

面壁智能开源全模态模型MiniCPM-o4.5,能边看边听还主动抢答。它引入全双工多模态实时流机制,在多方向达全模态模型领先水平。该模型是端侧原生,将与开发板配套,助力端侧智能硬件开发。

量子位
推荐文章8

当顶级视频模型半衰期只有 30 天,fal.ai 为什么收入反而一年增长 60 倍?

在生成式媒体技术发展背景下,fal.ai 作为生成式媒体 infra 公司迅速崛起。它通过统一 API 与云端平台提供多模态模型调用能力,2025 年收入增长 60 倍并完成融资。文章解析其如何构建护城河及对行业发展的判断。

海外独角兽
开源动态8

当LeCun还在「画饼」,中国AI大牛领先李飞飞一步把世界模型开源了

具身智能突破「遥操作」数据桎梏,商汤联合创始人王晓刚领衔的大晓机器人发布全球首个开源商业落地世界模型「开悟3.0」。它是多模态理解 - 生成 - 预测一体化,有强物理感知力,还解决了空间感和时间记忆问题。

新智元
新闻资讯8

2025 智能体元年,Agent 开发平台深度评测报告解读

2025 年 AI 产业两大核心趋势并行,AI Agent 产业化落地提速。国家工业信息安全发展研究中心赛昇实验室发布评测报告,对阿里云百炼等四大 Agent 开发平台从 RAG、工作流能力、Agent 工具调用三大维度测试,为行业选型提供参考。

特工宇宙
新闻资讯8

从 CIPS & CLM 迈进:中国大模型的智能跃迁

中国中文信息学会2025学术年会暨第二届中国大模型大会(CIPS & CLM 2025)于10月28日在北京召开,众多专家学者参会。大会聚焦大模型多方面内容,发布“大模型基金”,举办多场报告与论坛,展现中国AI领域进展。

AI科技评论
新闻资讯7

就在刚刚,ChatGPT发布了一个新功能Pulse

北京时间凌晨,山姆·奥特曼宣布 OpenAI 为 Pro 用户上线 ChatGPT Pulse 预览版,后续会扩展到 Plus 用户及所有人。Pulse 核心是主动推送个性化更新,能结合多信息生成内容,但需用户开放大量个人数据,隐私问题值得关注。

MacTalk