「全模态模型」共找到 8900 篇相关文章

算法论文8

告别盲选LLM!ICML 2025新研究解释大模型选择的「玄学」

弗吉尼亚理工大学研究团队提出 LensLLM 框架,基于 PAC - 贝叶斯泛化界限揭示 LLM 微调性能“双相演进”,可精准预测微调性能、大幅降低计算成本,为 LLM 选型提供新工具。

机器之心
新闻资讯8

从大模型到智能体:50+ 头部企业的 AI 进化实践

2025年AICon全球人工智能开发与应用大会6月27 - 28日在北京举办,50余家机构专家围绕AI Agent等前沿技术探讨落地实践与趋势。极客邦等企业代表分享应用布局,还有5大主题演讲、14个技术专场和50多个标杆案例。

InfoQ
产品应用8

AI版Office全网首测,键盘鼠标彻底退休!打工人沸腾

昆仑万维天工超级智能体(Skywork Super Agents)结合Deep Research和通用Agent优点,带来AI版office。它有超能Office「六件套」,六大卖点亮点足,具五大自研硬核实力,填补市场空白,有望成智能体赛道黑马。

新智元
产品应用8

实测腾讯Hunyuan-Image2.0,首个毫秒级实时图像生成模型

今天上午腾讯发布混元图像2.0,以“更智能、更开放、更中国”为理念。其参数规模提升,推理时间大幅压缩,实现毫秒级实时生成,还在画面质量等方面升级,新增实时绘画板功能。

带你学AI
产品应用7

全网实测开玩Fable 5.1,听说写作说话和真人没区别?

Anthropic发布Fable 5.1后,第三方跑分和个人实测出炉。ARC Prize测试成绩佳且成本降32%,网友用它做出多款游戏。科技媒体Every全面测评,指出其多方面优势与设计等短板,并给出使用边界。

量子位
新闻资讯7

又一位xAI联创宣布创业,押注开源模型和个人AI,融资11亿美元

8月11日,xAI联合创始人伊戈尔·巴布什金创办的River AI完成11亿美元融资。该公司6月成立,团队约20人,刚公开首个产品River API。巴布什金想让企业和个人拥有自己的AI,目前先从企业需求切入。

DeepTech深科技
新闻资讯8

ICML 2026现场最全索引:从快手到大厂,中国企业集体出征

ICML 2026 于7月6 - 11日在韩国首尔召开,投稿量翻倍,录用率26.6%。中国企业全面出击,快手、阿里千问等入选多篇论文,现场活动丰富。中国机构研究呈现从发论文到做现场、单点到系统布局、聚焦效率等趋势。

AI科技评论
算法论文8

把VLM塞进隐式世界模型,小鹏机器人新框架让机器人长出物理直觉

机器人大脑架构中VLM和VAM路线各有短板,香港大学、小鹏机器人等团队提出DIAL框架,让VLM在原生特征空间做隐式世界建模,解耦认知决策与底层执行,在机器人部署中表现优异。

量子位
产品应用7

打工人五一自救指南:把活全甩给AI,准备免打扰出门

五一将至,为避免假期工作内耗,可安装百度智能云打造的AI助手DuMate。它支持多模态理解与生成,能跨应用完成复杂任务。经测试,它可高效处理整理文件、生成报告等工作,还能并行处理多项任务。

量子位
开源动态8

「被动感知」到「理解接触」!它石智航重磅发布OmniVTA视触觉世界模型

它石智航联合六大顶尖机构推出OmniVTA视触觉操作框架和OmniViTac大规模视触觉数据集。该框架核心是从被动感知到主动预测触觉,通过多模块协同让机器人有预测、理解和修正能力,实验表现优。

新智元