多模态生成模型」共找到 8810 篇相关文章

开源动态8

智能必须基于世界模型?我们和蚂蚁灵波团队聊了聊

上周图灵奖得主 Yann LeCun 认为真正的智能应能在脑海推演,而大语言模型难以触及真实世界。2026 年初,蚂蚁灵波连续四天开源四款具身智能模型,探索从物理交互构建智能的新路径。

机器之心
推荐文章7

2026 将近,世界模型到底更「世界」了吗?

近期 Runway 发布相关产品,让「世界模型」讨论再聚焦。其定义从强化学习语境延伸,业内理解不断变化,概念边界变模糊。如今被推到和 LLM 同级,出现概念同名但内核分裂现象。

机器之心
新闻资讯7

苹果计划明年为Siri引入AI搜索功能,可能采用Gemini模型

据彭博社报道,苹果计划明年为Siri引入AI驱动的网络搜索功能,称“世界知识答案”,将以多媒体形式汇总结果。苹果正测试Google模型,或由其提供支持,此前还考虑过Anthropic的Claude模型但未达成协议。

AI工程化
新闻资讯8

阿里一口气发了N款新模型,让我们向源神致敬。

阿里云栖大会发布众多模型,有Qwen3 - Max、Wan2.5等。Qwen3 - Max对标顶尖模型;Wan2.5支持音画同出;Qwen3 - VL是强大视觉语言模型且已开源;Qwen3 - Omni是全模态模型。此外还有多个新模型,构建全场景生态。

开源星探
算法论文8

文言文秒杀所有大模型!100%攻击成功,轻松突破安全防线

南洋理工等机构团队提出基于文言文语境的自动化黑盒测试框架CC - BOS,利用果蝇算法和8维策略空间,暴露主流大语言模型安全盲区,实验显示对6款主流模型攻击成功率达100%。

AIGC开放社区
新闻资讯8

DeepMind一篇论文终结十年之争!GPT-5推理靠世界模型

GPT-5上线后推理能力惊人。最新研究揭示通用智能体聪明的原因是长出“世界模型”,终结了学界十年关于AI靠模仿还是思考的争论,实验也验证了世界模型对智能体的必要性。

新智元
算法论文8

98%准确率!这个双分支AI模型,精准识别木薯叶病害(附代码)

2026年3月论文DenseSwinV2提出双分支AI模型,结合CNN与Transformer,加通道注意力模块突出病害特征。该模型分类木薯叶病害准确率达98.02%,还给出简化版代码,有落地价值。

机器学习AI算法工程
开源动态7

直播预约 | LightMem:面向大模型的轻量化可插拔记忆系统

本报告聚焦大语言模型长期记忆构建与轻量化机制。现有外部记忆系统有记忆臃肿、组织低效、更新代价高问题。为此提出LightMem架构,能为大模型提供轻量、高效、可扩展记忆组件。

深度学习自然语言处理
新闻资讯7

“龙虾”时代,大模型公司的好日子来了

3月10日,MiniMax港股收涨,市值超百度。OpenClaw爆火,其创始人转发评测榜单,使MiniMax-M2.1排名突出。OpenClaw是智能体构建框架,为大模型公司带来盈利转机,撬开收入天花板,引发各方关注。

远川科技评论
开源动态8

单卡2秒生成一个视频!清华联手生数开源TurboDiffusion,视频DeepSeek时刻来了

清华大学TSAIL实验室和生数科技联合开源视频生成加速新框架TurboDiffusion,能让视频生成在保证质量下最高提速200多倍,单张显卡就能运行,还整合四项关键技术,有诸多应用意义。

开源星探