多模态通用智能」共找到 4542 篇相关文章

算法论文8

ICCV2025 | One image is all you need,多模态指令数据合成,你只管给图,剩下的交给Oasis

近年来多模态指令数据合成依赖人工设计提示词,成本高。本文提出 Oasis 方法,仅靠图像生成数据,打破传统输入模式,还开源代码库 MM - INF。实验显示其数据多样,能提升 MLLM 性能。

机器之心
开源动态7

比NotebookLM更好的「开源播客」,可根据多模态内容生成30分钟以上播客音频。

Podcastfy是开源Python工具,能把文本、图片等多模态内容,借生成式AI转化为播客。它支持自定义,适配多种语言和文本转语音模型,能生成2 - 5分钟或30分钟以上的播客,使用体验比NotebookLM好。

开源AI项目落地
开源动态8

AI 领域新动向!持续思考模型CTM横空出世:AI 向生物智能迈出重要一步

Sakana AI 推出新型 AI 模型 CTM,重新引入「时间」和「神经元动态」到 AI 计算核心。它有诸多创新,在迷宫探索、图像识别等任务表现出色,虽有训练慢等不足,但为 AI 向生物智能迈进提供新思路。

AI寒武纪
新闻资讯7

a16z全球AI产品Top100:AI入口之争已经打响,OpenClaw开启通用Agent时代

a16z发布全球AI产品Top100第六版更新,AI成主流默认功能,Gemini追ChatGPT凶猛,通用Agent登场。还介绍了各领域竞争态势、市场地理分布、创意领域演变等情况。

Founder Park
产品应用7

模力工场 035 周 AI 应用周榜:AI 正在走出通用叙事,进入细分人群与真实场景

模力工场 035 周 AI 应用周榜揭晓,前十应用展示 AI 向各领域渗透,正从通用大模型转向垂直细分场景。本周上榜应用呈现多趋势,如情绪陪伴类细分、内容生产类下沉、营销商业化具象化等。

AI前线
算法论文8

清华首提通用大模型滤波方法,实现零样本状态估计|NeurIPS'25

清华大学李升波教授团队在NeurIPS 2025提出LLM - Filter通用滤波器,将状态估计融入大语言模型推理框架。它能解决传统方法泛化性差问题,在未见过系统中实现零样本状态估计,有望成基础模型。

新智元
产品应用8

全球第二、国内第一!钉钉发布DeepResearch多智能体框架,已在真实企业部署

在数字经济浪潮中,企业对高效信息获取与决策支持需求迫切,但现有研究系统存在不足。阿里巴巴钉钉团队提出Dingtalk - DeepResearch多智能体框架,在评测中成绩优异,已在真实企业场景部署。

机器之心
算法论文8

LLM记忆管理终于不用“手把手教”了,新框架让智能体自主管理记忆系统

加州大学圣地亚哥分校和斯坦福大学研究人员提出强化学习框架Mem-α,用于训练LLM智能体自主管理记忆系统。它将记忆构建转为序列决策问题,采用多维度奖励函数,实验显示其全面超越现有方法。

量子位
算法论文8

ICML 2026|告别「单线程」思维,智能体进化出了原生的并行推理大脑

北京通用人工智能研究院语言交互实验室提出原生并行推理器NPR,它有「自蒸馏 + 并行强化学习」三阶段训练范式,配套并行推理引擎,让并行推理成模型原生认知能力,还介绍了其具体实现、实验结论等。

机器之心
新闻资讯7

半壁江山都来了!龙虾Hermes爆火后首场智能体大会两天议程公布,下周杭州见

2026中国AI智能体大会7月2 - 3日在杭州开幕,由智猩猩主办。有开幕式、论坛、研讨会等,60 + 位嘉宾参与。设展览区,多家企业展示产品。议程已敲定,报名通道临近关闭。

AI寒武纪