全模态技术」共找到 4327 篇相关文章

推荐文章7

技术狂飙下的 AI Assistant,离真正的 Jarvis 还有几层窗户纸?

随着AI技术进入新阶段,LLM面临新天花板,市场呼唤从「会聊天」迈向「能行动」的下一代AI Assistant。文章从智能规划与调用等维度分析其发展挑战,介绍不同技术路径并分析优劣势。

机器之心
产品应用8

360安云架构解,AI智能体如何开启「主驾」新时代?

AI发展加速,网络安危机加剧。360安云在ISC.AI 2025大会发布新产品,提出“安即服务”理念,打造AI驱动的四层架构,发布三大类智能体,为企业提供生命周期价值交付的安服务。

甲子光年
新闻资讯7

以示范应用推动技术迭代|“幻镜”AI视听测评季正式开启!

8月19日,“幻镜”AI视听测评季在首创·郎园Station启动,由多方指导与主办。它采取“AI作品创作征集+技术测评”结合模式,首季征集“我AI北京”主题作品,将促进视听技术迭代。

郎园Station
新闻资讯7

扒一扒Meta新大模型Muse Spark里藏着的PDR技术

Meta发布闭源大模型Muse Spark及‘沉思模式’,背后藏PDR推理技术。该技术通过‘并行起草+精炼’突破性能瓶颈,对比传统长CoT范式优势明显,在AIME竞赛题目测试中准确率显著提升。

PaperAgent
开源动态8

3万小时触觉数据补齐具身智能“手感”!新智具身&复旦大学技术报告三连发

上海新智具身联合复旦发布三份技术报告,将触觉跃升为具身智能核心基建。包含统一触觉数据格式并构建3万小时语料库、以触觉预判赋能VLA、在世界模型重构触觉想象等内容,项目数据和模型将开源。

量子位
算法论文8

Stream-Omni:同时支持各种模态组合交互的文本-视觉-语音多模态大模型

中国科学院计算技术研究所团队提出文本-视觉-语音多模态大模型Stream-Omni,能支持多种模态组合交互。它对各模态关系针对性建模,实现高效灵活的模态对齐,仅用少量语音数据就有多种交互能力。

机器之心
推荐文章8

AIGC生命周期业务风控白皮书,从备案到运营的合规与安实践

2025年《人工智能安治理框架》2.0版发布,凸显AI安重要性。数美科技发布《AIGC生命周期业务风控白皮书》,构建生命周期业务风控体系,涵盖备案攻略、评测要点、账号与内容风控等,还有实战案例。

InfoQ
开源动态8

华为开源突破性技术Flex:ai,AI算力效率直升30%,GPU、NPU一起用

11月21日,华为发布AI容器技术Flex:ai并联合高校将其开源。该技术基于Kubernetes构建,有三大核心突破,能提升算力利用率,异构兼容性优于Run:ai,将推动国产算力应用。

机器之心
新闻资讯7

Agent Token焦虑:当每次对话都在「烧钱」,技术如何破局?| GAIR Live 029期预告

GAIR Live 029 期线上圆桌将直击 Agent Token 焦虑的底层技术逻辑,邀请技术负责人从架构重构与系统优化双重视角,拆解 Claw 类产品如何从烧钱走向省钱。探讨成本解剖、架构升维、系统优化等核心议题。

AI科技评论
产品应用8

跨越智能体落地的可信鸿沟:玄甲(AgentWard)链路防御操作系统正式发布

大模型向自主智能体演进,安威胁域化。当前安方案有局限,制约产业落地。清华大学团队推出玄甲链路安防御操作系统,构建五层纵深防御体系,已落地应用,降低安事件发生率,筑牢安防线。

机器之心