「多场景应用」共找到 6445 篇相关文章
音频全能王炸!小米MiMo-Audio开源,力压Gemini/GPT-4o!
小米团队开源通用音频大模型MiMo-Audio,集多种功能于一身,支持7国语言零样本克隆和中英混合合成。首包延迟低,效果自然稳定。在多个基准测试中表现优于Gemini-2.5-Flash和GPT-4o-Audio。
太空中的两重辐射威胁,一张薄膜就能全挡住
韩国科学技术研究院团队开发出新型复合材料,将两种纳米管组合,在单层超薄结构中实现对电磁波和中子辐射的屏蔽,为多领域提供轻量安全方案,但应用落地面临性能落差、成本等挑战。
斯坦福开源复杂推理AI Agent,融合超10种工具
传统AI助手应对复杂任务能力有限,斯坦福开源OctoTools,这一复杂推理AI Agent融合11种工具。它在16项基准测试中准确率高,能应对多领域复杂场景,框架含工具卡片、规划器等构件。
预测误差仅0.26mm,中科院自动化所×灵宝CASBOT团队让机器人提前“知道你要干嘛”
中科院自动化所与灵宝CASBOT提出DTRT方法获ICRA 2025录用。该方法利用Transformer和博弈论,将人类动态纳入长期预测,实验显示其预测精度和协作表现显著优于现有技术,有巨大应用潜力。
大模型时代,通用视觉模型将何去何从?
过去通用视觉模型(VGM)是研究热点,想实现‘视觉模型大一统’。但大语言模型发展使研究热点转移,视觉‘独立性’被重新定义。清华鲁继文团队综述梳理其进展,探讨现状、挑战与应用潜力。
98%财务顾问依赖AI,揭秘7家先锋企业如何解锁商业新格局
OpenAI报告剖析7家前沿公司应用AI经验。如摩根士丹利评估后让98%财务顾问用OpenAI;Indeed用GPT - 4o mini优化职位匹配;Klarna用AI客服助手提升效益等,展示AI重塑企业运营的潜力。
2026中国AIGC最值得关注的企业&产品图鉴来了!谁在造浪,谁在落地?
中国生成式AI穿越产业深水区,焦点转向应用落地。第四届中国AIGC产业峰会发布2026年度值得关注的AIGC企业与产品榜单,覆盖全产业链环节与多赛道,为从业者锚定方向。
刚刚,Anthropic 发布 Claude for Life Sciences,目标生物科研全流程
Anthropic推出Claude for Life Sciences,全方位布局生命科学领域。它配备Skills功能,生物学测试表现提升,能解读图像、分析数据。还深度整合科研生态,应用场景广,获众多药企、学术机构青睐,还有AI for Science计划。
企业数字化转型新引擎:MCP + LLM + Agent 架构赋能!
本文介绍MCP(Model Context Protocol)模型上下文协议,它是Anthropic于2024年11月底推出的开放标准,可统一大模型与外部数据源和工具通信协议,打破数据孤岛,有诸多优势,还适用于多个场景。
首个面向柔性衣物灵巧操作的仿真平台来了,北大、伯克利联合发布
北大和伯克利联合发布首个面向柔性衣物灵巧操作的仿真平台 DexGarmentLab。它基于 Isaac Sim 4.5.0 搭建,有多样化场景、自动化数据采集管线和泛化能力强的策略框架 HALO,可推动柔性物体操作应用。