多场景应用」共找到 6433 篇相关文章

开源动态8

通义实验室正式开源 Mobile-Agent v3.5 及新一代平台 GUI Agent 基座模型 GUI-Owl-1.5

通义实验室正式开源 Mobile - Agent v3.5 及新一代平台 GUI Agent 基座模型 GUI - Owl - 1.5。该模型有档参数可选,分 Instruct 和 Thinking 版,支持平台。它解决了高质量数据难搞定等痛点,评测表现良好。

深度学习自然语言处理
新闻资讯8

老黄在CES 2026 上预言:将要告别应用软件的预编译时代,未来的应用是 GPU 上实时生成每一个像素

黄仁勋在CES 2026预言,应用将告别预编译时代,在GPU上实时生成像素。他回顾2025年AI关键进展,介绍Agentic AI特点与能力,还谈了其搭建及应用前景,指出未来软件或基于Agent交互。

宝玉AI
新闻资讯7

至简动力交付百台「开箱即用」机器人,加速具身量产节奏

2026年7月6日,至简动力宣布完成首批百台i7 Pro机器人交付,落成CNC智能化产线。其产品定位‘开箱即用’,适配场景。但行业仍处早期,至简面临跨场景成本、数据飞轮、产能等问题待解。

AI科技评论
开源动态7

爆火开源AI画布,真正可落地的手写AI黑板

文章推荐开源AI画布PenEcho,它是个超智能黑板,适合学习场景,让手写与AI共生。能理解内容及空间关系,把回答放回画布,支持模型,还具备种功能。

开源AI项目落地
开源动态7

火遍全网的AI在线生成前端页面DeepSite开源替代LocalSite

LocalSite AI是现代化网页应用,能按自然语言描述生成HTML、CSS和JavaScript代码。它功能丰富,支持AI供应商,介绍了技术栈、安装步骤、部署方式、使用指南及发展路线等。

GitHubStore
新闻资讯7

每周产业洞察 | AI影视文艺复兴已至,未来24个月内容供给将迎结构性变化

北京AIGC视听产业创新中心位于朝阳区,由方参与、首创郎园负责运营,通过六大服务平台促进成果转化与场景落地。截至2025年8月已汇聚60余家生态伙伴,首创郎园拓展地业务。

郎园Station
推荐文章8

直播预约 | Evaluation论文分享@ICML&ACL2025

2025年6月11日20:00将直播分享Evaluation论文。位嘉宾参与,涉及SyncPL奖励建模、文本事实一致性验证、大模型评测方法等领域论文,涵盖模型优化、基准测试等内容。

深度学习自然语言处理
产品应用8

大涨240%,Doc-Researcher确立模态文档深度研究新范式

在ChatGPT引领的AI革命中,大语言模型面对专业复杂文档常“束手无策”。Doc-Researcher提出三位一体解决方案,构建M4DocBench评测,性能远超现有方案,还适用于产业场景

PaperAgent
算法论文8

国产模态Agent拿下医学分割SOTA!不用改模型、不加token | 浙大&上海AI Lab

现有医学模态大模型在分割生物医学图像时存在瓶颈,浙大蔡钰祥教授、上海AI Lab江彦开等人提出IBISAgent框架,将分割定义为步视觉决策过程,实验显示其在数据集上大幅领先对比方法。

量子位
开源动态8

腾讯重磅开源!端到端视频音效生成模型HunyuanVideo-Foley

腾讯混元正式开源端到端视频音效生成模型 HunyuanVideo-Foley,适用于场景。它采用新型框架结合 REPA 策略,有三大核心优势,能适配场景,抑制底噪,保证音频保真度。

带你学AI