「多模态应用」共找到 2968 篇相关文章
微软 CTO 在 Rust Nation UK 大会上详解成功经验、挑战及对 Rust 编程语言的承诺
微软Azure首席技术官Mark Russinovich在Rust Nation UK大会探讨推动Rust采用的因素,展示微软产品中Rust应用成果,介绍用生成式AI加速C/C++向Rust迁移的努力,还提及开发者反馈及微软对Rust的承诺。
开源模型两个月内杀死比赛
过去60天,Vercel AI Gateway调用数据显示,开源模型Token调用份额从28%涨至62%,反超闭源模型。英伟达60亿美元入局扶持,闭源虽推新降价仍失领先,开源走向大规模应用。
这张信息图,居然是8B开源模型做的??
商汤新开源的 8B 多模态模型 SenseNova U1,架构独特,图像评测表现好,信息图生成能力强、延迟低。它具备图文交错能力,适合自媒体、敏感行业等,有在线体验和开源代码入口。
关于具身智能「触觉」,你想知道的都在这篇综述里了
本文由香港科技大学(广州)熊辉教授团队牵头,联合多所高校,全面梳理截至2026年第一季度具身智能触觉前沿研究。介绍触觉重要性、多模态触觉融合流程、全景蓝图,指出面临挑战并展望未来。
哈萨比斯:DeepMind才是Scaling Law发现者,现在也没看到瓶颈
哈萨比斯在Axios AI+峰会上称Scaling Law最早由DeepMind发现,靠它可能达成AGI,还预测未来12个月AI发展,如多模态融合、视觉智能突破等,且Gemini目标是成通用助手。
360发布全球最强视觉语言对齐模型!榜单全面领先!
360发布FG - CLIP 2双语细粒度视觉语言对齐模型,几乎在所有数据集上全面领先。它能让AI在统一框架内看懂图像细节、理解中英双语,团队还提出新中文多模态评测基准。
3 个 Multi-Agent 系统,把 GPTBots 的多智能体协作玩明白了!
文章介绍如何在GPTBots平台玩转多智能体系统,阐述多智能体协作优势、架构及三种协作模式,通过旅游规划、辩论对抗、商业决策三个案例展示协作模式应用,还给出总结与进阶建议。
一文讲懂Agent及其主流框架:自己想、自己干、自己复盘的才是好Agent!
文章对比Workflow和Agent,指出复杂多变场景下Agent框架更适用。还介绍AutoGPT、LangGraph等5款主流Agent框架,涵盖其特点、应用场景等,最后提及腾讯云TDAI团队探索数据库与AI结合。
凯捷研究院最新报告:到2028年,Agentic AI市场规模4500亿美元
凯捷研究院报告显示,到2028年Agentic AI有望撬动4500亿美元经济价值,但目前仅2%企业规模化应用。其能自主执行任务,带来商业价值,不过面临信任危机,各行业巨头已开始探索落地场景。
开源复现o3图像思考!快手让AI不再被动看图,模型自主生成代码调用工具
Kwai Keye团队提出Thyme新范式,构建技术方案,赋予开源模型“超越图像思考”能力。包括设计训练策略、构建开源配套资源,拓展多模态模型工具使用与决策水平,在基准测试中性能提升显著。