「多模态应用」共找到 2966 篇相关文章
“扁平+拓扑”双索引,85页PDF"秒级"推理,MMRag幻觉率骤降76%
多模态长文档视觉问答常见于科研论文等场景,现有技术路线有大视觉 - 语言模型直接端到端和检索增强生成,但各有缺点。MMRAG - DocQA引入新方案,解决多模态连接和跨页证据链接问题。
Andrej Karpathy:“ChatGPT套壳”的说法大错特错,提示词工程已过气
Andrej Karpathy力挺用“上下文工程”取代“提示词工程”,指出“提示词”过于简单,“上下文工程”更能揭示构建强大AI应用的本质。他强调“上下文工程”仅是构建大模型应用的一环,“ChatGPT套壳”说法大错特错。
多模态大模型中Attention机制暗藏「骗局」,需用一个公式修正丨上大×南开
上海大学曾丹团队研究发现,主流VLM中attention受位置偏置和padding区域异常高attention影响,直接用其进行视觉token剪枝会丢失关键信息。团队用公式对attention去偏,集成到多种剪枝方法,提升了模型性能。
终于不用羡慕老外了!美团竟然做出了类似V0&Bolt的AI编程神器
美团推出零代码应用生成工具NoCode,类似V0&Bolt。它功能强大,能生成复杂网页应用,支持提示词生成、自动优化、快速部署等,还自带数据库服务,免费且无需邀请,为国内Vibe Coding带来曙光。
OpenAI 新任应用CEO 首发长文:人工智能将成为人类历史上最大的赋能源泉。
前Instacart CEO Fidji Simo 8月18日加入OpenAI任应用CEO,她在长文表示AI可成人类最大赋能源泉,提出AI赋能的六个关键领域,强调技术价值在于让更多人受益。
从 “可用” 迈向 “好用”:详解火山引擎智能视频云的三层架构升级|甲子光年
2025年AI关键在多媒体领域,智能多媒体落地有变革也面临挑战。火山引擎提出智能视频云三层架构升级,即基建、平台、应用层升级,助企业实现低成本、高效率规模化应用,多行业已基于此打造能力。
Harness Engineering:耗时一周,我是如何将应用的AI Coding率提升至90%的
文章结合Anthropic、OpenAI方法论与项目实践,分享为存量Java应用构建Harness体系,将AI代码率从不到25%提至90%的方法。介绍Harness概念、现状挑战、实战步骤、关键经验及效果,还对其未来发展做了展望。
时隔9个月Meta全新模型Muse Spark发布:闭源,原生多模态,一发布就落后?
时隔9个月,Meta推出Muse家族首款大模型Muse Spark,原生多模态推理,但能力表现一般,编程领域落后于opus 4.6和GPT 5.4等。它有沉思模式,致力于成个人超级智能,技术亮点多,性能高效。
AI泡沫越大鱼越贵!YC合伙人复盘2025年AI创业
2025年底Y Combinator博客复盘该年AI四大变局,如Anthropic成最受欢迎大模型,使用率超OpenAI。创业者可在模型间套利,创建垂直AI应用。能源焦虑催生太空数据中心,AI泡沫或成应用层红利。
龙虾的应用商店挂牌了!北大开源MagicSkills,让Agent Skill可自由安装组合同步
北京大学Narwhal - Lab开源项目MagicSkills,把AI Agent所需技能统一管理,实现能力复用。它解决了技能管理分散、重复等问题,提供共享体系,让技能可安装、组合、同步和调用,适用于多Agent项目等。