「长文本理解」共找到 1690 篇相关文章
GPT-5超越人类医生!推理能力比专家高出24%,理解力强29%
最新研究显示,GPT - 5在医疗领域处理多模态信息能力出色,在多模态测试中推理和理解得分比GPT - 4o分别提高近30%和36%,比人类医生还高。其能力提升源于端到端多模态架构,但现实应用还需更多实战考验。
大模型外挂“三维物体知识库”来了,大幅增强机器人长程自主操作能力
现有视觉语言大模型(VLM)能让机器人理解指令,但在操作中缺三维空间知识。近日研究提出 RAM 框架,它像“三维物体知识库”,为 VLM 补充空间知识,经 14 项实验验证其操作能力,还探索了在铰接与柔性物体操作中的应用。
投入AI越多,跌得越猛!美股巨头只有AI拉胯的苹果在猛涨
本周财报季,亚马逊、谷歌和微软等科技巨头虽营收光鲜,但股价集体跳水,市值合计蒸发9000亿美元。因2026年计划砸6600亿美元建AI基建,市场担心回报周期长。而苹果未参与军备竞赛,与谷歌合作,营收创新高、支出降低、股价上涨。
AI大模型开发核心技术栈:从框架到部署的全景解析
本文为开发者提供2025年AI大模型开发核心技术栈图谱,解析四大核心支柱技术。基础开发框架含深度学习与AI Agent框架;模型训练与微调有分布式训练、参数高效微调;推理优化含关键技术与主流框架;AI编程辅助工具分主流形态且有发展趋势。
AI真有希望考清北了!豆包1.6多模态推理发威,闯关数理化带图大题
火山引擎原动力大会发布豆包大模型1.6,它是国内首款多模态SOTA模型,支持256k上下文长度。实测中它解答高考数理化带图大题表现出色,还具备图像识别、视频理解、GUI操作等能力。此外,火山引擎还推出系列工具和平台助力企业。
AI x 保险图谱:第一家 AI-Native 的保险独角兽会长什么样?
保险业规模庞大但运营效率极低,超 60%流程依赖人工,索赔周期长、客户满意度低。过去两年,LLMs 提升了 AI 处理非结构化信息的能力,使 AI 接管保险核心流程成为可能。GenAI startup 围绕保险流程构建产品,AI-native 保险公司也应运而生。
「压缩,就是你所需要的全部」!菲尔兹奖得主Michael Freedman新作揭开数学真相
菲尔兹奖得主Michael Freedman认为人类真正创造和关心的数学本质是「柔软且可塑」的。他在最新论文提出「压缩,就是你所需要的全部」,并在采访中探讨人类数学直觉与机器逻辑的鸿沟,认为理解压缩机制是人类与AI在数学领域协作的起点。
Issue修复开源No.1!蚂蚁 | 提出代码图模型:CGM,结合GraphRAG架构,领先最强开源7.33%
为解决开源模型在仓库级代码理解上的能力瓶颈,蚂蚁全模态代码算法团队提出 CGM 架构,融合仓库结构与语义信息。CGM 首创图结构与语言模型融合的对齐框架,还搭配了 GraphRAG 框架,在多个代码任务中表现出色,且相关资源均已开源。
苹果ASM投放的两种方式,竞价原理与机制
苹果ASM投放模式的选择对广告效果至关重要。Basic模式适合预算有限且缺乏投放经验的开发者,操作简单但数据报告不详尽。Advanced模式则适合专业团队,提供更精准的用户定位和详尽的数据报告,以便随时调整广告策略。
是剧本杀来了?还是儿童剧本杀教育机会来了!
儿童剧本杀教育的兴起,不仅为孩子们提供了一种新颖的娱乐方式,也带来了教育的新机遇。它通过沉浸式体验,让孩子们在玩耍中学习历史,培养兴趣,同时满足了市场对创新教育内容的需求。