长上下文能力」共找到 4096 篇相关文章

推荐文章8

AI x 保险图谱:第一家 AI-Native 的保险独角兽会什么样?

保险业规模庞大但运营效率极低,超 60%流程依赖人工,索赔周期、客户满意度低。过去两年,LLMs 提升了 AI 处理非结构化信息的能力,使 AI 接管保险核心流程成为可能。GenAI startup 围绕保险流程构建产品,AI-native 保险公司也应运而生。

海外独角兽
新闻资讯8

巅峰对决:最强模型GPT-5.3-Codex与Claude Opus 4.6同时发布

OpenAI和Anthropic同时发布旗舰级模型GPT - 5.3 - Codex与Claude Opus 4.6。前者有网络攻防与自主代码修复能力,被评定为网络安全高风险;后者用自适应思考与上下文压缩处理程任务,在多领域表现出色,但二者也都存在安全风险。

AIGC开放社区
Product Application7

补上OpenClaw最大短板!中国AI独角兽亮出龙虾盒子,打工人放心养虾

OpenClaw热潮下,云端隐私数据保护缺位,端侧算力和全模态脱敏能力不足制约其落地。无问芯穹推出InfiniClaw Box,具备多信源融合等能力,采用端云一体架构,实现隐私安全与大模型能力融合。

新智元
算法论文7

大模型在具身推理上「翻车」了?4496 道题全面揭示短板

美国东北大学等提出BEAR基准评估MLLM具身智能子能力,用4496道题测试20个模型。发现多模态大模型具身能力不足,还分析错因,开发BEAR - Agent提升模型具身推理能力,在仿真测试中效果显著。

机器之心
产品应用9

深度拆解 Gemini 3.8 Live:一句插话,为什么会牵动整个 Agent 系统

本文深度拆解Google发布的Gemini 3.8 Live,分析其将语音、推理、工具调用整合进持续运行链路的架构创新,探讨Voice Agent进入Runtime阶段的核心技术挑战与未来AI Agent发展趋势。

AI科技评论
新闻资讯8

Sora2甚至可以预测ChatGPT的输出

Sora2表现太卷,能预测ChatGPT输出,模拟交互还能渲染HTML,懂代码也懂物理,能体现玻璃折射现象,还能精准还原游戏支线任务关键要素,或基于LLM训练。

量子位
开源动态8

真实科研水平集体不及格!全新基准SFE给主流多模态LLM来了波暴击

上海人工智能实验室AI4S团队推出SFE评测基准,首创三级评估体系,涵盖五大科学领域66项任务。评测显示主流MLLMs在高阶科学任务有挑战,不同模型、学科表现有差异,还构建了SciPrismaX平台推动AI科学评估生态发展。

机器之心
算法论文8

具身智能空间视觉死穴,终于被最新顶会彻底解决!

招商局先进技术研究院下属实验室提出新的移动数据范式,以极低成本破解 VLA 的空间泛化瓶颈。研究团队识别出 VLA 模型三种捷径学习模式,提出层次化数据解耦策略,该方案在主流 VLA 模型上验证有效。

新智元
新闻资讯8

当黄仁勋反复提起OpenClaw,他到底在焦虑什么?|甲子光年

美国当地时间3月18日,「甲子光年」参加英伟达黄仁勋在GTC 2026的媒体会。黄仁勋多次提及OpenClaw,认为它很重要。英伟达不仅造GPU,还构建AI工厂,试图成为新计算秩序定义者。

甲子光年
开源动态8

社区供稿 | VibeVoice实现90分钟、多角色播客生成,拓展语音合成新边界

微软亚洲研究院提出全新语音生成模型 VibeVoice,采用 next - token diffusion 机制,能将文字脚本转为最 90 分钟、最多 4 人对话的高质量播客音频,在多方面有显著优势,未来潜力大。

Hugging Face