推理大模型」共找到 9551 篇相关文章

产品应用8

Seedance 2.0刷屏后,字节还有个硬核模型——3个复杂任务实测Seed 2.0

作者作为AI编程工具深度用户,没追热门的Seedance 2.0,而是实测同期发布的豆包模型Seed 2.0。设计3个日常复杂任务,在TRAE接入其Pro版测试,展现出强的自主纠错和多任务处理能力,也指出了不足。

花叔
产品应用8

首款推理具身模型,谷歌DeepMind造!自主理解/规划/执行复杂任务,打破一机一训,还能互相0样本迁移技能

谷歌DeepMind发布新一代通用机器人基座模型Gemini Robotics 1.5系列,由GR 1.5和GR - ER 1.5组成,结合视觉、语言与动作,实现“规划 + 执行”闭环,还提出Motion Transfer机制,能跨机器人迁移技能。

量子位
开源动态7

一夜之间,Claude Code删掉了80%系统提示词

本周五,Anthropic 技术团队成员 Thariq Shihipar 介绍新一代语言模型工程趋势变化。Anthropic 发现旧提示词工程范式在新一代强推理模型发布后或过时,新的 Claude.md 应精简,砍系统提示词后可把特定任务上下文交给 Skill。

机器之心
算法论文8

告别微调!斯坦福提出Agentic上下文工程

当前微调语言模型成本高、不灵活,‘上下文适应’方法有短板。斯坦福学等提出ACE框架,将上下文变为动态‘战术手册’,解决现有问题。论文通过实验验证其在性能、成本和效率上优势,为模型发展指明新方向。

深度学习自然语言处理
新闻资讯8

全国产算力托底、告别 AI 内卷,科讯飞如何让每个人站在 AI 肩膀上?

本文围绕科讯飞在AI领域的发展展开。董事长刘庆峰表示要让所有人共享AI红利,介绍了公司在多领域的应用成果,还发布全国产算力的讯飞星火X1.5模型,实现多项技术突破,推动AI融入现实生活。

AI前线
新闻资讯7

GPT-5.2破解数论猜想获陶哲轩认证!OpenAI副总裁曝动作:正改模型核心设计,吊打90%研究生但难出颠覆性发现

OpenAI 发布由 GPT - 5.2 加持的科研平台 Prism 并免费开放。副总裁 Kevin Weil 称目前模型难有颠覆性发现,但能加速科研。GPT - 5 能力超 90% 研究生,OpenAI 将优化其设计,让它更谦逊并自我核查。

InfoQ
推荐文章7

万字实录:AI究竟是普通人的“印钞机”,还是更狠的「收割机」?| GAIR Live 021

雷峰网&AI科技评论邀三位老师探讨“AI模型金融应用的机遇与挑战”。以Trading Arena赛为例,分析模型在金融投资应用,指出打造强逻辑推理脑”是金融应用关键,也提及Agent局限与“黑天鹅”预判路径等。

AI科技评论
算法论文8

模型砍掉一半,准确率反升15%!华科&阿里安全新研究实现ViT近乎无损的类特定压缩|ICLR'26

华中科技学联合阿里安全部提出Vulcan方法,一改传统压缩策略,通过“先训练再剪枝”实现ViT近乎无损的类特定压缩,为模型服务小场景提供新路径,论文已被ICLR 2026接收。

量子位
开源动态7

AI还不会独自问诊,o3准确率仅为51.12%,上交×SII开源高难度复杂疾病诊断测评集

上海交与SII团队开源高难度复杂疾病诊断测评集DiagnosisArena。测试显示,现有模型在复杂临床诊断任务中表现不佳,o3准确率仅51.12%,且选择题设置无法反映其真实能力。

量子位
开源动态8

告别VAE压缩损耗,南京学用DiP让扩散模型回归像素空间,实现10倍加速与SOTA级画质

南京学、腾讯优图实验室和新加坡国立学发布DiP框架,即将开源。该框架不依赖VAE,仅增0.3%参数量,推理提效10倍,在ImageNet获1.79的FID分数,解决扩散模型在像素空间难兼顾质效的问题。

AIGC开放社区