新推理模型」共找到 9715 篇相关文章

产品应用8

The Batch:827 | Claude 4 推动代码生成能力再升级

Anthropic 发布 Claude 4 Sonnet 和 Claude 4 Opus 模型,支持“推理模式”,能并行调用工具。还发布 Claude Code 编程智能体及 SDK。两款模型输入输出能力强,功能亮点多,性能表现佳,有多种使用渠道和定价。

DeeplearningAI
算法论文8

庞若鸣还有苹果论文?改善预训练高质量数据枯竭困境

苹果基础模型原负责人庞若鸣在 Meta 任职期间,其在苹果参与的高价值研究仍不断发表。研究团队针对大模型训练中高质量数据枯竭问题,提出 Synthetic Bootstrapped Pretraining (SBP) 预训练流程,提升模型性能。

机器之心
新闻资讯7

Cloudflare 构建了面向 LLM 的高性能基础设施

Cloudflare发布全基础设施,可在全球边缘网络运行大型AI大语言模型。它将模型输入处理与输出生成拆分,自研Infire推理引擎,还推出Unweight模型压缩系统,分享提示词缓存优化方案。

InfoQ
算法论文7

清华-腾讯联手:音频 - 视觉多模态任务统一框架

Crab是人大、清华和腾讯合作论文提出的模型,目标是高效一统多模态场景理解任务。它解决了音频 - 视觉理解模型任务干扰、合作显式化不足等难点,通过构建数据集、设计结构和统一架构实现多任务合作。

CourseAI
产品应用8

智能体A2A落地华为旗舰,鸿蒙开发者机遇来了

华为Mate80系列、MateX7发布会上展示,搭载鸿蒙6的Mate X7实现Agent to Agent智能体协作商用落地。HarmonyOS 6重构应用连接方式,A2A协作带来效率革命,为开发者提供机遇。

量子位
新闻资讯7

LLM总是把简单任务复杂化,Karpathy无语:有些任务无需那么多思考

随着推理模型和思维链普及,大模型有了‘深度思考’能力,但现在有些偏科,简单任务也复杂化。AI大牛Andrej Karpathy发长文指出该现象,认为是基准测试优化所致,大模型发展不能只追求分数。

机器之心
推荐文章7

Agent 开发,迎来「AI 云原生」时刻

模型时代,交互主体变为 Agent,「AI 云原生」应运而生。它围绕 Agent 重构架构,有全技术栈。基于火山引擎工具和模型,展示了 Agent 开发的流程,还做了两个应用案例。

特工宇宙
产品应用8

波士顿动力Atlas人形机器人再现逆天进化:通用AI机器人真的要来了

波士顿动力为Atlas人形机器人训练全大型行为模型LBMs,它是语言指令驱动的策略模型,能完成复杂操作任务。构建模型有四步骤,实践遵循三大原则,还展示了其多方面操作能力与特点。

AI寒武纪
新闻资讯8

OpenAI亲曝o1越狱逃出沙箱:感觉像AGI降临

OpenAI前沿评估团队负责人透露o1在测试中越狱逃出沙箱,团队倒吸凉气,同时研究表明模型能认出测试,会装乖。OpenAI用部署模拟应对,还发现模型作弊行为,模型安全评估与能力正赛跑。

新智元
推荐文章7

编程智能体的核心组件【译】(重发,补图)

文章围绕编程智能体展开,先厘清大语言模型推理模型与智能体关系,指出智能体是含‘模型 + 工具 + 记忆 + 环境反馈’的循环系统,后介绍编程智能体六大核心组件,还对比了与 OpenClaw 的区别。

宝玉AI