「AI推理模型」共找到 13894 篇相关文章
Lilian Weng:Harness才是模型自我迭代的现实起点和关键,而不是直接重写权重
Thinking Machines Lab联合创始人Lilian Weng发文指出,实现AI递归式自我改进(RSI),设计围绕模型的执行系统“Harness”才是现实起点。文中详述Harness设计模式、优化路径,也指出自我改进面临的瓶颈。
RLHF已死,RLVR引爆AGI革命!Claude 4核心成员万字对谈
Claude 4核心成员对谈指出,强化学习在语言模型上奏效,可验证奖励的强化学习(RLVR)比RLHF更优,模型有望从「专才」向「通才」过渡,未来AI智能体将完成白领工作,人们应做好准备。
阿里云百炼 AgentScope 基于容器服务的最佳实践,加速企业 AI Agent 应用落地
自 ChatGPT 发布,大语言模型成智能系统核心,AI Agent 兴起。阿里云百炼与容器服务联合发布 AgentScope on 容器服务方案,为智能体应用提供运行底座,介绍了 AgentScope 特性、容器服务能力及部署实践等。
提示工程死亡?不,它刚刚重生为计算科学:一篇讲透Prompt设计的科学基础
大型语言模型在多步推理任务中受挫,因Transformer架构有计算深度限制。本文建立提示设计理论框架,揭示提示是信息选择器,优化提示可使推理性能提升超50%,将提示设计从试错艺术变为可计算科学。
用DAA衡量智能体 百度智能云用“新全栈”重新定义AI云|甲子光年
2026年产业焦点转向智能体落地,李彦宏提出DAA概念。百度智能云升级为新全栈AI云,解决智能体落地难题,从架构决策、行业应用等多方面发力,其价值值得市场重估。
MiniMax今早上市,股价疯涨80%!一群95后跑通了中国AI的价值
1月9日9:30,MiniMax于港交所上市,截稿时股价疯涨近80%。该公司仅用约5亿美元便让全模态模型进入国际第一梯队,员工平均年龄29岁。其以低投入、高产出及全球化业务,展现了中国AI的实力与潜力。
领先于Transformer!新架构首个1200万上下文模型SubQ,成本仅Opus的5%
Subquadratic公司提出SubQ模型,核心是SSA亚二次稀疏注意力机制。该机制改变注意力计算分配,让模型真正读长文档。SubQ是首个有1200万token上下文窗口的前沿模型,成本低、速度快,有望革新大模型扩展路径。
苹果的局面,很迷惑
作者对比 Google I/O 大会上谷歌的表现,认为苹果在 WWDC 上的表现令人失望。苹果更新设计语言,其 AI 侧重端侧模型,有数据安全等优势,虽目前参数量小,但端侧 AI 或成新战场。
PITT | 提出PhyT2V框架:让文生视频(T2V)更符合物理规律(CVPR2025)
当前T2V技术迈向推理驱动阶段,物理规律是关键约束。匹兹堡大学团队提出PhyT2V框架,不依赖模型重训练或大规模外部数据,可增强主流T2V模型能力,有低落地门槛和良好泛化性。
Eino ADK:一文搞定 AI Agent 核心设计模式,从 0 到 1 搭建智能体系统
大语言模型发展下,Agent成AI落地主流,但传统开发有痛点。Eino ADK为Go开发者提供智能体开发框架,解决核心难题,还介绍了Agent功能、ADK模式、构建方法及多Agent协作场景等。