「推理框架开发」共找到 4661 篇相关文章
AEPO:智能体熵平衡策略优化,让探索更稳,推理更深!
中国人民大学与快手团队联合提出 AEPO 算法,解决熵驱动式智能体强化学习训练不稳等问题。它设计两项核心机制,在 14 个基准上优于主流算法,在 X 等平台获高关注。
终结数据荒!智源开源首个Deep Research数据合成框架InfoSeek
在大模型深度研究中,高质量数据是短板。近日,智源研究院发布首个面向深度研究的开源数据集InfoSeek,提出「扩散 - 回溯」数据合成方法,用3B模型在基准测试中接近商业模型表现,且数据集可扩容。
重构开发体验:CodeFuse 智能代码助手的设计与实践
蚂蚁集团技术专家牛俊龙在 QCon 大会分享 CodeFuse 智能代码助手架构设计与实践,介绍本地核心服务设计策略,结合案例优化其 AI 能力,还分享落地经验、教训与未来发展路径。
模仿学习新范式!Chain-of-Action:轨迹自回归实现动作推理
具身智能领域尚未迎来「GPT时刻」,现有模仿学习范式有缺陷。字节跳动与阿德莱德大学研究者提出「动作链」(CoA)策略,通过轨迹自回归建模解决累计误差,提升泛化性,实验效果显著。
Claude 和 Manus 还要人工搭框架?小米直接让 Agent 自我进化
6月12日小米Darwin Agent Team发布论文《HarnessX》,用“系统自进化”终结Harness人工调优时代,带来性能跃升。其让Harness成为“一等公民”,有可组合等特质,还能与模型协同进化,虽有局限但成热门方向。
Transformer可以改装成Mamba了:苹果把推理成本直接打成线性
苹果将Transformer改造成Mamba,采用‘两步走’策略,先造中间形态,再转成Mamba,避免性能崩塌。实验显示,新方法性能几乎没掉,成本逻辑改变,为模型降本重构提供新可能。
老黄入局吃龙虾!英伟达发布最强开源Agent推理模型
英伟达发布并开源120B参数的MoE模型Nemotron 3 Super,在多项测试中表现出色。它原生支持100万token上下文,吞吐量大幅提升。英伟达还计划五年投260亿美元构建开源AI模型,开放全参数权重等。
中途退学的艺术生,开发Web 3D项目,周下载量破400万
近日,Three.js 官方公布其周下载量突破 400 万。它是基于 WebGL 的 JavaScript 3D 图形库,承担诸多 Web 页面核心 3D 渲染工作。AI 降低其准入门槛,其创始人成长经历独特,开源风格克制。
当代码江湖遇上智能副驾:一场开发效能的「御剑飞行」
文章以代码江湖为喻,介绍开发者困境,引出智能GitHub Copilot副驾驶。它能提升开发者工作满意度和代码编写效率,全球2000万开发者在用,微软还持续创新。11月14日将举办分享会探讨其应用。
英伟达发布物理AI和机器人顶级开发平台Nvidia Jetson Thor
英伟达官网发布专为物理AI和类人机器人打造的顶级平台Nvidia Jetson Thor。其AI计算能力强劲,相比NVIDIA AGX Orin性能和能效大幅提升,硬件配置、存储、多媒体处理及相机支持等方面表现出色,能应对复杂场景。