复合长程任务」共找到 2007 篇相关文章

推荐文章8

端到端语音模型:从语音表征到模型架构

本文整理自阶跃星辰语音模型负责人杨学锐在2025年QCon全球软件开发大会的分享。介绍大模型对语音技术的重塑,涵盖识别、合成等方面;阐述端到端语音模型构建,涉及表征、架构、训推和任务;还提及模型评估方法。

InfoQ
算法论文8

英伟达揭示RL Scaling魔力!训练步数翻倍=推理能力质变,小模型突破推理极限

学界对强化学习能否让模型学会新推理技能争论已久,过去研究多悲观。英伟达研究指出,问题源于任务在基础模型训练数据中过度呈现及训练步数不足。其ProRL框架提升训练步数,释放小模型潜力,还构建技术组合拳。

机器之心
新闻资讯8

谷歌AI掌门人、诺奖得主Demis:AGI 需要打破“金鱼记忆”,而谷歌无论泡沫破裂与否都将是赢家

谷歌AI掌门人Demis接受专访,回应AI是否有“金鱼记忆”、AGI定义等尖锐问题。他认为通往AGI需突破,大模型是核心组件;真正AGI要能执行人类所有认知任务,离实现还有5 - 10年;还看好智能眼镜,强调保护用户对AI信任。

AI科技大本营
新闻资讯7

究竟会花落谁家?DeepSeek最新大模型瞄准了下一代国产AI芯片

近期,DeepSeek发布V3.1新模型,采用全新混合推理架构,在多任务表现上有提升。它采用UE8M0 FP8,或为国产推理芯片优化机制。国内多家厂商新一代AI芯片支持FP8,未来国产大模型或针对其专门优化。

机器之心
新闻资讯8

万字实录:VLA 范式,具身智能的曙光与迷雾丨GAIR Live

2025年5月9日,雷峰网等举办“具身智能之VLA的实践与突破”线上圆桌沙龙。多位专家探讨VLA定义、起源、技术路线等,指出其面临推理、数据等瓶颈,还讨论了与强化学习结合、数据选择、提升泛化性、长程任务及落地场景等问题。

AI科技评论
新闻资讯8

巅峰对决:最强模型GPT-5.3-Codex与Claude Opus 4.6同时发布

OpenAI和Anthropic同时发布旗舰级模型GPT - 5.3 - Codex与Claude Opus 4.6。前者有网络攻防与自主代码修复能力,被评定为网络安全高风险;后者用自适应思考与上下文压缩处理长程任务,在多领域表现出色,但二者也都存在安全风险。

AIGC开放社区
产品应用7

10个Agent一键组队:并行智能体协作,端到端交付从24h缩减到4h!

过去写代码靠程序员手动输入,即便有Copilot等工具,仍需人主导。并行代理出现后,程序员可调用多个AI并行工作,将端到端交付时间从24h缩减到4h,思维方式也需转变,对工程师能力要求也有变化。

新智元
算法论文8

CMU&斯坦福提出Reasoning新范式!自己找“窍门”,教会LLM抽象Reasoning

大型语言模型解决复杂推理问题时效率低,论文提出创新方法,让模型利用“推理抽象”,通过RLAD两玩家强化学习框架训练,在多基准测试提升性能,还分析了其作用、局限与未来方向。

深度学习自然语言处理
产品应用7

智谱 AutoClaw 深度测评:一键把电脑变成 AI Agent,是神器还是半成品?

本文深度测评智谱最新推出的桌面应用AutoClaw。它宣传能让电脑成AI Agent,引发两极评价。文章从安装、界面、功能、成本等方面测评,指出其优缺点,认为虽不完美但方向值得肯定。

AI科技评论
新闻资讯7

OpenAI官方发布【Codex 上手指南】

OpenAI 昨晚推出 Codex 研究预览版,这是强大的远程编码智能体,能导航代码库、解答疑问等。官方还发布使用指南视频,介绍了快速上手步骤、工作方式,以及提升效能的方法。

AI寒武纪