智能体训练」共找到 5190 篇相关文章

产品应用7

阿里QwenLong-32B:1W+超长Token推理,知识密集型复杂文档高效推理

文章介绍阿里QwenLong - 32B在长文本推理的能力。长文本推理有训练效率低和优化不稳定问题,QWENLONG - L1通过强化学习等解决,还阐述其组件、训练步骤,并给出实战代码及相关链接。

CourseAI
新闻资讯7

刚刚,1500名作家向 AI 宣战!

1500位作家联名向美国出版商发公开信,要求拒绝AI生成的书籍内容,称创作被AI“偷走”,还指出AI有声书取代人类、耗能大等问题。此前法院裁定用受版权书籍训练AI属合理使用。

AGI Hunt
开源动态8

如何定义“人味儿”?——HeartBench评测系建设实践

在大模型竞争格局生变,情感智能评测缺失的背景下,作者团队发布聚焦AI拟人化的中文评测系HeartBench,介绍其设计、评估方式、迭代过程等,还沉淀了评测系构建方法论及专家标注管理思考。

阿里云开发者
新闻资讯7

“VLA和世界模型都不是终局,会有物理世界独有的模型” | 蚂蚁灵波沈宇军@AIGC2026

在2026中国AIGC产业峰会,蚂蚁灵波沈宇军与李根深度对话。沈宇军指出大模型踩中互联网数据红利,但机器人数据空白。他认为VLA和世界模型非具身智能终局,未来会有物理世界独有的模型。

量子位
算法论文7

人大-清华-腾讯发布:音频 - 视觉多模态任务统一框架

人大、清华和腾讯合作发布Crab论文,目标是实现多模态场景理解任务的高效一统。它针对音频 - 视觉理解模型难点提出解决方案,构建数据集、设计LoRA结构、统一架构,训练分预训练和指令调整两阶段。

CourseAI
开源动态7

全球闲置算力训个模型,性能媲美R1,老黄天塌了!Karpathy曾投资它

全球首个分布式RL训练模型INTELLECT - 2发布,整合闲置算力完成训练,成本降低,性能媲美DeepSeek - R1。其采用分布式异步强化学习范式,团队开源四大关键组件,还获Karpathy等投资,未来有多项计划。

量子位
产品应用8

腾讯AngelSlim重磅升级!面向全模态的大模型压缩算法工具包,推理速度飙升 1.8倍!

近年来,推理阶段的成本等因素制约大模型规模化应用。腾讯混元升级的 AngelSlim 围绕 Eagle3 投机采样训练范式构建系统化实现,支持多模态场景,最高可实现 1.9× 推理加速,还具备多亮点。

腾讯技术工程
新闻资讯8

黄仁勋、李飞飞、Yann LeCun等六位AI顶级大佬最新对话:AI到底有没有泡沫?

六位 AI 顶级大佬黄仁勋、约书亚·本吉奥等齐聚参加峰会对话,回顾 AI 发展历程,分享职业生涯“顿悟时刻”,探讨 AI 是否有泡沫、何时达人类智能水平等问题,各抒己见展现对 AI 未来的不同思考。

AI前线
算法论文8

哈佛发现基础模型比你想象中更强大:纯采样方法可超越RL

论文提出基础模型本身已具备强大推理能力,通过“幂采样”纯采样算法,在多推理任务上媲美或超越RL后训练,挑战“RL才能提升推理”观念,为理解基础模型潜力开新视角。

深度学习自然语言处理
产品应用8

百度Qianfan-VL,发票/图表/合同等PDF识别94.75%刷新纪录!

当前主流视觉 - 语言模型在企业级应用有难点,百度千帆团队提出Qianfan - VL系列多模态大模型,在通用和企业级任务表现出色,基于自研芯片训练,还提供框架与管线降低成本。

CourseAI