「长任务时代」共找到 3532 篇相关文章
OpenClaw 之后,Agentic RL有了新训练范式
大模型技术推动AI从‘回答问题’迈向‘执行任务’,Agentic AI兴起。中国科大认知智能全国重点实验室提出Claw - R1项目,将前沿Agent Runtime与强化学习训练框架结合,为Agentic AI提供新训练基础设施。
智能流体力学青年学者论坛第30讲~33讲
智能流体力学青年学者论坛第30 - 33讲将于2026年3月6日举办,由中国空气动力学会智能流体力学专委会主办。报告涵盖迈向大语言模型时代的自动化智能CFD工作流等主题,多位学者将分享最新研究成果。
程序员不许写代码!OpenAI硬核实验:3人指挥AI,5个月造出百万行
OpenAI官博曝光内部实验,3人团队利用Codex智能体5个月造出百万行代码产品,人类不写代码,精力放于规划规则。此实验颠覆软件工程定义,宣告手工代码时代终结,也重塑程序员岗位。
ICLR 2026 | CineTrans: 首个转场可控的多镜头视频生成模型,打破闭源技术壁垒
随着视频生成模型发展,影视级长视频需多镜头序列及自然转场,这成新挑战。上海人工智能实验室团队提出 CineTrans 模型,基于掩码机制实现自动化转场,还构建 Cine250K 数据集,实验效果超基线。
对话原力灵机范浩强:评判机器人好坏,只有一个指标
本文是对原力灵机创始人范浩强的访谈。他认为AI是一生的事业,原力灵机成立于25年3月,强调模型是主轴。还指出评判机器人好坏的关键指标是回本时间,要从真实场景找突破,也介绍了具身智能应用等内容。
开源多模态推理「破壁」时刻:MMFineReason助力4B逆袭30B
长期以来,开源多模态模型在复杂推理任务上与顶尖闭源模型有差距,核心痛点是高质量推理数据匮乏。上海AI实验室OpenDataLab团队开源MMFineReason框架及大规模数据集,小模型凭此实现性能逆袭。
华为升级行业Agent算法架构!MindScale自己写prompt和工作流,KV Cache减少5.7倍token
华为诺亚方舟实验室更新面向行业应用的算法包MindScale,融合算法创新与业务实践经验。它梳理了Agent时代技术挑战,给出技术论文与昇腾代码,应对工作流维护等难题,还提升训推效率、适配国产硬件。
几句话就能复刻一个付费Skill,Skills商店还能卖什么?
文章探讨Skills商店的生意前景,介绍应用层转变,对比Skills与Agent商店,说明Skills来源,指出简单流程型Skills易被复刻,还阐述Sklls、MCP、A2A的关系及当前Agent存在慢的问题。
训练加速1.8倍,推理开销降78%!精准筛选题目高效加速RL训练丨清华KDD
清华大学THU-IDM团队与慕尼黑大学CompVis团队合作提出MoPPS框架,解决强化微调代价高问题。它精准挑题,预测难度,开销低、动态适应且平衡探索利用,在多任务表现佳,降本增效,有新范式。
揭秘!RLVR/GRPO中那些长期被忽略的关键缺陷
近年来大模型任务突破离不开RLVR关键技术,许多RLVR方法会进行组内优势估计,北航等最新工作揭示其存在系统性偏差,困难题优势被低估,简单题被高估。这会影响训练,论文提出校正算法。