任务级奖励」共找到 2929 篇相关文章

算法论文8

让AI生成视频「又长又快」:Rolling Forcing实现分钟实时生成

南洋理工大学与腾讯ARC实验室联合研究,由博士生刘坤昊等完成,提出Rolling Forcing方法,通过滚动窗口联合降噪等创新设计,突破实时长视频生成瓶颈,实现分钟实时生成,还支持交互控制,但仍有优化方向。

机器之心
新闻资讯7

颠覆算力格局!全球首个星座太空AI算力服务,在中国诞生

第四届琶洲算法大赛中,国星宇航与佳都科技联手推动「慧行·AI上星」实验,标志国星宇航成全球首个提供常态化星座太空算力商业服务公司,验证太空算力承载行业应用可行性。

新智元
开源动态8

从“造工具”到“用仓库”:RepoMaster,驾驭GitHub解决复杂任务的智能体大师!

RepoMaster旨在让AI智能体解决复杂开发任务。它能利用深度搜索定位GitHub仓库,其核心框架分三步闭环解决智能体‘看不懂、用不来’难题。实验显示它性能超主流框架,效率高,设计科学。

AI科技评论
算法论文8

TRM思考奖励模型上线,大模型推理质量终于能量化了 | ICML‘26 Oral

大模型推理评测多只看答案,忽略推理过程。上海多校团队提出TRM,用ME² principle刻画推理质量,DAG-based pairwise evaluation还原结构,训练奖励模型,让推理质量可度量、训练和优化。

量子位
新闻资讯7

Karpathy点透AI认知撕裂:顶圈子正集体患上AI狂热症

人们对AI能力认知差距大,部分人用旧版模型评判AI,而前沿模型进步多在专业领域。付费深度使用前沿模型的人有强烈AI狂热症,技术领域进展得益于奖励函数和企业应用价值。

AI寒武纪
8

上线不到一年,收徒百万,首个真人AI导师技术底牌首次曝光

2025年初,与爱为舞落地国内首个真人AI一对一导师产品「爱学」,上线不到一年有超百万学员使用。它突破传统AI教育局限,自研全栈技术体系,从多方面打造优质AI导师,为AI Agent规模化落地定义范式。

机器之心
算法论文8

自回归模型杀回图像生成!实现像素精准控制,比Diffusion更高效可控

当下AI图像生成领域,Diffusion模型虽为主流,但在精准控制上有不足。伊利诺伊大学香槟分校等机构研究者提出MENTOR框架,用自回归模型实现像素精准控制,比Diffusion更高效可控。

量子位
算法论文8

让GUI Agent不再「边做边忘」:快手、浙大提出MemGUI-Agent,攻克长程GUI任务

手机GUI Agent在长程任务中易遗忘关键信息,浙江大学APRIL实验室和快手主站技术部提出MemGUI - Agent,核心是ConAct,将上下文管理变为Agent动作,还开源MemGUI - 3K数据集,模型在评测基准取得佳绩。

量子位
新闻资讯7

“光顾赚钱不搞研究”,OpenAI元老高管出现离职潮,Mark Chen紧急回应

OpenAI现元老高管离职潮,如研究副总裁Jerry Tworek等。《金融时报》称与战略转向有关,Mark Chen反驳。内部因专注LLM撕裂,缺算力致资源集中ChatGPT,OpenAI危机四伏。

量子位
新闻资讯7

糟糕,Claude Opus 4.7源代码提示词曝光!底层设计全被看光

Claude Opus 4.7如期而至,性能全方位提升,编程暴打Gemini 3 Pro、GPT - 5.1。Claude Code之父分享最佳实践,还曝光系统提示词,揭示其进化逻辑,此外还提及Mythos的一些危险操作。

新智元