长任务」共找到 2435 篇相关文章

新闻资讯7

把AI变成你的科研搭子,公益培训启动报名!

面对科研难题,AI科研加速营招募启动。由上海人工智能实验室等主办,公益开放。以真实科研任务为主线,用“书生·端砚”实践,课程覆盖多领域,学员可获多种权益。

OpenMMLab
开源动态7

Harness Engineering 实践:Fitness Function 如何成为 AI 交付的防腐层

文章探讨 Harness Engineering 实践中,Fitness Function 如何成为 AI 交付防腐层。指出在 AI Agent 参与开发时,判断任务完成是难题,介绍 Routa 项目构建 Fitness 架构及规则执行等实践。

phodal
产品应用8

干翻全场!OpenAI深夜发布通用Agent。

OpenAI 发布 ChatGPT Agent,将 Operator 和 Deep Research 能力融合,能在虚拟电脑完成复杂任务。它功能强大亮点多,但也存在价格昂贵、安全隐患等问题,或压缩创业公司空间。

探索AGI
算法论文8

同时监督和强化的单阶段大模型微调,告别“先背书再刷题”,推理泛化双提升|中科院&美团等

中国科学院自动化研究所联合美团提出单阶段监督 - 强化微调方法 SRFT,结合监督微调与强化微调,解决传统两阶段方法的不足,在多任务中提升推理和泛化能力。

量子位
产品应用7

Sora 为什么输给 Codex?

本文探讨Sora输给Codex的原因。奥特曼称因Sora太吃compute,Codex优先级更高。Sora算力连续独占,成本难摊薄;Codex算力碎片可复用,能交错服务多任务,资源回报曲线更好。

AI科技评论
算法论文8

MIT这篇RLM论文,给出了Scaling的另一种可能~

当大家普遍认为解决上下文问题要靠扩大模型上下文窗口时,MIT 最新的 RLM 论文提出新路径。其 code 已开源,能实现无界上下文处理,可让任意大语言模型处理 10 万 +token。

PaperAgent
推荐文章7

大语言模型高考数学拿高分靠强化学习,那文科考高分得靠什么?

大语言模型在高考数学拿高分靠强化学习,但文科题无标准答案,此方法行不通。豆包1.6系列高考文科全科获683分,靠训练数据、思维链、上下文和多模态直接读图等因素。

宝玉AI
产品应用8

Claude Managed Agents 公测发布!Agent 开发成本直降 500 倍

Claude 宣布 Managed Agents 进入公测,可大幅降低 Agent 开发成本。它能自动生成配置和代码,接管多项任务,实现时间自主运行。多家早期客户使用后效果显著,还介绍了定价、接入方式及与自建的差异。

AGI Hunt
新闻资讯7

DeepSeek 推出快速模式和专家模式

DeepSeek web 端灰度测试快速模式和专家模式,快速模式用于日常会话,专家模式适合复杂任务,但不支持文件上传,上下文仅 128k。目前两模式能力与 v3.2 没差别,或为 v4 做准备。

AI寒武纪
新闻资讯7

今天起全员免费!GPT-4.1上线ChatGPT,首波实测:又快又听话,油腻感没了

今天凌晨起,GPT - 4.1可在ChatGPT中供所有用户使用。它专为编码任务和指令执行设计,推理效率高。首波实测反馈速度快、需明确指示且更清爽,性价比高,是日常编码的好选择。

量子位