「任务完成时间视野」共找到 2972 篇相关文章
刚刚,OpenAI最强编程智能体上线ChatGPT
OpenAI宣布在ChatGPT中引入Codex研究预览版。它是云端软件工程智能体,能并行处理多项编程任务。自今日起,部分用户可使用,后续将推付费选项。目前处于早期开发阶段,未来计划推更灵活工作流。
用多模态LLM超越YOLOv3!强化学习突破多模态感知极限|开源
华中科技大学、北京邮电大学等多所高校研究团队共同推出纯多模态开源LLM——Perception-R1,该模型用强化学习优化视觉感知,目前论文和代码均已开源,其在视觉任务上表现出色,为后续研究提供强大baseline。
首个长程Doc2Repo训练集!代码Agent不止修bug,开始造仓库
中国人民大学高瓴人工智能学院发布DeNovoSWE数据集,专注长程软件工程任务。它通过特定机制构造高质量数据,为代码智能体长程能力训练提供支持,实验显示能显著提升模型仓库生成能力。
豆包收费版第一天,我:充值…又得充值?我要再充值!
豆包开启付费模式,有三档收费标准,学生还有专属优惠。实测发现,付费版体验成熟,办公任务模式友好,但额度消耗快。文章还给出不同人群适合的档位建议。
让Agent真正“行动”起来,Agent Skill开发者大赛火热报名中!
人工智能下半场关键词是“行动”,Agent Skill成关键桥梁。Agent Skill开发者大赛今日启动,由AIGC开放社区与算泥社区联合主办,聚焦真实任务执行,设双赛道,官方提供支持,有丰厚奖励。
Anthropic 估值 3800 亿,增长营销只有 1 个人,还不会写代码
Anthropic估值3800亿美元,增长营销团队仅一人。该负责人用Claude Code搭建自动化工作流,完成传统团队多人的活。不止营销部门,其他部门也用它提效,反映OPC趋势。
麦肯锡调研了 50 个一线 AI 智能体的项目总结出来的六条经验
麦肯锡调研50个AI智能体真实项目,提炼出开发智能体的6个关键因素,如关注整体流程、明确适用任务、避免制造“AI垃圾”等,助企业从智能体中捕获价值。
把AI变成你的科研搭子,公益培训启动报名!
面对科研难题,AI科研加速营招募启动。由上海人工智能实验室等主办,公益开放。以真实科研任务为主线,用“书生·端砚”实践,课程覆盖多领域,学员可获多种权益。
Agent下半场!比Prompt更重要的是「上下文工程」,Anthropic首次系统阐述
Anthropic发文章阐述上下文工程,指出构建语言模型重点正从提示工程转向上下文工程,探讨了其与提示工程区别、重要性,给出实践指导原则、新趋势及应对长时程任务策略。
同时监督和强化的单阶段大模型微调,告别“先背书再刷题”,推理泛化双提升|中科院&美团等
中国科学院自动化研究所联合美团提出单阶段监督 - 强化微调方法 SRFT,结合监督微调与强化微调,解决传统两阶段方法的不足,在多任务中提升推理和泛化能力。