任务递进训练」共找到 3668 篇相关文章

推荐文章7

后端架构新范式!阿里云专家亲揭:用RocketMQ彻底搞定多Agent异步协同难题

文章整理自阿里云专家演讲,介绍基于 Apache RocketMQ 新特性构建异步化 Multi - Agent 系统,探讨 Agent 间异步通信等机制,指出 Multi - Agent 协同关键,还讲了 RocketMQ 新特性及如何构建异步系统。

AI科技大本营
新闻资讯8

林俊旸从阿里离开后首度发声:推理模型的时代快结束了

前通义千问Qwen负责人林俊旸离职后发长文,指出AI正从「推理思考」转向「智能体思考」,分析推理模型发展,谈混合思考模式失败,还提及智能体思考挑战及相关企业、学术界进展。

花叔
算法论文8

物理AI的「原生」时刻:原力灵机发布具身大模型DM0

主流‘预训练 - 后适配’范式有局限,原力灵机联合阶跃星辰提出具身原生 VLA 模型 DM0。它能统一机器人操作与导航,在 RoboChallenge 测试领先,还介绍了架构、训练方法及未来演进方向。

机器之心
推荐文章8

从 ReAct 到 Ralph Loop:AI Agent 的持续迭代范式

文章围绕AI Agent持续迭代范式展开,指出AI编程助手现存过早退出等问题,介绍了Ralph Loop范式,阐述其核心要素、原理、优势,对比与传统智能体循环差异,还给出使用最佳实践、适用场景与建议。

阿里云开发者
算法论文8

击败Meta登榜首:推理增强的文档排序模型ReasonRank来了

本文第一作者刘文涵聚焦AI搜索研究。提出推理增强的文档排序模型ReasonRank,在多个榜单击败多校和机构登榜首,其7B版本超越32B模型,论文获Huggingface paper日榜第一。还介绍研究动机、方法及实验结果等。

机器之心
新闻资讯7

刚刚,OpenAI发布自主编码代理Codex,程序员的工作将被彻底颠覆?

OpenAI发布自主编码代理Codex,它能独立完成编程任务。与其他工具不同,它是面向任务的,允许并行工作。虽经强化学习微调,代码有“品味”,但有局限,如后续请求处理不佳,未完全集成工程环境。

AGI Hunt
推荐文章8

提示工程实战指南:从Zero-Shot到Graph Prompting,7大核心技术全解析

随着大型语言模型发展,提示工程成关键技能。文章介绍零样本提示、少样本提示等七种提示优化模式,分析适用场景、优缺点,还给出示例,最后总结各技术适用场景及最佳实践。

OpenMMLab
推荐文章8

刚刚!北大校友Lilian Weng最新博客来了:Why We Think

北大校友Lilian Weng更新博客《Why We Think》,回顾利用测试时计算的研究进展,探讨让模型“思考更久”的方法。文中介绍了思维链、潜变量建模等策略,还提及多种提升生成质量的策略,如并行采样与序列修订,以及强化学习提升推理能力等内容。

机器之心
推荐文章8

相比层出不穷的 Agent 框架,不变的 Agent Protocol 是什么

文章围绕 Agent Protocol 展开,指出框架更迭但生产级 Agent 系统问题不变。以 Agent Protocol 为主线拆分 Agent Runtime,探讨其核心、稳定对象、执行模型等,还对比各框架在多维度的表现并给出设计建议。

阿里云开发者
产品应用7

FlowUs 创始人创立 Kollab,要为 AI 构建团队大脑

AI 从对话框向 Agent 等形态演变,完成单个任务能力增强,但工作场景中仍有协作断裂问题。Kollab 产品想解决此问题,让任务在组织自动流动,切中 Team - level AI,有共享工作空间等 4 个层级。

投资实习所