「多阶段训练」共找到 6045 篇相关文章

新闻资讯8

2025「中国最具价值 AGI 创新机构 TOP 50」发布

2025年中国AI行业新应用、新产品不断涌现。Founder Park从商业价值创新等四维度选出50家AI创业先锋,涵盖大公司新产品、垂直赛道头部公司和初创企业等,还介绍了如阿里生意管家、ACE Studio等众多创新产品。

Founder Park
新闻资讯8

亚马逊CEO:坚信AI Agent,能改变世界工作、生活方式

今天凌晨,亚马逊CEO Andy Jassy发文分享对AI Agent看法,坚信其会改变工作和生活方式。亚马逊内外积极应用,在购物、广告等多领域有成果,未来还将深入开发,预计员工总数会减少。

AIGC开放社区
开源动态8

Gödel Rescheduler:适用于云原生系统的全局最优重调度框架

本文介绍字节跳动研发的Gödel Rescheduler重调度框架,它能解决传统调度资源分配和任务摆放问题。阐述传统重调度弊端,介绍新方案组件,列举应用场景及成果,还提及未来规划,目前已开源。

InfoQ
开源动态7

从browser-use 出发,品 Agent 实现

本文作者以学习总结视角,从browser - use出发解析Agent实现。介绍LLM不同阶段,阐述Agent记忆、规划、工具等要素,通过对话演示和源码分析展示运行机制,还探讨MCP集成和Coze space应用模式。

阿里云开发者
算法论文8

大模型Agent的下一阶段:可自我进化的AI-Agent

在人工智能飞速发展下,研究者探索让AI自我反思改进。本文作者构建自我进化AI智能体系统,设计四层渐进式架构,经《卡坦岛》实验,证明自我进化能力,不同模型表现有差异,代码级进化潜力惊人。

AINLPer
推荐文章7

一文看懂华为昇腾芯片

文章介绍华为昇腾芯片,它是面向高性能AI计算的NPU芯片,有昇腾310、910、610等系列。还提及芯片演进、参数、价格、出货量等情况,以及基于芯片的硬件体系,覆盖多场景满足不同需求。

芯师爷
新闻资讯8

AI青年学霸齐聚杭州!这场峰会要选出「未来科学新星」

2025年6月6 - 8日,2025全球人工智能技术大会(GAITC 2025)将在杭州召开,多位院士带来重磅演讲。6月7日下午,首届“清源学者”前沿交叉峰会开幕,15位青年学者将分享原创成果,展示人工智能应用潜力。

量子位
算法论文8

谷歌之后,英伟达入局扩散大语言模型,Fast-dLLM推理速度狂飙27.6倍

大语言模型领域,推理效率制约实际应用。谷歌Gemini diffusion曾展扩散模型并行潜力,但开源扩散LLM推理慢。近日,NVIDIA等推出Fast - dLLM,无需训练即插即用,推理速度狂飙27.6倍,兼顾速度与精度。

机器之心
算法论文8

爆火论文颠覆RL认知!「错误奖励」让LLM推理暴涨24.6%,学界惊了

最新爆火论文颠覆传统RL训练认知,华盛顿大学等团队证实「伪奖励」可让LLM推理性能提升。研究设置多种伪奖励形式实验,发现其对Qwen模型有效,但并非对所有模型都有效。

新智元
推荐文章7

大模型微调知识与实践分享

文章详细介绍大型语言模型(LLM)微调知识与实践,包括模型结构、参数量等知识,以及Prompt工程、数据构造、LoRA微调等技术点。还给出微调实践流程,介绍相关平台和框架,如星云、TuningFactory等。

阿里云开发者