训练技术」共找到 4594 篇相关文章

新闻资讯8

刚刚,OpenAI发布CoT监控,增强AI Agent自主能力

今天凌晨,OpenAI发布思维链(CoT)监控技术论文,用于监督AI Agent,增强其自主性。思维链监控可调试故障、合规审计,是构建安全透明AI的蓝图,文中还提及CoT监控必要性及有效方法。

AIGC开放社区
新闻资讯8

Ilya罕见发声:大模型「大力出奇迹」到头了

Ilya大神在近2万字采访中称,AI正从「规模时代」走向「科研时代」,主流「预训练 + Scaling」路线遇瓶颈。他还探讨了AI泛化、安全对齐、预训练范式等热门话题,给出独特见解。

量子位
新闻资讯7

798现场|算法下的生活新常态

科技发展重塑社会关系,艺术为理解变化提供视角。798艺术区有两个展览,郭城的“虫”探讨技术理性双重性,蒲英玮的“红色计算机”探讨AI权力结构,展现科技与文明发展寓言。

798艺术区
新闻资讯7

谁在幕后操控特朗普2.0?PayPal黑帮与“科技共和国”野心 | 赠书福利

2025年特朗普启动国家级AI发展计划,背后是硅谷技术精英。他们用资本等重塑美国权力逻辑,核心是彼得·蒂尔。“技术加速主义”思潮兴起,主张技术进步解决问题,亚历山大·卡普构想“科技共和国”。

InfoQ
算法论文8

推理效率狂飙60倍:DiDi-Instruct让扩散大模型16步超越千步GPT

普渡大学等研究者提出 DiDi-Instruct 后训练方法,可将扩散大语言模型推理加速 60 倍,超越传统 GPT 模型。该方法实现推理效率与效果双提升,为大语言模型落地提供新方案。

机器之心
算法论文8

CL-Bench的故事没有结束,生成式CL-Bench:GENIUS来了

北大团队发布GENIUS,用于评估模型生成式流体智力。它构建含510个样本、20个子任务的评测集,测试模型多方面能力。实验显示当前模型流体智力有短板,还提出免训练注意力校准机制提升性能。

机器之心
算法论文8

ICLR 2026 Oral | 西湖大学发布Real PDE Bench

复杂物理系统时空演化预测是核心问题,当前AI模型多在数值仿真数据上训练,难以评估其在真实数据上的表现。西湖大学等实验室提出RealPDEBench,含真实与仿真数据,设三类任务、九个评估指标和十个基线方法。

力学与人工智能
新闻资讯7

DeepSeek正开发高级AI Agent模型,硬刚OpenAI

彭博消息,DeepSeek正开发高级AI Agent模型与OpenAI竞争。此模型能在极少指令下执行多步任务并自我优化,计划Q4推出。此前该司模型表现佳,技术已在多领域落地,但构建AI Agent仍有挑战。

AIGC开放社区
开源动态8

让GPU不再摸鱼!清华蚂蚁联合开源首个全异步RL,一夜击穿14B SOTA

清华与蚂蚁联合开源AReaL - boba²,实现全异步强化学习训练系统,解耦模型生成与训练流程,大幅提升GPU利用率。14B模型在多个代码基准测试达SOTA,性能接近235B模型。

新智元
产品应用8

Agent当上群主后,群聊变成办事大厅了

文心APP内测“多人、多Agent”群聊功能,像微型“办事处”,能替人办事、支招,效率高。百度文心团队提出Group - MAS攻克技术难关,此功能是全栈技术验证,还将有新玩法。

量子位