后训练技术」共找到 5938 篇相关文章

新闻资讯7

798现场|算法下的生活新常态

科技发展重塑社会关系,艺术为理解变化提供视角。798艺术区有两个展览,郭城的“虫”探讨技术理性双重性,蒲英玮的“红色计算机”探讨AI权力结构,展现科技与文明发展寓言。

798艺术区
新闻资讯7

谁在幕操控特朗普2.0?PayPal黑帮与“科技共和国”野心 | 赠书福利

2025年特朗普启动国家级AI发展计划,背是硅谷技术精英。他们用资本等重塑美国权力逻辑,核心是彼得·蒂尔。“技术加速主义”思潮兴起,主张技术进步解决问题,亚历山大·卡普构想“科技共和国”。

InfoQ
算法论文8

CL-Bench的故事没有结束,生成式CL-Bench:GENIUS来了

北大团队发布GENIUS,用于评估模型生成式流体智力。它构建含510个样本、20个子任务的评测集,测试模型多方面能力。实验显示当前模型流体智力有短板,还提出免训练注意力校准机制提升性能。

机器之心
算法论文8

ICLR 2026 Oral | 西湖大学发布Real PDE Bench

复杂物理系统时空演化预测是核心问题,当前AI模型多在数值仿真数据上训练,难以评估其在真实数据上的表现。西湖大学等实验室提出RealPDEBench,含真实与仿真数据,设三类任务、九个评估指标和十个基线方法。

力学与人工智能
新闻资讯7

DeepSeek正开发高级AI Agent模型,硬刚OpenAI

彭博消息,DeepSeek正开发高级AI Agent模型与OpenAI竞争。此模型能在极少指令下执行多步任务并自我优化,计划Q4推出。此前该司模型表现佳,技术已在多领域落地,但构建AI Agent仍有挑战。

AIGC开放社区
开源动态8

让GPU不再摸鱼!清华蚂蚁联合开源首个全异步RL,一夜击穿14B SOTA

清华与蚂蚁联合开源AReaL - boba²,实现全异步强化学习训练系统,解耦模型生成与训练流程,大幅提升GPU利用率。14B模型在多个代码基准测试达SOTA,性能接近235B模型。

新智元
新闻资讯8

13岁小孩哥当上CEO,22岁造独角兽!少年帮扎堆辍学,集结硅谷创业

在旧金山,一群00从名校辍学投身AI创业,如Brendan Foody等三位00CEO创办公司获巨额融资。还有13岁、16岁等少年也下场创业,Z世代CEO正重塑AI创业年龄门槛。

新智元
算法论文8

通义团队提出环境Scaling:自动构建环境,并自主学习和成长,可让30B比肩1T效果

阿里巴巴通义实验室团队论文提出通过程序化、自动化构建模拟环境,让语言模型自主交互学习。基于此训练的AgentScaler模型,数十亿参数就达万亿级模型性能,为轻量级代理智能发展带来新可能。

深度学习自然语言处理
产品应用8

美团之,京东也开始自研大模型了

京东发布JoyAI - LLM Flash模型,激活参数小、推理快。它采用混合专家架构等技术,在基础架构、数据加工、强化学习等方面表现出色,还通过多Token预测等技术加速推理,为商业场景落地扫清障碍。

AIGC开放社区
新闻资讯7

林俊旸Agent创业首次亮相,腾讯已投

前Qwen一号位林俊旸官宣创业公司Pragmatik Labs,方向为做横跨数字与物理世界的下一代Agent。公司获高榕、红杉、腾讯等投资,投估值达20亿美元。虽无产品模型,但凭借林俊旸过往成绩受关注。

量子位