两阶段训练法」共找到 3112 篇相关文章

新闻资讯7

ChatGPT聊天记录成法庭铁证,韩国汽车旅馆双命案反转

韩国一女子用含苯二氮䓬类药物的饮料毒杀名男子,警方从其手机挖出与ChatGPT的对话记录,成判定其杀人意图的铁证。此案件暴露AI安全漏洞,也引发对AI失控风险及数据隐私的担忧。

新智元
新闻资讯8

刚刚,全球视频模型新王诞生了!

天工AI的SkyReels-V4直接登顶Artificial Analysis文转视频全球榜,超越Veo 3.1、Sora 2。其相比之前有大核心升级,让视频生成从‘生成片段’走向完整视频生产,还应用于短剧平台DramaWave。

量子位
产品应用7

企业级靠谱龙虾升级,拒绝失控

OpenClaw爆火又降温,凸显轻量化智能体短板,企业需具精准业务理解和多技能协同能力的AI员工。滴普科技升级Deepexi企业大模型,其与平台构成DeepexiOS,支撑企业AI体系化建设。

量子位
算法论文8

迈向原生全模态AI智能体:人大&小红书发布OmniGAIA新基准

中国人民大学等团队推出 OmniGAIA 新基准及 OmniAtlas 训练框架。OmniGAIA 含 360 个高难度任务,覆盖多领域。实验显示闭源与开源模型差距大,OmniAtlas 显著提升开源模型表现,并指出未来全模态智能体发展方向。

PaperAgent
推荐文章8

智能体时代的强化学习:AReaL 框架与 Agent 最佳实践

本文整理自吴翼博士在 2025 年 QCon 全球软件开发大会的分享。他介绍 AReaL 框架及 Agent 最佳实践,阐述强化学习与大模型联系,指出 Agent 是 AGI 未来 5 年关键,强化学习是 Agent 技术核心,还分享团队成果与经验。

InfoQ
开源动态8

千星项目LLMRouter:多模型路由,16+策略优化推理

UIUC开源智能模型路由框架LLMRouter,可自动为大模型应用选最优模型,有16+路由策略。该框架打通训练、评测等链路,解耦Route与Training模块,支持多轮协同等,还可插件式扩展。

新智元
算法论文8

像开发软件一样造世界,Agent2World来了,把世界模型做成可运行的符号环境

为让模型真正“能行动”,需可执行、可验证的符号世界模型,但现有自动生成路线有困局。研究团队提出 Agent2World,经实验验证有显著效果,能稳定产出高质量符号世界模型,开辟 AI 理解现实环境新可能。

机器之心
新闻资讯8

空间智能爆发只需24个月?群核科技首席科学家唐睿预言:具身智能才是AGI终极形态 | 万有引力

群核科技首席科学家唐睿在访谈中表示,空间智能是具身智能基础设施,可解决其数据不足痛点。破数据瓶颈靠普及感知硬件,2D、视频与3D生成走向融合,空间智能爆点24个月内或随硬件突破到来。

AI科技大本营
算法论文8

0.005%参数量超越SOTA!提升模型能力无需庞大奖励模型

上海交通大学等校联合团队提出轻量级奖励模型SWIFT,利用大模型隐藏状态线性特征,仅训练极小线性层,在推理任务中超越主流奖励模型,实现计算效率与准确率双提升,且在多领域表现出色。

AIGC开放社区
新闻资讯7

这可能是今年门槛最低的黑客松比赛,速来!

2026开年Skill热度攀升,因其易搭建易分享且能交付结果。Founder Park联合扣子举办Skill招募大赛,设职场和极客赛道,有流量、付费等奖励,还公布赛程、报名方式及好Skill的标准。

Founder Park