「双预训练架构」共找到 3648 篇相关文章
智能体时代的强化学习:AReaL 框架与 Agent 最佳实践
本文整理自吴翼博士在 2025 年 QCon 全球软件开发大会的分享。他介绍 AReaL 框架及 Agent 最佳实践,阐述强化学习与大模型联系,指出 Agent 是 AGI 未来 5 年关键,强化学习是 Agent 技术核心,还分享团队成果与经验。
罕见!Meta、OpenAI、xAI联合分享了用生产环境提升LLM的最佳实践!
Meta、OpenAI、xAI联合发表成果CharacterFlywheel,聚焦在生产环境提升社交型AI对话能力。团队基于LLaMA 3.1迭代15个版本,7/8的A/B测试显示正向提升,介绍了架构、数据管道、奖励模型等内容。
OpenAI要跳过5.3,直接迈向GPT-5.4了?
近日,一名OpenAI工程师在公开的Codex GitHub仓库中提交拉取请求,让GPT - 5.4型号出现在代码版本判断条件中,同时有用户发现它曾短暂出现在Codex应用的模型选择器里。线索被迅速修改或删除,引发诸多猜测。
代码暴减99.9%!独立开发者仅用500行代码做出安全版OpenClaw,GitHub星数狂飙
近日,独立开发者 gavrielc 制作的开源 AI 助手 NanoClaw 火了。它核心代码仅约 500 行,实现 OpenClaw 同等核心功能。相比原版 Clawdbot 代码量大减,还解决了 OpenClaw 安全架构问题,是其安全替代方案。
千星项目LLMRouter:多模型路由,16+策略优化推理
UIUC开源智能模型路由框架LLMRouter,可自动为大模型应用选最优模型,有16+路由策略。该框架打通训练、评测等链路,解耦Route与Training模块,支持多轮协同等,还可插件式扩展。
空间智能爆发只需24个月?群核科技首席科学家唐睿预言:具身智能才是AGI终极形态 | 万有引力
群核科技首席科学家唐睿在访谈中表示,空间智能是具身智能基础设施,可解决其数据不足痛点。破数据瓶颈靠普及感知硬件,2D、视频与3D生成走向融合,空间智能爆点24个月内或随硬件突破到来。
0.005%参数量超越SOTA!提升模型能力无需庞大奖励模型
上海交通大学等校联合团队提出轻量级奖励模型SWIFT,利用大模型隐藏状态线性特征,仅训练极小线性层,在推理任务中超越主流奖励模型,实现计算效率与准确率双提升,且在多领域表现出色。
又是中国团队!一条链接出片,电商AI视频迎来「DeepSeek时刻」
电商AI视频此前生成效果不佳,难以用于投放。营赛AI发布的inSai Hilight是“下一代营销视频解决方案”,在权威评测中表现出色,能保证商品和数字人一致性,靠知识图谱等技术实现高质量视频生成。
Claude Cowork唱罢,开源Clawdbot登场!
本文介绍开源专属个人AI助手Clawdbot项目,已33.7k Star。阐述其功能,如整理文件、处理邮件等;对比与Claude Cowork异同;还探讨个人AI助手生态系统架构,认为它代表未来AI应用落地方向。
微软打包收购OpenAI?就差一点!
OpenAI奥特曼被董事会罢免时,微软差点雇佣式收购,资金、文书一天到位。微软曾对OpenAI商业化存疑,而奥特曼不想被其完全掌控,签亚马逊大单。此外,马斯克索赔,OpenAI要防御多方围猎。