「从零训练」共找到 4892 篇相关文章
社区供稿丨如何抑制大模型的“过度反思”:Yuan3.0 Flash 中的强化学习范式
大模型在企业落地时存在“过度反思”问题,浪费算力。YuanLab.ai团队在Yuan3.0 Flash模型中提出RIRM与RAPO,前者奖励“思考过程”,后者优化训练框架,实现推理效率提升,适用于企业场景。
苹果庞若鸣也被小扎挖走!Meta AI天团开会直接用中文吧
Meta超级AI实验室内部交流可用中文,苹果基础模型团队负责人庞若鸣被其挖走。Meta还从OpenAI和Anthropic各挖一人。目前其AI天团14人名单中9个是华人,苹果AI进展堪忧。
集成20+先进算法,优于GPT-4o,自主因果分析智能体来了
加利福尼亚大学圣迭戈分校研究团队提出自主因果分析智能体 Causal - Copilot,集成超 20 种算法。它解决因果分析使用门槛高、预训练模型有局限等问题,性能优于 GPT - 4o ,已开源邀全球研究者参与。
被 AI 大厂逼至绝望,这帮欧洲人发起了一场“科学复兴运动”
AI前沿成果被科技巨头锁在“黑箱”,欧洲科学家、工程师等发起“科学复兴运动”成立LAION。他们构建开放数据集,训练出表现优异的模型,还进行“爱丽丝梦游仙境”研究测试大模型,探讨推理模型发展方向。
字节跳动开源文档解析大模型Dolphin,告别繁琐的文档处理,上线狂揽1k星,真是绝了!
字节跳动开源文档解析大模型Dolphin,采用两阶段分析 - 解析范式,有异构锚点提示等功能,适用多领域。技术架构基于视觉 - 编码器 - 解码器,训练集超3000万个样本,安装推理简单,比同类更具竞争力。
60000小时炼出新开源VLA!20多种机器人都能用
蚂蚁灵波发布开源VLA模型LingBot-VLA 2.0,用60000小时预训练数据“喂”出。它支持20多种机器人构型,融合LingBot-Depth提升空间理解,还学会预测未来,在GM - 100评测表现佳。
ICML 2026 | 突破3DGS光度多义性瓶颈:北航/新国立提出AmbiSuR,重塑高保真3D几何重建
3D高斯泼溅推动神经渲染发展,但提取3D几何表面易失真,核心瓶颈是光度多义性。北航与新国大团队提出AmbiSuR框架,从表征和监督层面解决问题,实验证明其在多数据集表现优异。
Anthropic 最新播客:如何打造下一代 Claude
Anthropic的Alex Albert上播客揭秘Claude产研流程,涵盖模型规划、用Claude处理反馈、记忆“做梦”机制、性格训练等,还谈及AI对PM工作方式的重塑,以及单向门决策框架等内容。
Claude Cowork 解读和 Open-Cowork开源实现
Claude Cowork是Anthropic推出的AI工作代理工具,可操作文件、执行长期任务,现处研究预览阶段。因使用门槛高,GitHub出现开源项目Open - Cowork,零代码门槛、多模型支持,有文件管理等功能。
MIT天才博士刚毕业,就被前OpenAI CTO抢走!年薪或300万起步
MIT天才博士肖光烜刚毕业就官宣加盟Thinking Machines,主攻大模型预训练。他履历耀眼,博士论文破解LLM三大难题,构建高效大模型框架。Thinking Machines薪资可观,平均年薪超OpenAI等公司。