大模型预训练」共找到 9494 篇相关文章

算法论文8

推荐模型来了?OneRec论文解读:端到端训练如何同时吃掉效果与成本

随着AI发展,推荐系统面临诸多问题,快手技术团队提出OneRec,以端到端生成式架构重构推荐系统全链路,在效果与成本上实现突破,已在快手双端服务用户,也有需完善之处。

机器之心
产品应用7

训练世界模型,开始从人类的肌肉和脑子里偷师了

具身智能数据竞争进入新阶段,第一视角视频虽缓解数据量问题,但未记录人行动的原因及脑身体实时修正。FaceMind提出Ego - NeuroLoop数据范式,配套NeuroMatrix和NeuroBooster,将训练数据从“行为库”推向“闭环库”。

量子位
新闻资讯8

谷歌2025「复仇爽文」结局!从至暗时刻到王者归来

2025年谷歌上演AI复仇戏,年初被唱衰,年底凭Gemini 3等组合拳重回巅峰。在模型、开发、创意等8领域突围,还兼顾安全责任。全年各月不断推新,涵盖系统、工具、模型等多方面。

新智元
开源动态8

没想到,音频模型开源最彻底的,居然是小红书

近几个月,开源成AI社区焦点,国内厂商七八月开源多款模型,但音频生成占比小。小红书技术团队自去年起在音频领域稳定开源,成果覆盖TTS、ASR方向,具商用属性,降低落地门槛。

机器之心
算法论文8

何恺明首个语言模型:105M参数,不走GPT自回归老路

何恺明团队推出全新连续扩散语言模型ELF,不走GPT自回归老路。它将生成过程留在连续embedding空间,最后离散化变回token。ELF用较少参数、训练token和采样步数,跑赢主流扩散语言模型

量子位
新闻资讯8

硅谷今日最热具身模型!不用后训练,看一遍就学会

北美具身初创Skild AI发布全新机器人基础模型S1,主打上下文学习,能看示范视频完成复杂操作。在未见过任务上成功率达66%,远高于传统方法。其发展或让开发机器人技能像给ChatGPT写Prompt。

量子位
开源动态8

谷歌最强AI,被港科开源超了?让海外创作者喊出「King Bomb」的P图杀器来了

图像编辑与生成模型爆发,冲击Photoshop地位。港科贾佳亚团队开源DreamOmni2,优化升级多模态指令编辑与生成能力,效果获海外创作者认可,还在实测中表现出色,其采用创新技术方案构建多模态生成体系。

机器之心
新闻资讯7

多模态扩散模型开始爆发,这次是高速可控还能学习推理的LaViDa

近期基于扩散模型的视觉 - 语言模型 LaViDa 出现,它继承扩散语言模型优点。与自回归模型不同,扩散模型能并行、处理双向上下文。LaViDa 在多任务测试有竞争力,推理蒸馏和文本填空表现好,还能权衡速度与质量。

机器之心
8

AI教父Geoffrey Hinton,全球第二个百万引用科学家!

AI教父Geoffrey Hinton论文被引数破百万,成全球第二人。其代表作如AlexNet、Deep Learning等影响深远,覆盖理论、技巧等层面,支撑模型运行。他还称模型是黑箱,领域待探索。

新智元
开源动态8

AAAI 2026 Oral|InfiGUI-G1模型来了,刷新GUI Grounding SOTA

多模态语言模型发展下,GUI Grounding任务是难题,现有RLVR方法有瓶颈。浙江学等团队提出AEPO框架,推出InfiGUI - G1系列模型,小参数量刷新GUI基准测试SOTA,代码已开源。

机器之心