零预训练」共找到 2462 篇相关文章

产品应用7

训练大模型玩《反恐精英》:自带外挂一枪爆头,堪比职业玩家

动视暴雪、斯坦福大学和英伟达等研究人员基于职业玩家游戏数据和Transformer架构,开发游戏大模型MLMOVE。在《反恐精英:全球攻势》测试中,它表现出色,性能超现有机器人,还具提前判移动等创新。

AIGC开放社区
新闻资讯8

Ilya罕见发声:大模型「大力出奇迹」到头了

Ilya大神在近2万字采访中称,AI正从「规模时代」走向「科研时代」,主流「训练 + Scaling」路线遇瓶颈。他还探讨了AI泛化、安全对齐、训练范式等热门话题,给出独特见解。

量子位
新闻资讯8

Ilya交卷!黄仁勋砸50亿押注SSI,首个模型疑本周发布

Ilya Sutskever创立的SSI或本周发布首个重磅模型,引发圈内关注。英伟达砸50亿美元合作,提升其算力。该模型基于测试时训练架构,能边学边进化,或终结大模型“训练时代”。

新智元
开源动态8

刷新世界记录!40B模型+20万亿token,散户组团挑战算力霸权

Nous Research推出Psyche网络,用区块链汇聚全球计算资源,启动40B参数大语言模型Consilience训练,达20万亿token创纪录。还解决带宽瓶颈等问题,让AI训练去中心化,推动创新与民主化。

新智元
产品应用7

字节跳动Seed1.5-VL复杂图表精准抽取,Deep Think是多模态未来的主流

文章介绍字节跳动的Seed1.5-VL模型,它能精准抽取复杂图表,处理模糊图片、推理几何题。其由视觉编码器和LLM组成,训练语料丰富,后训练结合多种方法,推荐在huggingface体验。

CourseAI
算法论文8

全新训练数据筛选方案,让数据效率提升10倍!配置仅需fastText评分器|港科大vivo出品

香港科技大学和vivo AI Lab提出轻量级高效数据选择方法PreSelect,已被ICML 2025接收。它只需训练部署基于fastText的评分器,减少10倍计算需求,在多数据集实验中效果显著优于其他方法。

量子位
新闻资讯8

Google 发了个压缩算法,内存砍 6 倍,速度快 8 倍,精度损失

Google Research发布TurboQuant压缩算法,将在下月ICLR 2026正式发表。该算法把大模型的KV Cache压缩到3 bit,内存降6倍、速度快8倍且精度损失,解决了传统算法的压缩开销问题。

AGI Hunt
开源动态8

不用人类手写训练框架了!AI自己写代码,训出1B端侧「小钢炮」

5月25日,面壁开源端侧文本基座大模型MiniCPM5 - 1B,主打低成本部署等。它由AI编写的ForgeTrain框架参与训练,效果与英伟达Megatron对齐且速度快10%。该模型在榜单表现优,应用边界广,部署门槛低。

机器之心
新闻资讯7

具身智能稀缺的数据,可能藏在这个游戏手柄里?

游戏录屏平台Medal掌握的玩家操作记录成机器人模型训练核心数据。其创始人皮姆创办General Intuition获高额融资,该公司用游戏录像训练动作模型,但也面临数据多元性、任务表现及合作模式等问题。

DeepTech深科技
新闻资讯8

清华团队言:90%的人将脱离谋生劳动,「人公司」时代来了!

清华沈阳团队基于研究与实践提出四大颠覆判断,如AI走向「人机隔离」、未来公司只剩一人或人等。团队在模型训练、微调等多方面有成果,还探讨行业应用、知识范式颠覆等,描绘AI发展图景。

新智元