大模型预训练」共找到 9479 篇相关文章

产品应用7

训练模型玩《反恐精英》:自带外挂一枪爆头,堪比职业玩家

动视暴雪、斯坦福学和英伟达等研究人员基于职业玩家游戏数据和Transformer架构,开发游戏模型MLMOVE。在《反恐精英:全球攻势》测试中,它表现出色,性能超现有机器人,还具提前预判移动等创新。

AIGC开放社区
新闻资讯7

性能翻番背后:讯飞与昇腾,如何用国产算力炼就模型?|甲子光年

在全球AI竞争激烈背景下,科讯飞与华为昇腾深度合作意义重。双方合作历经四阶段,实现性能提升与技术突破,还通过软硬件协同构建AI自主发展竞争力,加速模型行业落地。

甲子光年
开源动态8

Google开源黑科技!不用训练的时间序列预测模型,17.9K Star 疯狂追捧!

Google Research团队开源的TimesFM时间序列预测模型获17.9K Star。它零训练、开箱即用,基于1000亿时间点预训练,涵盖多场景数据,还能给出置信区间,已集成到Google多个产品。

开源星探
算法论文8

EMNLP2025 | 解耦视觉与推理,港探索视觉语言模型"眼智分离"新范式

当前视觉语言模型处理复杂推理任务时,常过分依赖语言知识,忽视图像关键信息。港等团队提出ProReason框架,其蒸馏的ProReason - VL和ProReason - Q3模型性能提升显著,为LVLMs发展提供方向。

深度学习自然语言处理
算法论文7

剑桥揭开模型翻车黑箱!别再怪它不懂推理,是行动出错了

剑桥学等机构研究指出,模型执行长时任务易翻车,问题不在推理而在执行能力。研究人员评估多个指标,发现单步准确率提升可让任务长度指数增长,还研究了自条件化等影响及模型规模的作用。

新智元
开源动态7

类R1训练不再只看结果对错!港中文推出SophiaVL-R1模型

DeepSeek - R1爆火后,类R1结果奖励训练范式引发推理热潮,但仅以结果对错奖励模型有弊端。港中文联合团队发布多模态推理模型SophiaVL - R1,引入‘思考奖励’机制,还用Trust - GRPO算法解决奖励欺骗问题。

机器之心
算法论文8

直接从像素到单词:这个原生模型统一单图、多图、视频和空间智能

南洋理工学等团队推出NEO - ov模型,挑战传统「视觉编码器 + 模型」范式,直接从原始像素学语言。它在多任务表现出色,尤其空间智能突出,但在OCR等方面有短板,展现原生多模态建模潜力。

机器之心
算法论文7

Google 新论文离谱到家了,0延迟0成本通用,提升模型准确率最简单的方法。

Google新论文提出简单提升模型准确率的方法,即重复提示词,把完全一致的输入连续发2次。主流模型适用,经70项benchmark测试,0场景效果倒退,47个场景准确率提升,且几乎不增延迟、成本。

探索AGI
开源动态7

1万4颗星!机械臂可以接模型了!面向真实世界机器人的尖端人工智能LeRobot

LeRobot 为 PyTorch 中真实世界机器人提供模型、数据集和工具,降低入门门槛。包含尖端方法,已提供预训练模型等,未来将增加真实机器人支持,文中还介绍其安装、使用等内容。

GitHubStore
算法论文8

模型自己写代码、自己进化,GIM和港这篇ACL主会,把量化因子挖掘重做了一遍

香港学和GIM提出CogAlpha框架,将Alpha从‘公式’升级为‘代码’,搭建7层21个智能体探索体系,让模型参与研究流程。在5个数据集上跑赢21个基线方法,还具可解释性。

机器之心