大模型训练」共找到 9479 篇相关文章

算法论文8

最新研究揭示视觉模型与人脑的对齐机制

FAIR与巴黎高等师范学院通过训练自监督视觉Transformer模型(DINOv3),评估脑 - 模型相似性。发现模型小、训练数据量和图像类型影响相似度,DINOv3学到的表征会逐步与人脑一致。

量子位
开源动态8

社区供稿 | Hugging Face x 北京中关村学院等机构联合发布生成式基因组模型Carbon:一场关于“生命语言”的范式革命

北京中关村学院等联合发布生成式基因组模型Carbon并开源。Carbon家族有三个版本,旗舰模型Carbon - 3B在多任务匹敌70亿参数的Evo2 - 7B,运行速度快275倍。它在数据、分词、训练上有创新,还实现技术普惠,有多种应用场景。

Hugging Face
产品应用8

昨天夸国产模型争气,今天Vidu Q3就霸榜了

国产视频模型Vidu Q3在国际权威AI基准测试机构Artificial Analysis的最新榜单里,于Video Arena冲到全球第二、国产第一。它是全球首个支持16秒音视频直出模型,声画同出、高清直出,还有镜头控制、多语言文字渲染等优势。

MacTalk
开源动态8

WAIC抢先爆料:金融“黑马”模型超DeepSeek刷新SOTA,论文已上线

WAIC期间,蚂蚁数科金融推理模型发布会未开,论文已上线。其新模型Agentar - Fin - R1有8B和32B版,在金融测评集超DeepSeek等,还兼顾专业与通用,蚂蚁数科还提出评测基准Finova。

量子位
开源动态8

空间智能终极挑战MMSI-Video-Bench来了,顶级模型全军覆没

上海人工智能实验室 InternRobotics 团队推出空间智能视频基准 MMSI-Video-Bench,对主流多模态模型进行评测。该基准题型全面、问题具挑战性,视频数据多样,能针对性测评。结果显示模型与人类差距显著,明确了能力瓶颈。

机器之心
8

李曼玲、李飞飞、吴佳俊等联手:评估具身模型的新范式!

全新的具身模型空间能力评估范式Theory of Space突破传统局限,考察模型在动态环境构建、修正和利用空间信念的能力。该论文被ICLR 2026接收,研究对前沿多模态模型评测,揭示其空间认知能力边界。

新智元
开源动态7

Karpathy组建模型「议会」,GPT-5.1、Gemini 3 Pro等化身最强智囊团

前OpenAI联合创始人Andrej Karpathy发推称养成用LLM阅读习惯,还做了个新项目,让四个最新模型组成LLM议会当智囊团。项目是Web应用,提问后多模型处理,有互评和投票机制,已开源。

机器之心
推荐文章7

端侧跑模型,现在也太简单了

作者Vicki Boykis分享本地运行AI模型体验,指出如今本地模型性能提升,像GPT - OSS、Gemma 4系列表现出色。还介绍运行本地智能体流程的设置,虽有问题,但优势多,生态值得投资。

机器之心
算法论文8

RAE+VAE? 预训练表征助力扩散模型Tokenizer,加速像素压缩到语义提取

近期,RAE 提出以「 冻结的预训练视觉表征」作潜空间提升扩散模型性能。同期西安交与微软亚研院提出 VFM - VAE,结合 RAE 与 VAE,能加速模型收敛、提升生成质量,展示扩散模型 Tokenizer 演化方向。

机器之心
推荐文章7

破局模型推理困局!华为张君详解昇腾“融合算力”的优化秘籍

华为高级开发工程师张君在AICon会演讲,围绕模型推理优化,从模型、框架、算子层展开,结合案例阐述技术方案。分析模型推理现状挑战,介绍加速技术,分享昇腾硬件算子优化实践及通算融合算子优化方法。

InfoQ