大模型数据」共找到 9999 篇相关文章

开源动态8

Hugging Face开源nanoVLM,750行代码可训练视觉语言模型,简单到令人发指!

Hugging Face开源全新视觉语言模型框架nanoVLM,仅750行代码就能从零训练高效能VLM模型。它在单张H100 GPU训练6小时后,在MMStar数据集准确率达35.3%,且能在免费Google Colab跑。

AGI Hunt
产品应用8

文心X1.1三能力狂飙,海内外实测还挺惊艳!

9日WAVE SUMMIT深度学习开发者2025会上,文心模型X1.1发布,事实性、指令遵循、智能体能力显著提升,多项测试表现佳。它能做到知识一致,精准遵循指令,智能体解决问题出色,代码、数学、多模态能力也有进化,得益于迭代式混合强化学习训练框架。

新智元
算法论文8

ACL 2026 | 中科&上海AILab揭示强化学习后训练的Scaling Law

中国科学技术学和上海人工智能实验室等团队,在Qwen2.5和Llama 3模型开展研究,揭示强化学习后训练的Scaling Law,提出幂律公式预测模型学习效率与训练轨迹,成果被ACL 2026接收。

机器之心
产品应用7

更新啦!我用 Claude Skills 做的剪辑 Agent!识别效果+交互升级

作者成峰根据用户反馈对剪辑 Skills 做了改,替换火山引擎音视频识别模型、提升交互界面。改进包括用 API 替代本地模型、重构口误识别系统、设可视化审核界面,还介绍了简单使用方法。

AI产品自由
新闻资讯7

Altman 秀新模型“翻车”,谷歌补刀躺赢!OpenAI 前员工爆肝3天,编程再赢老东家模型

近期 OpenAI 多款未发布新模型登场,一款疑是“伪装的 GPT - 5”,一款编程赛获第二。宣称在 IMO 获金牌的模型遭质疑,谷歌 DeepMind 同获金牌评价更好。OpenAI 前员工编程赛赢老东家模型

AI前线
新闻资讯8

直面LeCun愿景,智在无界发布最强具身世界模型,20万小时人类视频屠榜6榜单

智在无界作为人类视频学习路线开创者,4月14日发布第三代旗舰模型Being - H0.7,用20万小时人类视频训练,提出新范式,在6项权威评测中综合排名全球第一,拓展了世界模型能力边界。

机器之心
新闻资讯7

反转!LeCun刚转发「全球最快开源推理模型」,ETH苏黎世就直接打假

上周,MBZUAI与G42等开源号称「全球最快的开源AI推理模型」K2 - Think,引发广泛关注,图灵奖得主Yann LeCun也转发相关推文。但三天后,ETH苏黎世研究员发文指出该模型存在数据污染、评估方式不合理等问题。

新智元
开源动态8

鹏城实验室 X 中hcp实验室推出 RADAR : 具身智能评测的新标杆

RADAR是鹏城实验室与中hcp实验室为具身智能领域设计的评测基准,解决现有评测体系三缺陷,通过创新设计揭示模型不足,为研究者提供方向,推动具身智能实用化。

AI科技评论
算法论文7

Reasoning模型在RL下的探索欲望急速下降问题:探索熵机制

论文研究发现模型经强化学习训练解题时,会出现模型探索欲望急速下降的熵崩溃现象,如训练初期策略熵断崖式下跌。对此进行规律分析、追根溯源,提出破解方法,研究对AI训练范式变革有重要意义。

深度学习自然语言处理
算法论文7

GPT-6要「活」了?MIT新作曝光,AI「自进化」不远了

麻省理工学院推出全新自适应模型框架「SEAL」,让模型从「被动学习者」变为「主动进化者」。网友猜测GPT - 6可能整合其能力,成为能自主学习的模型,研究虽有局限,但为模型自进化提供新路径。

新智元