大规模数据」共找到 6879 篇相关文章

算法论文8

多模态后训练反常识:长思维链SFT和RL的协同困境

华为与香港科研究发现,多模态视觉语言模型中,长思维链SFT与RL组合难协同增益。研究引入难度分类方法构建数据集,分析各方法表现及组合策略困境,还给出实验发现与未来研究方向。

机器之心
产品应用7

Spring AI 实战|Spring AI入门之DeepSeek调用

文章介绍Spring AI框架,它简化企业数据或API服务与模型集成,降低开发复杂度。还给出调用DeepSeek的实战步骤,包括手动请求、代码自动发起、实现流式响应等,也提及OpenAI starter的兼容性及生产环境监控。

阿里云开发者
推荐文章7

百度AI+ DeepSeek 豆包等GEO怎么做出排名?5个技巧,附快排与白帽操作区别

文章介绍GEO优化在AI模型2 - 3天出排名的5个技巧,包括官网SEO梳理、词库挖掘整理、内容数据投喂、市场竞对分析和技术策略微调,还对比快排与白帽GEO服务商,强调合规操作。

白杨SEO优化教程
算法论文8

机器人的「GPT时刻」来了?丰田研究院悄悄做了一场最严谨的VLA验证实验

丰田研究院(TRI)团队研究型行为模型(LBM),在近1700小时机器人数据上训练并量部署评估。发现LBM性能提升显著,预训练小数据量也能带来增益,预示机器人通用模型或到来。

机器之心
算法论文8

监督学习也能从错误中学习反思?!清华英伟达联合提出隐式负向策略爆炸提升数学能力

清华学与英伟达、斯坦福联合提出监督学习方案NFT,在RFT算法基础上构造“隐式负向模型”利用负向数据训练。该策略弥合监督与强化学习差距,其损失函数梯度和GRPO在On - Policy条件下等价。

量子位
算法论文8

模型遗忘不代表记忆抹除!首次系统发现「可逆性遗忘」背后规律

研究人员发现语言模型遗忘并非简单信息删除,可能藏于内部。他们构建表示空间诊断工具,区分可逆与不可逆遗忘,揭示真正遗忘是结构抹除。还在多种方法、数据集和模型上实证,得出系列结论。

新智元
新闻资讯7

1.6万人「卷」出科学未来!盛夏AI4S上海巅峰赛,谁人终得桂冠?

7月25 - 26日,第三届世界科学智能赛总决赛及颁奖典礼在上海举行。赛面向全球选拔,设五赛道,吸引近1.6万人参赛。赛秉持开源开放,成果将在星河启智平台共享,还开辟中学组,展现青少年潜力。

新智元
新闻资讯7

独家 | 华为天才少年楼燚航离职创业,要做 200B 以上的「具身脑」

前华为“天才少年”楼燚航离职创立引力蓝移,定位构建具身脑。其采用分层架构,认为具身智能Scaling拐点已至,规划了数据来源和模型参数规模。正与汇川合作,按24个月规划推进,面临产品验证挑战。

AI科技评论
算法论文8

ICLR 2026|首个微观世界模型MicroVerse来了,AI开始模拟看不见的世界

过去两年,世界模型成为模型演进重要方向,但现有模型多聚焦宏观世界。本文提出MicroVerse模拟框架,将研究边界拓展到微观尺度,还推出MicroWorldBench评测基准和MicroSim - 10K数据集,推动AI从视觉模拟迈向科学模拟。

机器之心
开源动态8

5B参数+4060Ti,10秒出图,全流程开源可复现!补齐统一多模态生成编辑的开源版图,让高质量图像生成真正变得更轻量、更普及

近日,多机构联合发布统一多模态生成编辑模型DeepGen 1.0,仅5B参数,集成五能力,4060ti 16G上10秒出图,多项指标超4倍工业级模型。团队开源全流程代码与数据,可从零复现。

量子位