大模型数据」共找到 9982 篇相关文章

开源动态8

全能高手&科学明星,上海AI实验室开源发布『书生』科学多模态模型Intern-S1 | WAIC 2025

7月26日,上海AI实验室在WAIC 2025上发布并开源科学多模态模型Intern-S1。它融合多学科知识,首创跨模态科学解析引擎,在多学科任务上超越顶尖闭源模型,还支撑构建了多智能体系统。

机器之心
新闻资讯8

维纳智能登上Nature通讯:AI不只会回答问题,开始生成高精度行业数据

维纳智能登上Nature通讯,其让模型自动生成高精度推理数据,用闭环反馈驱动专业Agent自主演化。该公司在多领域交出工业级精度答卷,还解决了Agent泛滥的困局,推出多款创新产品。

机器之心
推荐文章7

DeepSeek-R1发布100天后:全面复盘推理模型复现研究及未来!

推理语言模型(RLMs)发展显著,DeepSeek - R1发布引发广泛影响且未完全开源。MiroMind等总结其复现研究,关注SFT和RLVR方向,介绍数据构建、方法设计、训练过程细节及实验关键发现。

PaperAgent
算法论文8

Stream-Omni:同时支持各种模态组合交互的文本-视觉-语音多模态模型

中国科学院计算技术研究所团队提出文本-视觉-语音多模态模型Stream-Omni,能支持多种模态组合交互。它对各模态关系针对性建模,实现高效灵活的模态对齐,仅用少量语音数据就有多种交互能力。

机器之心
新闻资讯7

独家|RoboScience 机器科学完成10亿元融资,资金将用于强化 VLOA 模型与本体

AI科技评论独家消息,RoboScience机器科学近日完成10亿元A轮融资,将深化VLOA模型技术,推进自研机器人本体工程化与量产。其VLOA模型有创新性架构,能实现通用泛化,还将发布自研机器人本体。

AI科技评论
算法论文8

单卡即可微调模型!内存占用仅1/8,性能依然拉满 | ICML 2025

基础模型应用于下游任务时微调成本高,低秩适应(LoRA)方法虽降低成本,但性能不及全量微调。华中科技学和香港中文学团队提出GOAT框架,在25个多领域任务验证效果好,内存占用仅1/8。

量子位
算法论文8

突破一亿Token极限:EverMind提出MSA架构,实现模型高效端到端长时记忆

机器之心发布文章介绍,模型长期记忆能力受限于上下文长度。《MSA: Memory Sparse Attention for Efficient End-to-End Memory Model Scaling to 100M Tokens》提出MSA架构,突破扩展性、精度和效率的不可能三角,实现100M长度的模型长时记忆框架。

机器之心
开源动态8

OPPO AI重磅发布:深度研究智能体,离“真正好用”还有多远?我们给模型做了一次全身体检

2025年,Deep Research成AI热点,OPPO AI Agent Team对模型评测。发布论文,开源评测基准FINDER和失败分类体系DEFT,揭示AI“装懂”“缺乏韧性”问题,还分析模型表现并给出发展建议。

深度学习自然语言处理
算法论文8

为防AI刷题,Nature等顶刊最新封面被做成数据集,考验模型科学推理能力|上海交通

上海交通学王德泉教授课题组提出MAC基准,用顶级期刊最新封面构建测试集,评测多模态模型能力。研究设计两种含“语义陷阱”的测试任务,发现顶尖模型有局限,还提出DAD方法提升表现,采用双重动态机制。

量子位
算法论文8

彭一杰教授课题组提出RiskPO,用风险度量优化重塑模型后训练

彭一杰教授课题组提出 RiskPO,解决模型后训练陷入「均值陷阱」问题。它将风险规避理念融入优化目标,用「关注奖励分布左尾」替代「追求整体均值」,在多领域数据集上表现超越 GRPO 等。

机器之心