「科研论文」共找到 1299 篇相关文章
Make SFT Great Again!从SFT到DFT:一权重之差,泛化之跃
大型语言模型的监督微调(SFT)简单高效,但泛化能力弱于强化学习(RL)。本文直击 SFT 核心缺陷,揭示其泛化瓶颈源于隐含的“病态奖励结构”,并提出仅需单行代码修改的动态微调(DFT),实验表明其效果显著。
科学能力太强,这个多模态推理「六边形战士」被严重低估!Intern-S1开源登顶
7月26日,上海AI实验室发布并开源「书生」科学多模态大模型Intern-S1,其多模态能力全球开源第一,文本能力比肩一流,科学能力国际领先。它开创「通专融合」新范式,重构科研生产力,引发国际关注。
研究者尝试揭示扩散模型创造力的起源
斯坦福大学研究人员 Mason Kamb 与 Surya Ganguli 在论文中提出解释扩散模型创造力的机制,指出其创造力是去噪生成图像时的确定性结果,还识别出关键偏置,搭建 ELS 机模型并验证其准确性。
Issue修复开源No.1!蚂蚁 | 提出代码图模型:CGM,结合GraphRAG架构,领先最强开源7.33%
为解决开源模型在仓库级代码理解上的能力瓶颈,蚂蚁全模态代码算法团队提出 CGM 架构,融合仓库结构与语义信息。CGM 首创图结构与语言模型融合的对齐框架,还搭配了 GraphRAG 框架,在多个代码任务中表现出色,且相关资源均已开源。
Meta联合Google新作:语言模型到底“记”了多少东西?
Meta和Google合作的论文探讨现代语言模型对训练数据的“记忆”情况。研究发明新方法精确测量“记忆”量,发现模型记忆有上限且与参数线性相关,还揭示学习转折、隐私规律等重要结论。
WSL、Copilot皆重磅开源,深夜炸场的微软给我们带来了哪些惊喜?
今年微软 Build 2025 大会于 5 月 20 日凌晨开场,AI 是重要战略方向,‘开源’成关键词。大会有诸多亮点,如开源 Copilot 核心功能和 WSL,升级开发者工具,推出新智能体和平台等,还与多方探讨 AI 发展。
AI 群星闪耀之前,商汤先相信那群少年
文章讲述商汤奖学金支持青年科研者的故事。自2017年设立,已资助280位本科生,在他们未成名时给予信任与支持,不仅是奖金,还提供资源和网络,获奖者们正从不同方向推动AI发展。
下一代mRNA药物是什么?由谁来定义?|对话深信生物李林鲜
本文对话深信生物李林鲜,回顾其从科研到创业经历。深信成立后经历mRNA产业起伏,从疫苗到治疗性产品推进。现探索用AI助力研发,李林鲜期望未来由深信定义下一代mRNA药物。
Agentic AI的第三种范式来了,16家机构提出「伴身智能体」
16家海内外高校与科研机构的22位研究者提出ComBodied Agents新范式,它围绕人的长期状态与主体性构建。论文给出闭环技术框架与评测标准,还提到研究难点与风险,也为产品实践提供指导。
刚刚,中国AI交卷!40年难题56分钟破局,AI不再「学习」
文章介绍AI科研应用新趋势,从学习已知知识转向搜索未知解。以百度‘伐谋’为例,它助力南京林业大学检测松材线虫病,还在多学科和产业场景中展现价值,百度还启动科学家计划推动其发展。