大模型训练」共找到 9463 篇相关文章

算法论文8

面对无解问题模型竟会崩溃?港中文&华为联合提出首个模型推理可靠性评估基准

港中文和华为诺亚实验室联合提出ReliableMath基准,探究模型推理可靠性。提出评估准则,构建含可解与不可解问题的ReliableMath数据集,实验揭示模型缺陷,还提出提高可靠性的对齐策略。

机器之心
算法论文8

模型幻觉的源头找到了!清华团队锁定模型宁愿说谎也要讨好人类的神经元

清华学研究团队深度解剖语言模型微观机制,确认幻觉关联神经元存在,揭示其与过度服从行为相关。通过干预神经元激活状态可增减模型幻觉行为,为开发可靠 AI 系统提供靶点。

AIGC开放社区
开源动态8

模型理解真实医疗视频,全球首个开源技术方案来了!

AI 进入医疗领域需谨慎,此前美国引入不成熟 AI 致手术失误频发。全球首个医疗视频理解模型元智医疗视频理解模型发布并开源,解决了医疗视频领域的任务优化、数据缺失和无法评测痛点。

机器之心
开源动态8

超越O4-mini,多模态模型终于学会回头「看」:中科院自动化所提出GThinker模型

现有多模态模型在通用场景推理有瓶颈,缺乏对视觉线索校验与再思考能力。中科院自动化所提出GThinker模型,有创新的「线索引导式反思」模式,经两阶段训练,性能超O4 - mini,论文等已开源。

机器之心
推荐文章7

2025 年中丨模型市场分析报告

这是《2025年中丨模型市场分析报告》。指出基础模型塑造计算未来,企业重心转向推理。Anthropic超OpenAI成市场头号玩家,开源模型采用趋缓,企业换模型重性能,AI支出从训练转向推理。

特工宇宙
新闻资讯7

OpenAI新模型,被曝秘密训练中!万字硬核长文直指o4核心秘密

SemiAnalysis爆料,OpenAI正训练规模介于GPT - 4.1和GPT - 4.5间的新模型,下一代推理模型o4基于GPT - 4.1训练。强化学习成推理模型进步功臣,但面临基础设施瓶颈,奖励函数难定等问题。

新智元
开源动态8

英伟达新架构引爆全模态模型革命,9B模型开源下载即破万

英伟达推出全模态模型OmniVinci并开源,其90亿参数规模性能超同级别甚至更高级别模型训练数据效率是对手6倍,能精准解析视频和音频,在多模态应用场景中表现卓越,下载量破万。

新智元
开源动态7

Unsloth宣布更新,可免费用强化学习训练视觉模型Qwen2.5-VL-7B

Unsloth宣布更新,支持视觉/多模态模型强化学习训练,含Gemma 3和Qwen2.5 - VL。其独特机制使VLM RL训练速度提升、显存占用降90%等。还引入GSPO算法,能在免费Colab T4 GPU训练Qwen2.5 - VL - 7B。

AI工程化
开源动态7

一文彻底搞懂 MCP:AI 模型的标准化工具箱

MCP(模型上下文协议)是 Anthropic 于 2024 年 11 月开源的新技术,是 AI 模型的标准化工具箱。它能让模型与外界互动、获取信息、完成任务,整合 Function Call 标准,几乎所有模型都可接入。

机器学习AI算法工程
算法论文8

模型也需要自我反思,上海AI Lab合成“错题本”让模型数学成绩提升13.3%

上海AI Lab提出LEMMA方法,构建“错误 - 反思 - 修正”数据,让模型从错误中学习。通过教师模型定向制造“学生会犯的错”构造数据,实验显示在Llama3 - 8B上数学解题准确率提升13.3%。

量子位