「后训练阶段」共找到 4141 篇相关文章
WSJ:中国AI公司用“飞行硬盘箱”规避美国芯片封锁
美国限制向中国出售先进AI芯片,中国公司想出新招,工程师带硬盘到海外数据中心训练AI,再将结果带回。企业还通过多种方式绕开封锁,同时东南亚数据中心崛起,中东也成新热点。
刚刚,OpenAI公司结构重大调整:继续由非营利实体控制,营利性部门要变公益公司
OpenAI官方宣布公司结构重大调整,将继续由非营利组织控制,现有营利部门成公益公司(PBC),非营利组织控制PBC并成大股东,二者使命相同。这是与相关部门对话后决定。
揭示扩散语言模型扩展定律,人大高瓴团队与蚂蚁集团发布LLaDA MoE v2
中国人民大学高瓴人工智能学院与蚂蚁集团合作,首次系统刻画混合专家扩散语言模型扩展定律,据此训练LLaDA MoE v2,实现扩展效率与智能双重突破,将推动其迈向规模化时代。
刚刚,GPT-5.5 Instant全员免费!数亿人的ChatGPT变了
OpenAI深夜推出GPT - 5.5 Instant,全面接管ChatGPT默认模型且全员免费。它亮点诸多,如幻觉率暴降、数学成绩提升、回复字数减少、记忆和个性化功能升级等,三个月后GPT - 5.3将退役。
西湖大学张驰团队:从视觉合成到空间理解,视频 AI 正在「转向」丨CVPR 2026
过去两年视频生成发展近成熟,但多数模型缺乏空间结构稳定建模能力。西湖大学AGI Lab团队提出论文,将问题落回推理阶段,让相机轨迹成约束条件,推进视频生成到三维结构约束建模。
一个超级搜索Agent开源,超低成本拉满搜索推理能力!小参数、慢思考。
MiroThinker 1.5发布,打响2026年AI模型进步第一枪。它以小参数实现高性能,解决信息雾霾、AI幻觉、决策无力等问题,通过交互式扩展和时序敏感训练沙盒技术,展现强大搜索推理能力。
香港中科院发布聆音大模型,400万张图喂出个“AI超声神医”
中国科学院香港创新研究院发布超声大模型“聆音”,用超400万张图像的超声数据集,经自监督学习训练。它在多项诊断任务破纪录,临床效果佳,还将模型等开源,有望推动领域发展。
OpenAI罕见发论文:我们找到了AI幻觉的罪魁祸首
AI“幻觉”是阻碍完全信任AI的关键障碍,目前无根治良方。OpenAI罕见发论文揭示其根源,指出标准训练和评估程序奖励猜测,应加大对自信错误的惩罚,奖励表达不确定性。
ICCV 2025 | 打造通用工具智能体的基石:北大提出ToolVQA数据集,引领多模态多步推理VQA新范式
北大团队提出ToolVQA数据集,用于提升基础模型工具使用能力。它含2.3万条样本,贴近真实需求。通过ToolEngine构建,涵盖多工具与任务领域。微调后模型表现佳,代码与模型已开源。
小米模型实现声音理解新SOTA!数据吞吐效率暴增20倍,推理速度快4倍 | 全量开源
小米全量开源MiDashengLM - 7B模型,它基于Xiaomi Dasheng和Qwen2.5 - Omni - 7B Thinker,实现声音理解新SOTA。性能领先,推理效率高,革新训练范式,全栈开源,将赋能多场景。