大模型后训练」共找到 9479 篇相关文章

新闻资讯7

250份文档“毒晕”模型!无论规模小统统中招

Claude母公司Anthropic联合两机构研究发现,仅250份恶意文档就能在不同规模模型植入“后门”漏洞,打破以往对模型数据中毒的认知,给厂商防御敲响警钟。

量子位
开源动态8

里程碑!逻辑智能发布全球首个完全开源语音模型框架LLaSO,语音AI迎来新纪元

逻辑智能发布全球首个完全开源语音模型框架LLaSO,它像“全家桶”,提供高质量数据、统一评测基准和强基础模型。语音模型发展遇瓶颈,LLaSO框架及参考模型LLaSO - Base有望打破僵局。

AI科技评论
开源动态8

探针伸进模型黑箱,南加州学华人团队打造AI记忆研究的深空望远镜

南加州学 Robin Jia 教授团队借助英伟达算力,构建基于 Llama 3 架构的全开源受控模型 Hubble,其成果将在 ICLR 2026 亮相。研究揭示模型记忆机制效应,还评估了‘机器遗忘’技术,有法律应用潜力。

DeepTech深科技
开源动态8

开源!强效果,高性能,严隐私?我全都要:OPPO 终端模型实践

OPPO AI 中心推出开源端侧多模态模型 AndesVL,含 0.6B - 4B 四档尺寸套件,有通用能力强等优势。它经多阶段训练,OPPO 还构建端侧部署方案,评测显示其在多方面表现优异,未来会继续技术革新。

InfoQ
新闻资讯7

模型年中报告:Anthropic 市场份额超 OpenAI,开源模型企业采用率下降

本文基于年中报告指出,当前模型API支出翻倍,企业重心转向模型推理。Anthropic市场份额超OpenAI,开源模型企业采用率下降。代码生成成热门场景,企业换模型重性能,AI支出从训练转推理。

Founder Park
新闻资讯7

顶尖技术+标准产品+创新模式+可靠服务,打造模型商业落地中国范式 | 卓世科技@MEET2026

模型参数竞赛白热化的当下,焦点转向模型如何在行业存活、产生价值。卓世科技合伙人赵策在MEET2026会提出,模型下一场竞争在模型、终端、数据与业务流闭环,该司据此在多领域落地应用。

量子位
新闻资讯7

“通用模型微调成为行业模型是伪命题”?医疗AI深度重构,传神语联创始人何恩培:孪生智能体能砍70%线下复诊工作

本文为《2025 年度盘点与趋势洞察》系列访谈,传神语联创始人何恩培分享医疗 AI 发展看法。他认为通用模型微调成行业模型是伪命题,介绍了传神素问中医模型应用,还对比中西医 AI 化差异,探讨未来发展场景与挑战。

InfoQ
算法论文8

别被室内基准高分骗了:模型是在推理空间,还是在「背答案」?

2025年,空间智能成模型竞争新热点,模型在室内基准上分数飙升。但因训练与测试数据同源,其提升或只是“背答案”。中科院学等机构发布OSI - Bench重新审视模型空间能力,评测显示当前提升可能是虚假繁荣。

机器之心
新闻资讯7

模型的新战场在推理?——《推理模型综合测评报告 2025》深度解析 | 直播预告

5月29日,InfoQ研究中心发布《推理模型综合测评报告2025》,通过五维度、五题型的300道测试题对八家主流推理模型全面测评,还总结各维度表现,梳理技术前置因素与趋势。6月6日有直播解读。

InfoQ
新闻资讯8

腾讯调整模型组织架构:姚顺雨加盟,向总裁刘炽平汇报

腾讯宣布模型组织架构调整,姚顺雨加盟。他是模型Agent方向青年研究者,将任“CEO/总裁办公室”首席AI科学家等职。腾讯强化研发体系,混元模型成果多,AI产品有竞争力,内部推进AI变革。

量子位