后训练技术」共找到 5968 篇相关文章

产品应用8

一文读懂DeepSeek-V3.2核心技术DSA:API疯狂降价性能不减的背

DeepSeek发布实验模型DeepSeek V3.2,引入自研稀疏注意力机制DSA,API价格最高降75%。DSA先筛选计算,含闪电索引器和稀疏多潜在注意力两组件,分四步工作,权衡了精确性与速度。

AI寒武纪
算法论文7

估值840亿AI实验室再放大招,他们要给大模型戴上「紧箍咒」

新智元报道,OpenAI前CTO创办的Thinking Machines Lab发布研究「模块流形」,将传统数值修正转为「预防式」约束优化。它提出新范式,为训练大模型提供新思路,还介绍了流形优化器及相关算法。

新智元
开源动态8

“边说边思考”,Mini-Omni-Reasoner 开创实时语音推理新范式

Mini - Omni - Reasoner将推理能力引入大型语音模型,开创“边说边思考”范式,实现实时语音推理与交互。推出Spoken - Math - Problems - 3M数据集,经四阶段生成流程构建。训练采用分阶段策略,性能超基础模型。

GitHubStore
开源动态8

刚刚,大模型装上「鹰眼」!首创高刷视频理解,谷歌Gemini 2.5完败

面壁智能开源MiniCPM-V 4.5多模态端侧模型,8B参数越级反超72B巨无霸,在多领域达SOTA。它首创高刷视频理解,性能强、效率高、适合端侧部署,还实现多技术创新,是开源端侧多模态AI的革命。

新智元
新闻资讯7

逆天改命!OpenAI 开源模型的安全底裤被 Meta 研究员给扒掉了……

Cornell大学兼Meta研究员jack morris成功将OpenAI最新开源的推理专用模型GPT-OSS逆向还原成基础模型,绕过对齐和安全措施,还暴露其训练用大量版权材料问题,此成果引发社区激烈讨论。

AGI Hunt
新闻资讯7

GPT-5问题太多,奥特曼带团回应一切,图表弄错是因「太累了」

GPT - 5发布问题频出,在数学、逻辑、编码任务中失误不断,还出现低水准图表错误,引发吐槽质疑。OpenAI联合创始人Sam Altman等在Reddit AMA活动中回应问题,给出解决方案并分享未来规划。

机器之心
产品应用8

4个月11万用户、Claude Code成了,Dogfooding该被AI公司重视起来了

Dogfooding(内部试用)应被AI创业公司重视。Anthropic推出的Claude Code源于内部工具孵化,经内部使用和场景验证发布,四个多月获11万开发者用户,其成功说明深度内部试用是竞争优势。

Founder Park
算法论文8

单向VLM变双向!人大斯坦福等提出MoCa框架:双向多模态编码器

人大、斯坦福等机构提出MoCa框架,将单向视觉语言模型转化为双向多模态嵌入模型。它通过持续预训练和异构对比微调,解决传统模型局限,在多模态基准测试中表现优异,尤其小规模模型性能突出。

新智元
推荐文章7

上下文工程的崛起:提示工程已是过去式

大模型应用从简单问答转向复杂智能体系统,技术焦点正从提示工程转向上下文工程。上下文工程核心是为大模型提供恰当信息与工具,其重要性日益凸显,且与提示词工程有明显区别。

AI工程化
产品应用8

揭秘夸克首个高考志愿大模型!蒸馏数百名人类专家经验、Agent 可完整生成志愿报告

6月12日,夸克发布国内首个高考志愿大模型,上线‘高考深度搜索’等三大核心功能。其‘志愿报告’以Agent运行,能输出完整报告;模型经多阶段训练,搭载最大高考知识库,为考生提供精准志愿填报服务。

AI科技大本营