「后训练方案」共找到 4475 篇相关文章

新闻资讯7

究竟会花落谁家?DeepSeek最新大模型瞄准了下一代国产AI芯片

近期,DeepSeek发布V3.1新模型,采用全新混合推理架构,在多任务表现上有提升。它采用UE8M0 FP8,或为国产推理芯片优化机制。国内多家厂商新一代AI芯片支持FP8,未来国产大模型或针对其专门优化。

机器之心
开源动态8

刚刚,小红书开源了首个多模态大模型dots.vlm1,性能直追SOTA!

小红书人文智能实验室(hi lab)低调开源视觉语言模型dots.vlm1。该模型基于自研视觉编码器构建,在视觉理解和推理任务上接近SOTA水平,实测表现惊艳,还介绍了其技术架构、预训练数据布局等内容。

新智元
算法论文8

ACM MM 2025 | 小红书AIGC团队提出风格迁移加速算法STD

小红书AIGC团队提出风格迁移加速算法STD。现有一致性模型在风格化任务有缺陷,文章提出从部分噪声状态出发的训练框架STD,设计轨迹状态库减轻计算负担,引入非对称对抗损失增强风格一致性,实验显示其效果优。

机器之心
产品应用8

vivo发布端侧多模态模型,只有3B可理解GUI界面,20项评测表现亮眼

vivo AI Lab发布端侧多模态模型BlueLM - 2.5 - 3B,融合文本与图文能力,支持长短思考模式切换。它在20余项评测中表现出色,参数量小,训练和推理成本低,有精巧结构、高效策略,还有高质量数据和高性能平台支撑。

量子位
产品应用7

一文读懂 NVIDIA B30 与 H20 的区别 :参数、应用与国产替代全解析

本文解读英伟达B30与H20芯片差异,对比参数和应用场景。B30为中国市场定制,虽单卡性能逊于H20,但集群性价比高。还分析B30挑战及国产替代方案,指出其是美技术封锁2.0版本。

芯师爷
新闻资讯7

小扎疯狂挖角 OpenAI、签约跳槽就发 7 亿奖金,奥特曼痛批:不懂创新,老“复制”人了

Meta 首席执行官扎克伯格掀起 AI 人才争夺战,向 OpenAI 和谷歌 DeepMind 员工提供巨额签约奖金。OpenAI 首席执行官奥特曼证实此事,称挖角大多未成功,还批评 Meta 不懂创新,只“复制”。此外,奥特曼还谈及超级智能等问题及 OpenAI 未来方案。

InfoQ
新闻资讯7

o3-pro答高难题文字游戏引围观,OpenAI前员工讽刺苹果:这都不叫推理那什么叫推理

OpenAI“最新最强版”推理模型o3 - pro引发关注。首位全职提示工程师给它设难题,它推理后答对。OpenAI前员工借此讽刺苹果。各大评测榜单显示其表现与官方有差异,苹果&SpaceX前工程师分享使用心得,肯定其表现。

量子位
算法论文8

AI Agents和Agentic AI有什么区别?

论文《AI Agents vs. Agentic AI》深入探讨AI Agent和Agentic AI的本质差异。AI Agents是集成大模型和外部工具的单体系统,适合简单任务;Agentic AI是多智能体协作新范式,适合复杂场景。还提及挑战、解决方案与未来方向。

AGI Hunt
产品应用8

别人忙着卷Code,Kimi抽身反打浏览器插件:网页操作一秒变Skill

月之暗面Kimi在发布Kimi Code Desktop后,升级原有的Kimi WebBridge,推出新版Kimi浏览器扩展,新增侧边栏入口,支持将网页操作录制保存为Skill方便后续复用,适合处理重复网页工作,和Kimi Code Desktop配合拓展了Agent的能力边界。

量子位
推荐文章9

当硅谷开始说 “打不过国内”丨五源孟醒

本文是五源资本合伙人孟醒2026年8月赴硅谷考察AI产业后整理的一手观察,记录了硅谷一线从业者对中美AI格局的最新判断,拆解不同AI方向的中美差距,分析Neo lab、数据产业的最新行业变化,信息密度高、参考价值强。

五源资本 5Y Capital