模型优化器」共找到 8364 篇相关文章

产品应用8

抛弃“级联”架构!快手OneRec用大模型重构推荐系统,服务成本降至1/10

传统级联式推荐架构有瓶颈,快手用OneRec重构推荐链路,服务成本降至1/10。文中介绍OneRec架构、Tokenizer方案、强化学习奖励设计,还提及优化及多模态联合训练方向。

InfoQ
开源动态8

终于!OpenAI 开源了2款模型:gpt-oss-120b 和 gpt-oss-20b

OpenAI 发布 gpt-oss-120b 和 gpt-oss-20b 开源模型,性能出色,如 120b 版本媲美 o4-mini,20b 版本能在笔记本甚至手机运行。采用 Apache 2.0 许可证,有多种特性与运行方式,还经安全分析。

AGI Hunt
推荐文章8

阿里云CIO首次系统复盘:大模型落地的RIDE方法论与RaaS实践突破

阿里云智能集团 CIO 蒋林泉分享大模型落地实践,介绍了阿里云在翻译、智能外呼等场景的应用案例,提出 RIDE 方法论,包括重组组织、识别机会、定义指标和推进执行,还分析了翻译和 Agent 模式的要点。

InfoQ
开源动态8

准确回答视频细节!11B模型挑战视频理解「证据级」任务,开源可商用

近日,复旦大学邱锡鹏教授领衔的OpenMOSS团队联合模思智能开源11B参数的多模态视觉理解模型MOSS-VL。它能准确回答视频里可被验证的细节、时间、过程和空间关系,有六项证据级能力,架构设计独特,采用Apache2.0开源许可。

量子位
开源动态8

微软又上大分!刚刚开源一款 0.5B 轻量级实时 TTS 模型,还能边想边说!

2025 年大家致力于解决 AI「嘴巴」问题,追求实时流式对话。微软刚开源轻量级 TTS 模型 VibeVoice-Realtime - 0.5B,参数虽小但能边输入边朗读,有诸多特点和广泛应用场景。

开源星探
开源动态8

Qwen3.8-Flash-Next:SGLang Day-0 支持

2026年8月26日,Qwen团队开源多模态MoE模型Qwen3.8 - Flash - Next,它是Qwen4架构早期预览版。SGLang在发布首日就提供完整支持,模型架构多方面升级,亮点众多,还给出启动命令及配置建议参考。

GiantPandaLLM
算法论文8

给文档质量"打分":DIQA-5000 数据集与融合版面语义的 DocIQ 质量评估模型

文档图像质量评估(DIQA)是评判‘增强算法有没有把图变好’的关键工具。过去研究多围绕自然图像,缺文档专用数据集。本文提出DIQA - 5000数据集和DocIQ模型,补齐缺口。

机器学习AI算法工程
算法论文8

视觉思维链全新架构,加州大学让多模态大模型有了灵性,整体性能提升5.3%

加州大学伯克利分校等团队提出视觉思维链(CoVT)架构,让视觉语言模型推理时生成连续视觉信号。它内化轻量级专家能力,采用对齐策略和四阶段训练,实验显示性能提升,还具可解释性。

AIGC开放社区
产品应用8

AI 模特时代到来:字节x清华推出商用级视频换装模型DreamVVT,保真度显著领先SOTA

字节跳动智能创作团队联合清华推出视频换装模型DreamVVT,基于Diffusion Transformer构建,用两阶段设计解决复杂场景痛点,支持多种输入,在保真度和时序稳定性上领先SOTA。

机器之心
算法论文8

首个全面梳理语音大模型发展脉络的权威综述,入选ACL 2025主会

香港中文大学团队语音语言模型综述论文《Recent Advances in Speech Language Models: A Survey》被 ACL 2025 主会议接收,这是该领域首个全面系统综述,指明语音 AI 未来方向,还剖析技术架构、训练策略等。

机器之心