可迁移模型」共找到 9890 篇相关文章

开源动态8

英伟达全新开源模型:三倍吞吐、单卡跑,还拿下推理SOTA

英伟达推出专为复杂推理和agnet任务打造的开源模型Llama Nemotron Super v1.5,实现SOTA表现,吞吐量提至前代3倍,单卡高效运行。它采用NAS优化架构,经多数据集训练,现已开源。

量子位
算法论文8

ICML 2026 |让大模型边想边说:这篇文章把「何时开口」变成学习策略

论文《When to Think, When to Speak: Learning Disclosure Policies for LLM Reasoning》针对推理模型的‘沉默税’问题,提出Side - by - Side(SxS)Interleaved Reasoning,将‘何时披露内容’变为学习决策,经实验验证效果良好。

机器之心
产品应用8

灵2.5Turbo实测|顶尖AI视频模型,真能打平CG吗?

灵发布2.5 Turbo版本视频模型,进步显著,提示词理解、高速动态表现、风格稳定性都有提升,价格还更划算。经多场景测试,其在特定场景下内容质量能与CG媲美,开始理解动作背后逻辑。

歸藏的AI工具箱
开源动态8

OpenAI重新开源!深夜连发两个推理模型,o4-mini水平,笔记本、手机

OpenAI 自 GPT - 2 后重新开源,此次连发两个推理模型 gpt - oss - 120b 和 gpt - oss - 20b。它们性能达 o4 - mini 水平,在笔记本、手机运行,有宽松许等亮点,在多测试中表现出色。

机器之心
新闻资讯7

Meta详细阐述基于LLM级训练、混合并行计算与知识迁移的GEM广告模型

Meta发布生成式广告模型GEM详细信息,旨在改善平台广告推荐能力。它处理海量用户 - 广告交互数据,用三种方法构建系统,还实施GPU级优化,采用两种知识迁移策略,获业内人士认

AI前线
开源动态8

准确回答视频细节!11B模型挑战视频理解「证据级」任务,开源商用

近日,复旦大学邱锡鹏教授领衔的OpenMOSS团队联合模思智能开源11B参数的多模态视觉理解模型MOSS-VL。它能准确回答视频里被验证的细节、时间、过程和空间关系,有六项证据级能力,架构设计独特,采用Apache2.0开源许

量子位
开源动态8

小红书发布FireRedChat:首个私有化部署的全双工大模型语音交互系统

小红书智创音频团队推出业内首个支持私有化部署的全双工大模型语音交互系统FireRedChat,将半双工链路升级为全双工,提供级联与半级联服务,在多指标领先,让AI有“人感”。

机器之心
产品应用7

Qwen深度研究一夜升级!生成网页和音频播客,新模型能认医生手写体

Qwen版深度研究加速进化,增加听觉和视觉输出,生成网页和音频。改进功能同时更新模型,Qwen3 VL能识别医生手写体。实测新功能表现出色,Qwen3-VL系列更新后性能优异。

量子位
开源动态8

文心大模型 4.5 系列正式开源,涵盖 10 余款模型

6月30日,百度正式开源文心大模型4.5系列,含10款模型,实现预训练权重和推理代码全开源。在飞桨星河社区等平台下载,百度实现框架与模型“双层开源”,技术创新多,性能表现优。

AI前线
新闻资讯8

沈向洋解读AI演进五大维度!IDEA研究院发布“万物抓取”模型,GPU渲染器打破国外垄断

沈向洋分享梳理智能演进的五个维度,包括算法范式、智能载体等,指出机会不仅来自技术本身。此外,IDEA研究院还发布“万物抓取”DINO - X Grasp模型、MoonBit编程语言、GPU渲染器Smart等创新成果。

量子位