全模态模型」共找到 8672 篇相关文章

新闻资讯7

9B 模型“平替”GPT-4o ?!面壁赌对OpenClaw端侧AI,内部上演一人月产65万行代码的效率核爆

2023年面壁智能转攻端侧大模型,起初遭质疑,后获市场认可。今年发布开源全模态模型MiniCPM - o 4.5,年中还将推AI硬件松果派。其内部有“一人公司”趋势,对未来端侧智能发展有清晰判断。

AI前线
新闻资讯8

神秘爆款模型被小米认领!雷军直言超过马斯克 xAI Grok,罗福莉透露MiMo-V2-Pro将开源

小米发布 MiMo-V2 家族三款新模型,确认 Hunter Alpha 是 MiMo-V2-Pro 早期版本。雷军称其超马斯克 Grok,罗福莉透露模型稳定后将开源。MiMo-V2-Pro 适用于 Agent 场景,Omni 关注模态交互,TTS 面向语音生成。

InfoQ
算法论文8

模型合体!上交&上海AI Lab&华师提出LED-Merging,拒绝「能力」与「安」二选一

上海人工智能实验室等团队提出LED - Merging解决模型融合“安 - 效用冲突”问题。该方法无需训练,像“神经元手术刀”,不牺牲专业能力还提升安性,论文已被ACL 2025 Main Conference接收。

深度学习自然语言处理
推荐文章7

本地LLM万字救场指南来了!网超AI实测:4卡狂飙70B大模型

文章围绕本地大语言模型(LLM)展开,针对实用性和经济性问题,用Dell Precision 7960塔式工作站对主流模型测试。涉及不同尺寸模型、推理框架等,给出不同配置下性能指标及使用建议,还模拟真实场景测试。

新智元
算法论文8

Speech LLM 的下一个突破口:你的语音大模型可以是个「带韵律的文本模型

语音大模型存在‘模态代沟’致性能‘降智’,此前两波改进未根本解决。香港中文大学论文提出TextPro - SLM架构,从输入端破局,仅用约1000小时数据就实现低‘模态代沟’,对多模态模型设计有启发。

机器之心
开源动态8

万亿思考模型新速度!蚂蚁开源Ring-2.5-1T:IMO金牌水平,强;混合线性架构,快!

蚂蚁集团发布球首个开源混合线性架构万亿参数模型Ring - 2.5 - 1T,打破深度思考牺牲推理速度和显存的‘不可能三角’。还同期发布扩散语言模型LLaDA2.1和模态模型Ming - flash - omni - 2.0,想做成可复用底座。

量子位
产品应用8

阿里电影级视频模型万相2.6系列上线,功能比Sora2还,人人都能当导演

12月16日,阿里发布通义万相2.6系列模型,5款新模型同时上线,覆盖图像到视频多环节。它是国内首个支持角色扮演的视频模型,功能比Sora2,已上线阿里云百炼和万相官网。

AI前线
开源动态8

HumanSense:探索多模态推理边界,打造「察言观色会共情」的模态交互伙伴

蚂蚁集团与西安交通大学联合提出并开源 HumanSense,含评估基准与推理模型。通过细粒度评测、模态消融等研究,提出优化策略,项目已在 GitHub 和 HuggingFace 开源,推动 AI 交互体验革新。

机器之心
开源动态8

小红书发布FireRedChat:首个可私有化部署的双工大模型语音交互系统

小红书智创音频团队推出业内首个支持私有化部署的双工大模型语音交互系统FireRedChat,可将半双工链路升级为双工,提供级联与半级联服务,在多指标领先,让AI有“人感”。

机器之心
算法论文8

复旦、同济和港中文等重磅发布:强化学习在大语言模型周期的面综述

来自多所顶尖科研机构的研究者完成长文综述,总结大语言模型生命周期的强化学习研究,阐述其各阶段应用策略,分析未来挑战与趋势,重点关注 RLVR 技术,有生命周期梳理等三大贡献。

机器之心