「开源大语言模型」共找到 9112 篇相关文章

算法论文8

vivo突破手机AI部署难题,绕开MoE架构限制,骁龙8 Elite流畅运行|ICCV 2025

在AI多模态时代,‘让大模型上手机’成焦点。现有MLLM在手机端部署有难题,vivo AI研究院等团队提出GenieBlue方案,绕开MoE架构限制,在骁龙8 Elite芯片手机流畅运行,保持语言性能同时实现多模态表现。

量子位
推荐文章7

Opus 4.5之后,AI正在催生“巨头型百人公司”

Opus 4.5发布后,Agent赛道洗牌,模型差距由Agent Loop拉开。本文围绕Cherry Studio,与创始人及投资人探讨AI公司护城河、开源意义、用户价值差异等,指出未来将催生“巨头型百人公司”。

五源资本 5Y Capital
开源动态7

凌晨,Qwen又更新了,3090就能跑,3B激活媲美GPT-4o

Qwen凌晨更新,Qwen3 - 30B - A3B有新版本Qwen3 - 30B - A3B - Instruct - 2507。仅激活3B参数,实力媲美谷歌Gemini 2.5 - Flash和OpenAI的GPT - 4o,在多项测试中提升显著,已在魔搭社区等平台开源。

机器之心
新闻资讯7

微软全球AI采用报告:每6个人就有1个用AI,但差距正在失控

微软AI经济研究所报告显示,2025下半年全球AI普及率创新高,每6人就有1人用AI,但全球南北数字鸿沟加剧。富裕国家借基建优势巩固领先,韩国靠政策、技术、文化实现跃升,开源模型DeepSeek在新兴市场崛起。

AIGC开放社区
推荐文章8

近期必读,Mary Meeker 340页PPT分析AI现状和未来

Mary Meeker发布340页《人工智能趋势报告》,分析AI现状与未来。报告指出AI发展迅速,用户、使用量和资本支出增长前所未有,但也面临变现威胁,如竞争加剧、开源模型崛起和中国追赶,同时AI正深刻改变工作方式。

歸藏的AI工具箱
新闻资讯8

拉 DeepSeek 和通义“组队”斗 OpenAI?小扎首届 AI 大会变“大型商战现场”,和微软 CEO 疯狂互曝!

4月30日凌晨Meta举办首届AI开发者大会LlamaCon,推出面向消费者的Meta AI聊天机器人和面向开发者的Llama API,欲扩大开源Llama模型应用范围、挑战OpenAI。扎克伯格还与微软CEO纳德拉就开源闭源生态、AI生产力等展开讨论。

AI前线
算法论文8

ICML 2026|告别「单线程」思维,智能体进化出了原生的并行推理大脑

北京通用人工智能研究院语言交互实验室提出原生并行推理器NPR,它有「自蒸馏 + 并行强化学习」三阶段训练范式,配套并行推理引擎,让并行推理成模型原生认知能力,还介绍了其具体实现、实验结论等。

机器之心
新闻资讯8

DeepSeek低价风暴打服硅谷!海外平台争相倒贴V4 Flash

DeepSeek V4 Flash掀起价格风暴,全球开发者为之疯狂。海外平台如Nous Portal、Cline等纷纷补贴,其能力大幅提升,价格却极低,让开发者更愿尝试开源模型,AI应用层或迎转机,且DeepSeek Code可能将至。

量子位
开源动态8

全球首个!10万小时人类数据全开源,Hugging Face罕见站台

上周Dyna Robotics公司用超100万小时人类第一视角视频训练DYNA - 2模型,发现物理AI有Scaling Law。8月20日光轮智能宣布10万小时全模态人类行为数据EgoSuite - Open100K开源,与Hugging Face联合发布。

新智元
算法论文8

EMNLP 2025 | 动态压缩CoT推理新方法LightThinker来了

随着AI发展,大语言模型处理复杂推理任务能力提升,但推理产生大量中间步骤和文本,拖慢计算速度、增加资源压力。研究者提出LightThinker,模仿人类思考模式,动态压缩推理步骤,削减tokens数量,降低成本。

机器之心