B端商业化」共找到 1383 篇相关文章

新闻资讯7

7B小模型超越DeepSeek-R1:模仿人类教师,弱模型也能教出强推理LLM | Transformer作者团队

Transformer作者之一创立的Sakana AI带来新方法,让教师模型像人类教师一样做启发式教学,根据已知解决方案输出解释。用此方法训练的7B小模型在传授推理技能上比671B的DeepSeek - R1更有效。

量子位
产品应用8

0.3B参数,600MB内存!腾讯混元实现产业级2Bit量化,侧模型小如手机App

腾讯混元团队推出面向消费级硬件的“极小”模型HY-1.8B-2Bit,参数量仅0.3B,内存占用600MB。它基于产业级2Bit侧量化方案,生成速度提升,还通过多种方法提升能力,未来将探索新技术缩小与全精度模型差距。

量子位
开源动态8

百度0.9B参数模型登顶全球第一,聊聊PaddleOCR-VL背后的技术细节

百度PaddleOCR-VL模型仅0.9B参数,在OmniDocBench V1.5榜单获92.6分全球第一,在多能力维度达业界最佳,能处理109种语言。其采用两阶段架构,结合优质训练数据,实现高性能与低内存、快速度的平衡。

AIGC开放社区
产品应用8

音乐新王震撼降临,Al音乐进入格莱美时刻

2026开年,MiniMax Music 2.5发布,凭「格莱美级」音质、极致拟真人声开创AI音乐新高度。它消除中文演唱「洋味儿」,支持14种结构标签精准控制,让音乐制作门槛降低,从C娱乐迈向B生产力。

新智元
推荐文章7

我的AI年度盘点

博主黄益贺做年度AI使用盘点。系统层面,从外挂式RAG旧体系转向以Coding Assistant为核心新体系,结合MCP、Skills等完善系统;工具层面,全面拥抱Google生态,C看好Google,B看好Anthropic,不看好OpenAI。

newtype AI
开源动态8

DeepSeek V4没做的,MiniCPM-o 4.5给做「全」了~

上周 DeepSeek V4 发布,遗憾不是多模态。今天 MiniCPM-o 4.5 补上短板,凭 9B 参数实现全双工全模态大模型,自 2026 年 2 月发布后 Hugging Face 下载量超 25 万。还推出多项成果,性能表现出色。

PaperAgent
算法论文8

清华刘洋团队论文:揭示为何 70B 的医疗模型,反而不如 8B 会问诊丨ILCR 2026

在医疗AI领域,模型静态评测与临床问诊能力存在断层。清华刘洋团队提出DOCTOR - R1,将临床问诊建模为POMDP,用强化学习训练。实验验证了其有效性,对医疗AI发展有深远启示。

AI科技评论
新闻资讯7

腾讯披露元宝已是TOP3应用

2025腾讯全球数字生态大会信息量大。腾讯元宝日活冲前三,混元3D建模精度提升3倍。C产品逐步落地B,如腾讯云CodeBuddy等。腾讯云还将带成熟生态出海,投资1.5亿美元在沙特建数据中心。

量子位
开源动态8

Qwen3.6-27B 开源:小小身材,超级码力

阿里云宣布开源 Qwen3.6-27B 多模态模型,支持多模态思考与非思考模式,在智能体编程方面超前代旗舰 Qwen3.5-397B-A17B。它已在 Qwen Studio 上线,开源权重可从 Hugging Face 和 ModelScope 下载,阿里云百炼 API 即将支持。

千问大模型
算法论文7

Mini-Omni-Reasoner:实时推理,定义下一代对话模型

现有对话模型推理能力未解锁,因深度思考带来延迟。为此提出 Mini - Omni - Reasoner,采用边思考边表达范式,突破‘要么快,要么准’困境,还设计了数据合成管线和五阶段训练方法,实验证明其性能提升明显。

机器之心