4B 参数」共找到 2497 篇相关文章

产品应用8

刚刚,阿里Qwen3.8-Max来了!冲进全球第一梯队,模型表现直逼Claude

阿里巴巴突袭发布新一代基座大模型Qwen3.8 - Max,它总参数量达2.4万亿,在多场景表现出色,在权威榜单冲进全球第一梯队,性能直逼Claude,且价格实惠,实测反馈良好。

量子位
新闻资讯7

美国解除Claude禁令,Fable 5与Mythos 5即将恢复访问

美国商务部解除针对Claude Fable 5和Claude Mythos 5的出口管制,Anthropic将恢复两款模型访问权限。此前因安全担忧模型被限制,政策逐步松动后现整体解禁,Anthropic还发布了Claude Sonnet 5。

DeepTech深科技
开源动态8

微软 SkillOpt:不动模型权重,只训练那份「技能说明书」

微软研究院 Yifan Yang 等人推出 SkillOpt,思路反直觉,不动模型权重,把「技能文档」当可训练参数。它在 52 个组合中表现最优,技能可迁移,代码已开源,还支持多操作。

AI工程化
新闻资讯7

DeepSeek开招Harness产品经理!「参与Agent桌面端产品全过程」

DeepSeek热招Agent Harness产品经理,旨在将前沿模型能力转化为领先Agent产品。招聘详情明确职责与任职要求,释放模型和产品两手抓信号,且其融资后有商业化承诺,将加速发展。

量子位
新闻资讯8

不换GPU,性能飙升2.8倍!英伟达用软件暴打摩尔定律

2026年1月8日,英伟达官网披露,基于Blackwell架构的推理软件栈升级,让混合专家模型(MoE)推理效率迎「阶跃式」突破,单GPU吞吐飙升2.8倍,显著降低推理成本。其通过软件针对性升级发挥硬件潜力,还进行多项优化。

新智元
产品应用8

一行代码,Claude成本直降85%!最强Opus做大脑,Sonnet疯狂搬砖

Anthropic深夜发布Claude「顾问策略」,让Opus 4.6当「顾问」,Sonnet/Haiku当「执行者」,实测性能翻倍、成本降85%。还带来Monitor工具更新,加上此前的Managed Agents等,构建完整Agent平台。

新智元
新闻资讯8

Generalist最新长文定调:具身原生才是正道,中国玩家原力灵机已交卷

Generalist创始人Pete Florence团队释出GEN-1技术博客,否定世界模型与VLA之争,强调具身智能应回归目标,主张从零训练。中国原力灵机DM0也采用具身原生路线,在RoboChallenge评测中成绩优异。

量子位
产品应用8

三星研究院发布手机端侧大模型MeKi:基于Memory的LLM扩展新范式,支持旗舰手机端侧部署

三星研究院发布端侧大模型架构MeKi,提出用存储空间扩展模型容量、提升LLM性能的新范式。它利用手机ROM缓解内存压力,实现容量与性能提升。实验显示其性能、效率表现优,为边缘部署LLM提供新思路。

AI科技评论
开源动态8

1.8K Star!又挖到一款超酷的 Claude Cowork 开源平替,而且比 Cowork 更快更省!

Anthropic 发布 Claude 的 Cowork 能力后成热门,但高额费用和封闭策略让普通人却步。现推荐开源替代方案 OpenWork,它免费开源,速度快、省 Token,还引入安全隔离机制,功能丰富。

开源星探
新闻资讯7

顶级商战往往采用最朴素的方式:你叫「微软」,我叫「巨硬」

2026决战前夜,AI成抢夺电力与地皮的「物理战争」。谷歌要5年内算力拉升1000倍,抠能效;马斯克自建电厂、买仓库,手搓算力中心,还在名字上挑衅微软,不过也引发环保抗议。

新智元