「4B 参数」共找到 2488 篇相关文章
又一个Kimi K3下周开源!Qwen3.8-Max编程、办公、科研都能自己干了
Qwen3.8-Max是Qwen家族迄今最强模型,2.4万亿参数,下周将开源权重。它在多项基准测试中表现出色,能连续自主工作数天,在编程、办公、科研、长周期任务、多模态等方面全面提升。
这家公司,“杀死”了他们的 AI 应用
脸谱心智(FaceMind)虽未关停「叠叠社」AI 应用,但开始押注底层世界模型研究。其论文提出 Looped World Models,带来 100× 参数效率提升,强调 AI 可靠更深内部推演获得能力,指出只做应用不够。
加入Meta近一年,亚历山大王回应:超级智能之前,AI终局未定
亚历山大·王加入Meta近一年后携Muse Spark模型回归,回应诸多争议。他指出Llama 4发展不符要求,Meta缺超级智能信仰。介绍了Meta超级智能实验室架构原则,还谈到算力分层、模型福利等内容。
算力不再稀缺?中国AI芯片供给出现反转
过去中国AI产业常焦虑算力不足,如今国产AI芯片进入集中交付阶段,自给率提升。伯恩斯坦测算,国产化率有望从2023年约17%提至2027年约55%。产业进入新阶段,竞争从“拼参数”转向“拼体系”。
月薪3万,去内蒙草原给DeepSeek守机房
深度求索放出数据中心高级运维工程师等岗位,要将效率至上哲学从软件延伸到机房运营。其选择乌兰察布建数据中心,因当地条件优、产业生态成熟。且传闻其新一代大模型V4将发布,算力成决胜关键。
Cursor 慌了:当 AI 不再需要代码编辑器
Anthropic新模型Opus 4.5编程能力强大,开发者无需逐行审查代码,可直接向智能体下达指令获取成品,这冲击了Cursor代码编辑器业务。虽Cursor收入增长,但面临焦虑,正努力自研模型、拓展企业客户。
黑客已死!Claude 两周挖出 Firefox 22 个漏洞
Anthropic与Mozilla合作,让Claude Opus 4.6对Firefox代码库做漏洞挖掘,两周发现22个漏洞,14个高危。Claude发现漏洞能力强,但利用漏洞能力弱。还研究用LLM做「补丁Agent」,为AI辅助安全研究建规范。
阿里开源QwenLong-L1:首个以强化学习训练的长上下文推理大模型
LRMs扩展到长文本场景是挑战,阿里开源QwenLong-L1框架,是首个用强化学习训练用于长文本推理的模型。它含三个核心组件,QwenLong-L1-32B性能领先,与Claude-3.7-Sonnet-Thinking相当。
阿里Qwen悄悄放出6个开源权重,国庆卷疯了~
国庆期间,阿里通义千问悄悄放出6个开源模型权重,Qwen3-VL是通义千问系列最强大的视觉 - 语言模型。其30B版本多模态表现媲美GPT - 5 - Mini等,功能与架构均有升级。
叫板英伟达RTX 5090!GPU初创公司做出13倍路径追踪性能的怪兽显卡
芯片初创公司Bolt Graphics首款GPU模组Zeus 4C,路径追踪性能达RTX 5090的13倍。但它不适合游戏场景,更擅长低功耗高精度图形渲染,不过测试、应用、价格目前都是未知数。