「4B参数」共找到 2500 篇相关文章
Opus 5写代码全对,但说话让人想打人。
A社近日状况不断,Claude max 20x被免费薅,share链接隐私信息泄露,拥抱开源组织只剩Anthropic未签字。周五发布的Opus 5写代码出色,但说话啰嗦、判断力焦虑,值得细品。
中国AI芯片如何破局?这家公司重注推理芯片
2月3日,云天励飞董事长陈宁在战略前瞻会表示要All in AI大算力推理芯片,打造“中国版TPU”。他认为2025 - 2035年是推理芯片高光时刻,还介绍了公司技术壁垒、差异、战略及生态等内容。
梁文锋署名!DeepSeek再发炸裂论文:提出“条件记忆”新范式,彻底打破GPU推理显存墙
来自DeepSeek的新论文提出“条件记忆(Conditional Memory)”新范式,推出Engram模块,实现可扩展知识查找。研究揭示U形缩放定律,构建的Engram模型性能超越纯MoE基线,还打破了GPU显存瓶颈。
告别盲选LLM!ICML 2025新研究解释大模型选择的「玄学」
弗吉尼亚理工大学研究团队提出 LensLLM 框架,基于 PAC - 贝叶斯泛化界限揭示 LLM 微调性能“双相演进”,可精准预测微调性能、大幅降低计算成本,为 LLM 选型提供新工具。
突发!小扎“突袭”OpenAI核心,四名顶尖华人被挖走
扎克伯格亲自招募,从OpenAI挖走4名顶尖华人研究员,此事已被OpenAI研究科学家路橙确认。这4人是OpenAI顶尖研究人才,对OpenAI来说是重大损失。
图像分词器造反了!华为 Selftok:自回归内核完美统一扩散模型,触发像素自主推理
华为盘古多模态生成团队推出 Selftok 技术,通过反向扩散将自回归先验融入视觉 token。它突破传统,实现因果 token、强化学习友好型 token 及纯 AR 大一统架构,实验在多方面表现优异,论文还入选 CVPR 2025 最佳候选。
27岁研究员连辞OpenAI、Anthropic!两家都在拿我们的命下注
本文报道GPT-4o核心贡献者Jacob Coxon接连从OpenAI、Anthropic辞职并退出AI行业,批判头部AI机构陷入竞速赛,罔顾超级智能失控风险,直指行业需共同踩刹车。
谷歌掀桌:深度研究智能体进入自动驾驶时代
4月末谷歌DeepMind推出两款基于Gemini 3.1 Pro的AI研究智能体,标准版重速度,增强版求详尽。Max版在多测试获SOTA得分,能自主研究课题出报告,还可融合数据、生成图表,已开启公开预览。
姚顺雨腾讯首篇论文:给AI下半场指路“上下文学习”
姚顺雨入职腾讯后首个成果CL - bench,用来测试大模型“从上下文中学习”能力。研究指出当下模型多依赖“过去”知识,无法适应“当下”学习。评测中,十个前沿模型表现不佳,揭示其真实场景应用缺陷。
刚刚!微软 | 发布全新一代自研AI芯片Maia 200
微软提前发布自研AI芯片Maia 200,基于台积电3纳米工艺,性能超竞品,是其异构AI基础设施重要部分,将支持多个大模型,已部署在美中数据中心,还开放Maia SDK预览。