「136亿参数」共找到 1793 篇相关文章
200亿国产巨头,在这个赛道做到了全球第一
声学传感器龙头歌尔微电子冲刺港交所,它是全球第五大、中国第一大智能传感交互解决方案提供商,全球第一大声学传感器提供商,市场份额达43%。其发展历程长,技术投入大,虽面临挑战,但上市后未来可期。
4000亿国产算力航母:芯片巨头合并超算巨头
上交所披露海光信息拟换股吸收合并中科曙光并募资,两家公司A股自5月26日开市起停牌,预计不超10个交易日。海光聚焦芯片研发,中科曙光深耕服务器领域,重组方案待明确,实施有不确定性。
第六章 Coding优先编的是「过程与约束」,不是「参数」
本章以开面包店类比训练大模型,介绍 AutoResearch 自主实验框架。它将研究生助理工作循环交给 Agent,在固定时间用单一指标判断好坏。仓库获约 64.7K Stars,Karpathy 设计哲学为极简主义与固定约束。
硅谷最危险战争!Anthropic死扛封杀,营收狂飙190亿
美国政府给Anthropic贴上「供应链风险」标签,OpenAI同期签军方协议。Anthropic CEO Amodei指责OpenAI,备忘录外泄使与国防部解决方案告吹。虽被封杀,但有巨头支持,营收反超OpenAI,其安全红线获广泛支持。
ERNIE 5.0:走向原生统一的万亿参数多模态基础模型
过去多模态模型‘拼接式’方案存在理解与生成割裂问题,ERNIE 5.0 借此提出,用统一自回归框架做多模态理解与生成,在架构、训练与系统层面有创新,评测中各模态能力表现出色。
开源医疗模型SOTA:蚂蚁健康发布百亿参数医疗大模型
由浙江省卫生健康信息中心、蚂蚁健康等联合开发的AntAngelMed医疗大模型正式开源。它凭借独创训练与架构,在权威评测中表现优异,降低算力门槛,将专业知识、诊疗能力与计算架构融合,为医疗AI落地奠基。
250份文档就能给大模型植入后门:不分参数规模
Claude母公司Anthropic联合英国AISI和图灵研究所研究发现,仅250份恶意文档就能给不同规模大模型植入“后门”漏洞,打破了以往对大模型数据中毒的认知,给厂商提了个醒。
翁荔陈丹琦加盟的840亿AI公司,公开第二篇论文
明星创业公司Thinking Machines公开第二篇研究论文,主题为“Modular Manifolds”,通过统一框架约束和优化网络不同层/模块,提升训练稳定性与效率。论文提出模块化流形思路,若应用于大模型,训练效率和稳定性将大幅提升。
7 亿用户白嫖 ChatGPT,OpenAI 怎么从他们身上赚到钱?
ChatGPT有7亿多免费用户,SemiAnalysis研究认为GPT - 5的‘Router’机制能让OpenAI从免费用户身上获利。‘Router’可降低成本、提升性能,结合新功能及合作,有望开启交易抽成的商业化模式,冲击谷歌等巨头。
万亿参数狂欢!一文刷爆2025年七大顶流大模型架构
文章深入剖析2025年顶级开源模型的创新技术,介绍了DeepSeek V3/R1、Kimi 2、Qwen3等七大顶流大模型架构,揭示滑动窗口注意力、MoE和NoPE如何重塑效率与性能。