136亿参数」共找到 1793 篇相关文章

开源动态8

The Batch: 873 | 通过自监督学习实现更好得图像处理

Meta等团队发布DINOv3权重和训练代码,参数规模扩6倍,用更多数据并引入新损失函数。它在图像分割和深度估计表现卓越,解决了自监督训练的视觉transformer的问题,提升全局和局部任务表现。

DeeplearningAI
算法论文7

英伟达说,小语言模型(SLM)是智能体的未来

英伟达论文指出小语言模型(SLM)是代理人工智能未来。SLM参数小于100亿,可装在消费电子设备。英伟达认为其强大、适合代理系统且经济。微软、英伟达等多家厂商的小模型表现出色,文中还分析了SLM优势及代理架构。

AI与安全
开源动态7

DeepSeek-R1今天一次「小更新」,颠覆了大模型格局,网友:尽快放R2

昨晚,DeepSeek官方宣布其R1推理模型升级到最新版本(0528),并公开模型及权重。该版本参数量高达6850亿,采用MIT许可证,性能提升明显,在多个基准测试中成绩优异,网友实测代码能力也大幅提升,但仍存在过度思考问题。

机器之心
新闻资讯7

AI 圈现“教科书式”骗局:对外伪造千亿估值,对内裁员、四次爽约,投资人员工双双被套

2025年初,Infinite Reality宣布获30亿美元融资,自报估值飙升至155亿美元,引发质疑。其高估值存疑,30亿美元融资真实性未知,CEO履历也有疑点。11月股东会称33.6亿美元投资或不到账,还取消股份回购,已四次食言,目前遭监管调查。

InfoQ
新闻资讯7

刚刚,Anthropic首超OpenAI!暴买谷歌TPU,Claude杀疯了

Anthropic与谷歌、博通合作打造3.5 GW TPU集群,预计2027年上线。其年化收入破300亿美元首超OpenAI,客户呈指数级增长。但训练和推理成本高,与OpenAI都在冲刺IPO,竞争激烈。

新智元
新闻资讯7

AI收入暴涨!英伟达超过苹果,成为全球市值第二

根据CompaniesMarketCap数据,英伟达公布财报后股价升超4%,一度成全球市值第一。截至5月29日收盘,其市值超苹果,仅比微软少150亿美元。虽此前受DeepSeek冲击,但Q1营收、利润仍创新高,二季度预计乐观。

AIGC开放社区
开源动态7

The Batch: 907 | 小而高效模型的“制作”方法

Mistral AI发布Ministral 3系列模型权重,结合剪枝与蒸馏技术,用级联蒸馏法构建。该系列参数规模有140亿、80亿和30亿,在部分测试中表现佳,训练成本低于传统方式。

DeeplearningAI
算法论文8

每周7亿人都在如何用ChatGPT?OpenAI最全报告来了

OpenAI联合哈佛大学经济学家发表论文《How People Use ChatGPT》,基于内部对话数据,分析ChatGPT从2022年11月上线到2025年7月的使用情况。截至7月,周活超7亿,每周发消息180亿条。

量子位
开源动态8

Claude Mythos核心架构开源!22岁天才一人破解,融合DeepSeek思路

22岁初创CEO Kye Gomez以第一性原理推导出Claude Mythos核心架构,开源OpenMythos项目。该架构采用循环深度Transformer,不堆参数,循环思考16次推理,结合MoE层,参数效率翻倍。

新智元
产品应用8

刚刚,Anthropic分享了构建Skills的最佳实践

Anthropic获300亿美元融资,估值达3800亿美元,发布《The Complete Guide to Building Skills for Claude》指南。介绍Claude Skills本质、与MCP关系、应用场景、技术实现、设计模式及测试迭代方法。

PaperAgent