「参数量」共找到 1240 篇相关文章
从卖token到卖结果,这些公司开始让AI背KPI了
当前企业难以衡量AI真实价值,常以调用量代替产出。一批公司开始尝试改写,如Sierra和零犀科技,直接对结果收费。Sierra覆盖超40%财富50强企业,零犀实现规模化盈利与正现金流。
【梁文锋署名】DeepSeek再发新论文:75%思考+25%记忆,这是他们算出来的最优解
DeepSeek新论文《Conditional Memory via Scalable Lookup》提出Engram模块,指出大模型用计算模拟查字典是浪费算力,Engram能给模型装“记忆”,还发现参数分配呈U型缩放定律,推理和长上下文能力提升显著。
世纪反转:“安卓爹”谷歌成 iPhone“大脑供应商”?曝苹果每年掏70亿换定制Gemini,明年上线新Siri
彭博社报道苹果将与谷歌合作,每年付约10亿美元获定制Gemini用于升级Siri,计划明年春季推出。谷歌模型参数远超苹果现有模型,能让Siri功能更强大,且运行在苹果私有云。
0 代码改造实现应用运行时数据库密码无损轮转
本文探讨通过整合 MSE Nacos、阿里云 KMS 及 Apache Druid 等技术组件,实现应用运行时数据库密码无损轮转。介绍敏感数据安全风险,详述方案流程、优势,还提及未来对接更多组件,支持多参数动态更新。
HBM Roadmap和HBM4的关键特性
文章介绍 KAIST TERALAB 公布的 HBM 技术,涵盖 HBM 路线图和 HBM4 特性。HBM 路线图展示从容量升级到计算存储融合的进化,HBM4 在电气规格、封装冷却、架构等方面有突破,AI 工具也用于研发。
单季利润2610亿元!三星的“AI印钞机”,火力全开
4月7日三星公布一季度业绩,营业利润57.2万亿韩元,DS部门贡献超七成。HBM业务营收大增,通用DRAM量价齐升。三星从HBM3E追赶者成HBM4领先者,但产能转移致产业链裂痕,下游产品纷纷涨价。
一封来自Transformer之父的分手信:8年了!世界需要新的AI架构
Transformer之父Llion Jones在TED AI大会上称要把对Transformer的爱好调成「低电量模式」。他认为大量资金与人才涌入使研究被「收窄」,大家只顾卷参数、抢发论文,没人探索新架构,他呼吁找回好奇心。
抖音&LV-NUS开源多模态新模,以小博大刷新SOTA,8B推理比肩GPT-4o
抖音SAIL团队与LV - NUS Lab联合推出多模态大模型SAIL - VL2,以中小参数规模在106个数据集实现性能突破。该模型从架构、数据、训练三方面创新,后经全链路优化,在多数据集验证中表现卓越。
刚刚,国产Agent模型闯入全球第一梯队!限时免费
昆仑万维发布SkyClaw-v1.0及其轻量版SkyClaw-v1.0-lite Agent模型,性能达全球第一梯队,价格仅主流顶尖模型一半甚至更低,适配主流Agent框架,还兼容OpenAI接口,现限时免费,后续将逐步开源。
PixelRefer :让AI从“看大图”走向“看懂每个对象”
多模态大模型多停留在整体场景级理解,现实任务需细粒度、对象级理解。浙江大学等联合提出PixelRefer框架,可实现精细视觉指代与推理,在多项任务表现领先,轻量版性能优,还开源两类数据集。