136亿参数」共找到 1793 篇相关文章

新闻资讯7

对话越疆刘培超:春晚隐藏具身选手,却是百亿市值大玩家

今年春晚,越疆科技的六轴协作机器人亮相。创始人刘培超接受专访,披露组建具身智能团队细节。越疆科技目前市值161亿,刘培超以50亿财富登胡润百富榜。他分享创业历程、具身智能布局及对行业看法。

量子位
产品应用8

斯坦福李飞飞团队,带你一句话进入无限3D世界

斯坦福李飞飞团队推出Marble平台,能将图片或文字变成3D世界。其有持久存在、可自由导航、可自定义操控等特性,技术或与3DGS有关,实测领先竞品,World Labs获巨额投资,估值超10亿美元。

AIGC开放社区
算法论文8

1.5B刷新数学代码SOTA!快手&清华精细化Token管理,LLM推理能力飙升

快手与清华团队用1.5B参数小模型在推理基准上超越同量级SOTA。其Archer方法通过精细化Token管理,对知识型和推理型Token差异化训练,让知识和推理同步更新且互不干扰,在数学和代码任务表现出色。

量子位
新闻资讯8

英伟达再创历史纪录!Q1收入增长69%,数据中心贡献89%,游戏业务大涨42%

英伟达2026财年Q1财报亮眼,总收入441.1亿美元,环比增12%、同比涨69%。数据中心和游戏业务表现出色,分别占比近89%、创新高。不过H20芯片受出口限制影响,预计二财季收入减80亿美元。

量子位
算法论文8

CVPR 2026 | ReFTA:打破张量化PEFT的「权重重建」瓶颈

随着大模型发展,全参数微调成本高,参数高效微调(PEFT)成主流。常见基于矩阵低秩分解的PEFT方法有局限,张量化PEFT虽有优势但存在权重重建问题。本文提出ReFTA方法解决该问题,有工程和理论优势。

机器之心
新闻资讯7

奥特曼预告ChatGPT新产品!Pro会员也要额外收费,这次不计成本投入算力

OpenAI已花160亿美元租计算资源,还计划未来五年额外支出1000亿租备用服务器。2024 - 2030年将砸3500亿用于服务器租赁,2030年研发投入近收入50%。奥特曼预告未来几周有计算密集型新产品,部分对Pro用户额外收费。

量子位
新闻资讯7

投入AI越多,跌得越猛!美股巨头只有AI拉胯的苹果在猛涨

本周财报季,亚马逊、谷歌和微软等科技巨头虽营收光鲜,但股价集体跳水,市值合计蒸发9000亿美元。因2026年计划砸6600亿美元建AI基建,市场担心回报周期长。而苹果未参与军备竞赛,与谷歌合作,营收创新高、支出降低、股价上涨。

新智元
开源动态8

小红书hi lab首次开源文本大模型,训练资源不到Qwen2.5 72B 的四分之一

6月6日,小红书hi lab团队首次开源文本大模型dots.llm1,采用MIT许可证。该模型激活参数量140亿,总参数量1420亿,上下文长度32K。训练资源不到Qwen2.5 72B的四分之一,在多个测评中表现出色。

AI前线
开源动态8

小红书开源大模型dots.llm1,初次出手,小有惊艳!国外网友们又炸了……

小红书hi lab团队公布首个开源大模型dots.llm1,这是142B参数的MoE模型,仅14B激活参数就能与Qwen2.5 - 72B打平。它开源力度大,训练效率高,数据处理精细,训练稳定,获国外网友高度关注。

AGI Hunt
新闻资讯8

DeepSeek-R2尚未问世,微软小模型捡漏称王?6000样本炼出「数学作弊器」!

微软推出Phi-4推理模型系列,参数最多14B,能在本地高性能笔记本电脑上流畅运行。Phi-4-mini-reasoning在数学推理上性能超越DeepSeek-R1蒸馏模型,且参数规模更小。文章还介绍了模型特点、训练方法、性能表现及局限性等。

新智元