大厂自研」共找到 5818 篇相关文章

新闻资讯7

继宇树后,唯一获得三家押注的变量:具身模型不是把DeepSeek塞进机器人

2026 开年,变量机器人获字节、红杉 10 亿融资。变量认为具身智能不是 AI 模型应用,需“生于物理世界、用于物理世界”的基础模型,其有研成果,还开源模型组织黑客松。

机器之心
新闻资讯7

OpenClaw 之父惊叹中国速度!集体杀入新战场:用AI 批量制造“一人公司”

AI 发展改写创业规则,“一人公司”批量涌现。创业者借助 AI 工具降低开发门槛,通过外包灵活组建团队。其商业化紧跟技术风口、服务长尾需求,但变现呈“金字塔结构”,竞争靠速度、资源和效率。参与培育市场,传统软件服务商与一人公司边界渐模糊。

AI前线
新闻资讯8

芯片团队规模近3000人!小米扩张研芯片版图

8月24日小米举行玄戒芯片技术沟通会,公布三颗研芯片:AI旗舰SoC玄戒O3、端侧AI加速芯片玄戒O100、智驾高算力AI芯片玄戒D100。小米重启芯片研发五年多,投入超210亿,芯片团队近3000人。

芯师爷
开源动态8

蚂蚁dInfer框架,让扩散语言模型推理速度再飙10倍,相同模型性能下超越回归模型

蚂蚁开源dInfer框架,联合名校发论文阐述实现细节。它解决扩散模型推理难题,提出创新算法和系统优化策略,实验显示其推理速度远超Fast - dLLM和回归模型标杆vLLM,代码已开源。

AIGC开放社区
新闻资讯7

独家|清华团队组团创业,押注机器人端侧进化,已完成首轮融资

过去一个多月,机器人学习风向生变。清华李健雄团队围绕机器人学习等研究多年后成立本溯智能创业。他们认为当下主流技术路线有问题,押注In - Context Learning,让机器人端侧进化,降低部署成本。

DeepTech深科技
产品应用8

微信研高性能推理计算引擎 XNet-DNN:跨平台 GPU 部署语言模型及优化实践

本文深入解析微信研的高性能推理计算引擎 XNet-DNN,介绍其核心技术架构和性能优化策略。该引擎基于 RCI 框架构建跨平台 GPU LLM 推理能力,在多方面超越现有解决方案,还给出了详实对比实验数据。

腾讯技术工程
算法论文8

告别单一模型依赖!北航等机构发布综述:语言模型集成(LLM Ensemble)

北航等机构发布的论文系统性回顾了LLM Ensemble领域进展,介绍分类法、相关问题、方法、基准、应用和未来方向。LLM Ensemble指推理阶段综合利用多模型优势,现有推理前、中、后三集成范式。

PaperAgent
新闻资讯8

啊?微博7800美元训的模型,数学能力超了DeepSeek-R1

近日,微博发布研开源模型VibeThinker,15亿参数却在数学测试上击败6710亿参数的DeepSeek R1,后训练成本仅7800美元。其为AI产业带来新思考,还将推动微博AI应用发展。

量子位
算法论文8

LLM工业级进化:北邮与腾讯AI Lab提出MoE-CL架构,解决模型持续学习核心痛点

北邮百家AI团队与腾讯AILab提出MoE - CL架构用于LLM进化持续指令微调。其结合‘解耦LoRA专家’与‘GAN对抗降噪’,在腾讯业务及基准测试中效果佳,降低人工成本,准确率优于主流方法。

机器之心
算法论文8

扩散模型引导新范式:直接交换token就能变强! | CVPR‘26 Oral

上海交和vivo研究者提出交换引导(SSG),不依赖文本条件、不加噪声、不改模型,只交换token特征。在多数据集实验中,SSG表现超现有方法。不过,其缺理论支撑、计算开销

量子位