从零训练」共找到 4869 篇相关文章

新闻资讯7

个人开发者训400亿参数大模型:分布式算力,DeepSeek架构,3090单卡部署

Nous Research推出Psyche Network,可整合全球算力训练AI。它基于Deepseek的V3 MLA架构,有DisTrO优化器等技术,能让个人和小团体创建大规模模型,还实现40B参数LLM预训练

量子位
开源动态8

他们让万亿参数RL学会了「省着跑」,顺便砍掉九成算力

2025年,强化学习成大模型进化主战场,但万亿参数模型跑RL成本高。Mind Lab团队实现1T参数模型LoRA高效RL训练,GPU消耗降90%,技术开源。此外还有Memory Diffusion记忆机制等成果。

量子位
新闻资讯7

Hinton的亿万富豪博士生

文章讲述Hinton的“江湖往事”,1986年CMU首届联结主义夏令营合影说起,介绍合影中的大神。重点提及Hinton首位博士研究生Peter Brown,他AI跨界金融成华尔街巨鳄,而Hinton安贫乐道,凸显高尚人格。

量子位
开源动态8

中心动态重分配哈希,北邮团队提出并开源CRH项目 | AAAI 2026

北京邮电大学等机构联合提出新颖端到端框架 CRH,在训练哈希函数时动态更新哈希中心,提升检索精度和语义一致性。论文被 AAAI 2026 收录,代码已开源。

AI前线
算法论文8

谁说3DGS必须靠LiDAR?如视Argus入选ECCV,让图像也能提供LiDAR级位姿约束

消费级3DGS应用走向普通用户,但需精确位姿约束,过去靠LiDAR,成本高。如视Argus入选ECCV 2026,能图像预测位姿等,为3DGS提供精准约束,推动其走向低成本采集时代。

机器之心
新闻资讯7

SpaceX为何官宣收购xAI?8万亿太空炼丹梦,别无脑跟进!

2026 年 2 月 3 日,马斯克宣布 SpaceX 全资收购 xAI。直接原因是 SpaceX 盈利而 xAI 烧钱,合并为解决资金问题;根本原因是 Grok 竞争失利,想借 SpaceX 运载能力打造太空算力形成差异。但太空训练面临散热等难题,推理可行。

新智元
推荐文章7

理解Ray Data分布式数据处理原理-源码分析

Ray Data是构建于Ray之上的分布式数据处理库,提供高性能且可扩展的API,可用于AI场景。文章源码入手,分析其流式执行原理,包括读取数据源、构建数据处理、输出数据等环节,还介绍了LogicalPlan转PhysicalPlan及流式执行过程。

阿里云开发者
产品应用7

走一步看一步、两三个月就迷茫一次:字节扣子的两年「创业」

字节的扣子刚完成大版本更新,定位“职场AI,就用扣子”。它过去两年像早期创业团队“野生”生长,Bot Studio到工作流平台,再到扣子空间,如今迈向Vibe Coding,强化“伙伴”定位,值得产品创新者研究。

Founder Park
算法论文8

CVPR 2026 视频模型趋势梳理:不止生成下一帧,更要理解下一步

视频智能正画面生成走向运动控制、动态建模等。CVPR 2026 显示视频模型竞争重心视觉质量转向对时空和物理规律的建模能力,文中介绍多篇相关论文及成果。

AI科技评论
开源动态8

美团开源新模型,多项能力实测第一

美团发布5600亿参数的LongCat - Flash模型,有创新动态计算机制和高效训练推理架构。它在多项测评中领先,尤其在代理工具使用测试表现出色,还以宽松许可开源,降低使用门槛。

AIGC开放社区