三阶段训练」共找到 3268 篇相关文章

新闻资讯8

小米神操作!认领榜一神秘模型Hunter Alpha,龙虾之父都忍不住打听

小米官宣MiMo-V2家族款新模型Pro、Omni和TTS,其中Pro就是此前占领OpenRouter调用量榜单第一的神秘模型Hunter Alpha。它参数规模万亿,性能亮眼,Omni和TTS也实力强悍,此前身份引发全球网友好奇。

量子位
新闻资讯7

马斯克最大算力中心建成了:全球首个GW级超算集群,再创世界纪录

全球首个GW级超算集群Colossus 2正式投入运行,马斯克称其4月将升级至1.5GW。这为Grok 5训练提供强大算力。但美国部分地区因数据中心电力需求激增,或在用电高峰对居民轮流停电。

量子位
产品应用8

上帝视角!DeepMind提前5天锁定Melissa,强度预报不再靠天

飓风Melissa来临前,DeepMind算法提前5天预言其强度变化。该模型用两类数据训练,能生成多种未来场景,在路径和强度预测上优于传统模型,已被NHC投入实战,但AI不能理解灾难,人类仍需做决策。

新智元
新闻资讯7

Q2 GPU市场,英伟达独占94%,AMD被逼上绝路?

权威机构JPR报告显示,2025年Q2全球PC用GPU出货量环比增8.4%,CPU出货量也同步增长。这是关税恐慌引发的‘囤货潮’所致。英伟达在GPU领域优势巨大,AMD在CPU战场表现出色,家旗舰产品各有特色。

AIGC开放社区
开源动态8

32B 稠密模型推理能力超越 R1?中国秘密 AI 团队发布推理小模型 AM-Thinking-v1

2025年,国内神秘A - M - team在Hugging Face开源32B推理模型AM - Thinking - v1。它在多推理评测中击败DeepSeek - R1,与超大规模模型成绩相当。团队靠后训练方案挖掘32B模型潜力,探索小体量实现大能力路径。

AI科技评论
新闻资讯8

为什么AI大厂的人,都跑去做生命科学了?

越来越多AI人才投身生命科学,创办数十亿美元估值公司。这是因训练通用模型门槛高,而生命科学技术可迁移、产业愿付费且有成功先例。新一代公司AI位置、融资、技术目标有变化,但仍面临数据和临床验证问题。

DeepTech深科技
新闻资讯7

寻找 8 支 AI Native 硬件团队,好产品应该被更多人看见

今年是AI硬件爆发年,AI硬件重新定义人与设备关系。百度智能云联合Founder Park在Create 2026百度AI开发者大会设「AI硬件产品快闪」,邀8支团队展示类AI Native硬件,还将提供多种支持。

Founder Park
新闻资讯8

AGI很蠢?AI教父Hinton预警:4.8万亿美元市场已锁死,AI正撕裂全球!

AI教父Hinton在全球数字世界大会警告,全球AI产业膨胀,仅1%研发投入用于安全。他认为AGI是愚蠢术语,真正该关注超级智能。还指出AI有类风险,像烟草石棉一样,法规或难防危害外流。

新智元
新闻资讯8

Anthropic逼急谷歌!布林下场亲自督战,组「追杀队」围剿Claude

谷歌联合创始人布林亲自督战,组建攻坚队「追杀」Anthropic,欲夺回编程能力差距。Claude在编程领域锋芒正劲,谷歌AI编码占比仅50%,而Anthropic已达100%。攻坚队聚焦长期写代码任务,策略转向优先训练内部代码模型。

新智元
新闻资讯8

刚刚,OpenAI 发了一份 13 页的「超级智能新政」

OpenAI 发布 13 页政策白皮书《智能时代的产业政策:以人为先》,提出让繁荣惠及所有人、降低风险、普及 AI 大目标,并给出公共财富基金、效率红利分配、税制改革等具体方案,同时 Sam Altman 表达了对 AI 发展的紧迫感。

AGI Hunt