「多阶段训练」共找到 6045 篇相关文章

开源动态8

让世界模型推理效率提升70倍:上海AI Lab用“恒算力”破解长时记忆与交互瓶颈

上海AI Lab联合多家机构开源Yume1.5,针对视频生成构建可交互“世界模型”的核心难题,提出时空信道联合建模(TSCM),实现近似恒定计算成本的全局记忆访问,展示了世界模型工程化落地的可行路径。

量子位
新闻资讯8

今夜无显卡!老黄引爆Rubin时代,6颗芯狂飙5倍算力

CES 2026上,英伟达黄仁勋发布Vera Rubin超算架构,推理性能比Blackwell提升5倍,训练性能提升3.5倍,成本降10倍,已投产,下半年商用。还展示自动驾驶模型等,且无新显卡发布。

新智元
新闻资讯7

宇树IPO搁浅传闻满天飞,王兴兴:别当真,也不用和外人解释

宇树科技回应“A股上市绿色通道被叫停”传闻,称未申请绿通,上市工作正常推进,还发H2机器人训练视频。创始人王兴兴称消息是乱编的,别当真也不用解释,相关不实报道已下架。

量子位
新闻资讯8

智谱定档大模型第一股,1月8日挂牌上市,IPO预募资43亿港元

智谱定档2026年1月8日在港交所主板挂牌上市,预募资43亿港元,上市后市值预计超511亿港元。它是中国最早开展LLM研发的公司,多模型表现亮眼,靠MaaS模式实现盈利,但研发投入巨大。

量子位
算法论文8

AI4S回归白盒符号主义,清华等联合发布SR-LLM:自主发现科学知识

清华大学等多所高校联合发布SR - LLM,这是融合大语言模型与深度强化学习的符号回归框架。它从数据生成可解释数学模型,在跟车行为建模等任务表现优,为机器自主科学发现开辟新路径。

新智元
新闻资讯7

穿越周期的早期投资:从赛道思维到认知红利|甲子引力

2025 年 12 月 3 日,「甲子光年」举办年终盛典,科技产业投资专场圆桌对话探讨早期投资从“赛道思维”到“认知红利”转变。英诺王晟主持,红杉张涵等嘉宾参与,指出决胜点在对人、周期和非共识的理解。

甲子光年
新闻资讯8

Alex Wang“没资格接替我”!Yann LeCun揭露Meta AI“内斗”真相,直言AGI是“彻头彻尾的胡扯”

图灵奖得主 Yann LeCun 在访谈中,尖锐评价当前 AI 发展路径,认为规模化大模型是死胡同。他正通过新公司 AMI 推动“世界模型”技术路线,还谈到 AI 关键要素、安全等问题,与主流观点分歧明显。

InfoQ
产品应用7

Medeo 教程:一次生成无脑抽卡不可取,真正的视频 Agent 应该啥样

本文介绍AI视频生成Agent Medeo 1.0版本,它支持短或超长提示词,泛化性好,多种垂类视频都能做。文中介绍其基础操作、展示案例和提示词,还剖析了能兼顾质量与灵活度的原因,目前产品在内测将全量上线。

歸藏的AI工具箱
新闻资讯7

“75亿元投资理财”?摩尔线程回应

近期,摩尔线程拟将IPO募集的不超75亿元闲置资金用于现金管理引关注。公司称募投项目分阶段投入,此举为提高资金使用效率,不影响项目推进。12月20 - 21日将举办开发者大会。

芯师爷
新闻资讯8

10人创业团干翻行业“潜规则”!全员必须会AI、让跑大模型全程“裸奔”,谷歌老兵不烧钱创业

谷歌老兵Bryan Zhou投身AI创业,组建AnyInt团队。该平台定位AI Infra中间件,一个API对接所有模型,提倡“去中心化”。团队一开始就奔着付费用户,还做了极致性能优化,吸引众多开发者。

AI前线