训练步骤」共找到 2336 篇相关文章

新闻资讯7

警惕全球“最大”芯片IPO的暴雷风险

Cerebras 5月14日上市成2026年迄今全球最大IPO。其核心产品WSE工程有突破,但良率计算方式与传统不同。训练未成功,推理找到新机会。与OpenAI超200亿美元合同背后是股权换订单,财务数据也有隐忧,上市后存诸多疑问。

芯师爷
开源动态8

腾讯混元世界模型1.1开源:单卡秒级重建3D世界成为现实

腾讯混元团队开源混元世界模型1.1,它是混元3D世界模型1.0升级版。新增多视图及视频输入,单卡可部署,秒级创造3D世界。有核心突破,能处理多任务,经训练策略优化,多测试表现佳。

AIGC开放社区
产品应用7

“导演梦”不再遥远:Captain Cinema 让你用短片制作出电影

约翰·霍普金斯大学与字节Seed团队推出自动生成短片的Captain Cinema系统。它以剧情文字为输入,先规划关键帧,再补全画面动态合成短片。采用特殊训练法和模型,虽有局限,但为电影自动生成迈关键一步。

带你学AI
新闻资讯8

强化学习之父Richard Sutton最新演讲揭示OaK架构:通向超级智能的八步愿景

强化学习之父Richard Sutton在演讲中介绍OaK架构,认为它是通向超级智能的路径。他回顾对简单通用AI智能体架构的追求,强调从经验学习、拟合世界的重要性,还指出实现该架构需八个步骤,虽只是愿景但提供了发展路线图。

机器之心
推荐文章8

GPT-4o图像生成的「核燃料」找到了!万字长文拆解潜在变量,网友:原来AI在另一个维度作画

上月,GPT - 4o图像生成功能爆火。Sander Dielman在博客中探讨生成模型利用潜在空间提高效率和质量,将潜在变量比作「数据精髓」,深入对比多种模型,还介绍训练方法、损失函数等,兼具理论深度与直观洞察。

机器之心
开源动态7

这可能是,全球最强开源Agent模型,走了一条反Scaling Law的全新范式!

MiroThinker v1.5开源,其30B小模型在Agent benchmark上击败万亿参数的Kimi K2T。它以交互深度为新Scaling维度,训练有严格时间管控,实测表现超Search Agent,“小模型+强交互”或成新方向。

探索AGI
开源动态8

SD又回来了!一秒出图,手机就能玩:SD3.5-Flash让专业AI绘画进入“闪电”时代

Stability AI联合萨里大学SketchX实验室推出SD3.5-Flash模型,能在普通电脑甚至手机上快速生成专业级高分辨率图片。它将推理步骤压缩、显存要求降低、出图时间大幅缩短,画质也没明显缩水,还在性能上反超SD3.5M。

AIGC开放社区
算法论文8

CVPR 2026 ReSAM:每个目标只标1个点,SAM就能学会分割遥感图像

CVPR 2026收录论文《ReSAM: Refine, Requery, and Reinforce: Self-Prompting Point-Supervised Segmentation for Remote Sensing Images》,提出让SAM每个目标只标1个点,通过R³循环自己生成高质量伪标签训练。在WHU建筑数据集上,1点标注与全监督差距仅1.3%,省99%标注成本。

机器学习AI算法工程
新闻资讯8

英伟达4B小模型击败GPT-5 Pro!成本仅1/36

英伟达ARC - AGI 2中,4B小模型NVARC以27.64%成绩力压GPT - 5 Pro登顶,单任务成本仅其1/36。亮点是零预训练深度学习法,还靠合成数据、测试时微调等策略。小模型特定领域优化后优势明显。

量子位
推荐文章7

“光靠人盯不住了”!拆解上万张晶圆,这家公司靠AI将芯片良率提升数个百分点

喆塔科技创始人赵文政称国内跑通AI的半导体工厂少,工业AI尚处发展阶段。喆塔将DeepSeek接入自研大模型,提升训练效率。还分享了团队实例,强调工业AI决胜点在行业知识。此外,介绍了喆塔切入AI领域的过程、应用成果、面临挑战及未来策略等。

AI前线