训练环境」共找到 2534 篇相关文章

算法论文8

英伟达发布 Jet-Nemotron 系列小模型,理论最大加速比 56 倍

英伟达发布 Jet - Nemotron 系列小模型,在多项基准测试中表现出色,实现高吞吐量加速和高准确率。其训练采用 PostNAS 方案,对既有模型针对性优化,展示了在小模型优化上的可行技术路径。

AI科技评论
推荐文章8

Physical Intelligence 核心技术团队分享:物理世界的“Vibe Coding”如何实现?

Physical Intelligence 核心技术团队解读机器人技术路径,分享前沿探索。介绍 VLA 与 VLM、LLM 关系,还提及 PI 构建数据管线、提出“知识绝缘”机制,分析开放世界部署难题,展望未来“机器人模型即服务”。

海外独角兽
新闻资讯7

AI 狂潮中,电子业破局:国产先进封装加速突围

AI应用渗透使算力需求结构重塑,传统芯片技术升级遇阻,先进封装技术成关键。文中介绍DeepSeek架构突破、DeepSeek - R1算法革新,分析其对算力需求的影响,指出高性能算力芯需求仍高,先进封装能释放芯片性能,国产有望突破。

芯师爷
算法论文7

从BERT到T5再到Qwen3:关于Embedding的八点总结

哈工大30+页综述聚焦通用文本嵌入(GPTE),系统介绍其架构、数据、模型,探讨预训练语言模型(PLM)给GPTE带来的基础能力与高级扩展,还涉及多模态、多语言、代码嵌入等应用。

PaperAgent
新闻资讯7

金融智能体真的是大模型落地“最后一公里”?

InfoQ《极客有约》X AICon 直播栏目邀请业内人士探讨金融 AI 大模型实践现状。指出大小模型融合是主要方案,智能体有应用但也有问题。还分享了评估 AI 项目的要点、智能体应用案例及未来布局方向。

InfoQ
新闻资讯7

上海又要冲出一个百亿芯片IPO

近日,瀚博半导体与中信证券签署上市辅导协议,冲刺A股科创板。其由前AMD核心技术领袖钱军、张磊创立,选差异化技术路径,已历6轮融资。当前国产GPU IPO潮起,瀚博有望借此抢占市场。

芯师爷
算法论文8

具身智能体主动迎战对抗攻击,清华团队提出主动防御框架

面对对抗攻击,现有防御方法多为‘被动防守’,遇上未知或自适应攻击时效果衰减。清华朱军团队在TPMAI 2025中提出主动防御框架REIN-EAD,通过与环境交互实现‘感知—决策—行动’一体化,实验效果佳。

量子位
新闻资讯7

2025全球大模型应用报告:红海混战「忠诚度」瓦解,用户脚踏4.7条船!

2025年上半年大模型从技术走向生产,45%企业将其用于生产环境。用户付费方式多样,使用面临知识不足、成本高的挑战。市场红海竞争,用户平均用4.7家大模型,国产模型出海需借第三国。

新智元
开源动态8

WRC整理床铺机器人背后模型曝光!端到端双系统全身智能VLA,仅凭少量微调就能get任务

星海图在2025WRC展示G0模型,可让机器人自主完成铺床任务。其发布端到端双系统全身智能VLA模型G0,结合真机数据集与架构,还构建开放数据集,评测结果优于π0模型,即将开源。

量子位
开源动态7

突发!Qwen更新模型,全面超越kimi k2,强的离谱,主打Agent

Qwen小更新非推理模型性能强劲,各项指标超kimi k2,与Claude opus 4持平,Agent能力亮眼。Qwen团队告别混合思维模式,新模型上线,独立训练两模型,新版本多方面提升,团队称还有大招。

AI寒武纪