「研发成本」共找到 2040 篇相关文章
监督学习未死,一题训练五小时起飞!华人学者新方法20倍训练效率释放大模型推理能力
大模型推理能力研究中,RL训练资源成本高、不稳定,传统SFT低数据量易过拟合。加拿大滑铁卢大学华人团队提出One - Shot CFT方法,用一题多解多点评训练,仅需约5个GPU小时,效果好、稳定性强。
台积电“退场”,氮化镓市场影响几何?
近日,纳微半导体宣布将产品代工从台积电转至力积电,台积电决定2年内退出氮化镓业务。因其代工业务利润低,难达预期,且氮化镓市场竞争激烈。但氮化镓厂商积极应对,市场前景仍被看好。
多模态“卷王”阶跃星辰:如何利用 JuiceFS 打造高效经济的大模型存储平台
有“多模态卷王”之称的阶跃星辰,自研多模态模型,早期商业存储系统难满足需求,后引入 JuiceFS。文章介绍大模型各环节存储需求,详述 JuiceFS 企业版与社区版优化实践,含模型分发、读性能等优化。
AI破译生命!微软蛋白质研究「超级加速器」登上Science
微软研究AI for Science团队推出BioEmu,能模拟蛋白质在平衡状态下的各种可能结构集合。它输入蛋白质序列就能生成大量结构样本,预测性质,速度比传统方法快10万倍,已开源助力药物研发。
手机上实现AI视频实时生成,DiT模型上移动端
扩散变换器在视频生成任务性能强,但计算成本高,在手机上难实用。Snap提出创新优化法,加速视频生成,能在iPhone 16 Pro Max上每秒超10帧,不过也存在细节退化等局限。
打造全球首个强化学习云平台,九章云极是如何做到的?
AI正从语言模型走向智能体,强化学习成关键技术,但训练面临困难。2025年6月九章云极发布全球首个工业级强化学习云平台AgentiCTRL,实现系统级重构,其智能基础设施战略布局领先,具产业赋能优势。
无损加速视觉语言模型推理!轻松剪掉视觉冗余Token|腾讯AI Lab
多图像、长视频让大型视觉语言模型推理成本暴涨,成算力瓶颈。腾讯AI Lab联合CMU提出VScan,通过两阶段视觉token筛选机制,在几乎不损性能的前提下实现推理加速,且已在GitHub开源。
阿里云客服Agent业务提效实践:灵活可控的落地方法论
阿里云算法专家姜剑介绍了“阿里云服务领域 Agent 平台”及业务提效方法论。阐述 Agent 技术本质、模式,分析其给客服领域带来的价值,指出阿里云客服痛点,提出解决设计问题的方法,展示平台设计与落地成果。
AI Infra 工程师们如何应对大模型流水线里的“暗涌”?
InfoQ《极客有约》X AICon 直播邀请华为、蚂蚁集团等专家探讨大模型 Infra 工程师实战日常。涉及大模型工程高频问题、版本迭代冲突处理、推理部署成本优化、开源项目挑战及 GPU 虚拟化趋势等内容。
亿点点新融资砸向具身智能:斯坦福华人团队,首创“自适应机器人”品类
具身智能火热,非夕科技完成C轮亿级美元融资,由咏归基金、广发信德联合领投。该公司由斯坦福大学相关成员创立,首创“自适应机器人”品类,此轮资金用于扩产、研发及生态拓展。