「计算效率」共找到 1776 篇相关文章
CMAME|美国西北大学,德州大学|Wing Kam Liu及 TJR Hughes 等: LLM赋能的下一代计算机辅助工程
工程仿真里有限元方法常见,但计算与人力成本高。此研究提出把大语言模型变为计算机辅助工程智能体,开发不依赖训练数据的降阶求解器,在多问题上表现佳,为下一代计算机辅助工程提供框架。
大模型狂叠 buff、Agent乱战,2025大洗牌预警:96%中国机器人公司恐活不过明年,哪个行业真正被AI改造了?
InfoQ编辑部发布《2025年度盘点与趋势洞察》,探讨大模型、Agent等领域变化,分析行业被AI改造情况。指出2025年格局重塑,竞争焦点转变,国内AI有进展但与硅谷有差距,还介绍了大模型、Agent、AI Native等发展趋势。
2025 年最全面的 LLM 架构技术解析【长文】
Sebastian Raschka更新「大型LLM架构对比」长文,解析2025年LLM架构发展。介绍了如DeepSeek V3、OLMo 2、Gemma 3等模型架构特点,像DeepSeek V3用MLA和MoE提升效率,还探讨线性注意力复兴等趋势。
摩尔线程放大招?新一代 GPU 架构即将揭晓 | Q推荐
2025年12月19 - 20日,摩尔线程首届MUSA开发者大会将在北京举办。大会聚焦全功能GPU,主论坛将揭晓新一代GPU架构,还有20+技术专场及1000㎡科技嘉年华,诚邀全球相关人士共筑国产智能计算生态。
新任IEEE Fellow要来参加雷锋网GAIR大会啦!
2026年IEEE新晋Fellow名单公布,348位学者入选,其中华人126位,AI领域42位。付昊桓等学者研究聚焦高性能计算等领域,付昊桓将在12月12日GAIR大会演讲。IEEE Fellow是学会最高荣誉,当选者贡献重大。
让大模型学会「心灵感应」:基于思维沟通的多智能体合作范式来了
NeurIPS 2025的论文提出思维沟通概念,建立潜在思维可识别性理论,构建ThoughtComm框架。该框架让模型共享潜在思维,跳过语言冗余歧义,实验显示其提升了协作效率与推理能力,或开启新智能形态。
5小时通关《原神》主线!Lumine:AI玩家正式登场
Lumine能像人类一样理解游戏画面、推理并操作,以接近人类效率5小时通关《原神》蒙德主线,还能零训练玩《鸣潮》等。它是开放式研发方案,靠少量数据和显卡让模型成强大智能体。
告别盲目卷参数!科大讯飞1024亮出底牌:all in“更懂你”
在模型能力趋同当下,科大讯飞在1024开发者节提出让AI“更懂你”。展示多模态超拟人“小飞老师”和「百变声音复刻」功能,发布星火X1.5大模型,还推出多领域软硬件产品,赋能多行业。
刷新SOTA高出19.05分!英伟达开源OmniVinci全模态理解模型,只用1/6的数据,实现全方位超越
英伟达研究团队发布OmniVinci研究,该全模态理解大语言模型用六分之一训练数据,在全模态理解基准测试成绩超现有顶尖模型19.05分。它靠创新架构和数据策略实现效率与性能双突破。
智能体系统如何「边做边学」?斯坦福团队探索在线优化的新范式
斯坦福等校团队提出 AgentFlow 框架及 Flow - GRPO 算法,让智能体系统能「边做边学」。它由多个智能体模块协作,在多领域基准测试中表现出色,小模型也能超越大模型,为智能体训练提供新思路。