「AI架构优化」共找到 11221 篇相关文章
我用 GPT 6 Astra 做了一个 3D 版的《桃花源记》(文中含提示词)
作者宝玉分享借助GPT 6 Astra与Codex制作可交互3D版《桃花源记》的完整过程,公开可复用提示词模板,提供成品在线体验,分享AI生成交互式内容的实战心得。
罕见!Meta、OpenAI、xAI联合分享了用生产环境提升LLM的最佳实践!
Meta、OpenAI、xAI联合发表成果CharacterFlywheel,聚焦在生产环境提升社交型AI对话能力。团队基于LLaMA 3.1迭代15个版本,7/8的A/B测试显示正向提升,介绍了架构、数据管道、奖励模型等内容。
北大、字节、中科院自动化研究所等提出图像并行生成新范式
北大、字节等团队发现多模态模型先思考后作画会降低图像语义保真度,因自回归架构有误差传播问题。为此提出并行多模态扩散框架MMaDA - Parallel,构建ParaBench基准,多项优化后在测试中击败Bagel。
DeepSeek V4正式版太便宜辣!5毛钱做出3D射击游戏,网友直呼绷不住
DeepSeek V4 Flash正式版API上线公测,其价格便宜得离谱,如0.07美元就能制作第一人称3D射击游戏。与Claude Opus 5、GPT - 5.6等对比,功能相近但成本低很多。它靠MoE架构等降低成本,还提升了性能。
刚刚,英伟达革了自己的命:智能体自主进化7天,干掉所有算子工程师、GPU专家
英伟达新研究AVO构建了新型进化变异算子,用自主编码智能体取代经典方法。智能体7天自主进化,优化MHA内核,性能超cuDNN和FlashAttention - 4,还能快速适配GQA,展现强大泛化能力。
全球1100万台出货,追觅打造最聪明的扫地机
追觅扫地机将AI打造成完整链路,实现从感知到决策的闭环。其X60 Pro采用超广角双目灵动导航避障技术,提升感知能力,引入强化学习优化决策,全球出货超1100万台,营收增长显著。
登顶SuperCLUE DeepSearch,openPangu-R-72B深度搜索能力跃升
近日 SuperCLUE 发布 11 月 DeepSearch 评测报告,国产大模型 openPangu - R - 72B 名列第一。它采用 MoE 架构平衡效率与性能,经预训练技术优化和 DeepSearch 专项突破,彰显国产算力与大模型研发融合成效。
落地商用开启国产一体化智算新时代,蓝芯算力LX500亮相滴水湖RISC-V产业论坛
2026年8月13日,第五届滴水湖中国RISC - V产业论坛召开。蓝芯算力生态营销负责人许庆伟以核心产品LX500为线索,从架构、算力、商业落地三方面,展示国产RISC - V算力商用路径。
清华给电子显微镜加上Agent,DeepSeek V3全程调度,数天流程缩短至几分钟
清华大学牵头,联合多机构推出电镜领域AI Agent AutoMat,它能把原子级STEM图像转成标准CIF结构并给出关键物性,将人工流程缩短至几分钟。它还构建数据集验证,性能超现有工具,不过也有瓶颈待解决。
告别“试验田”:当大模型真正嵌入 ERP、供应链与核心决策流 | AICon
文章围绕大模型嵌入企业核心系统展开,邀用友罗小江等担纲。介绍鞍钢赵伟升级 RAG 技术、用友罗小江构建决策架构、京东耿东阳用大模型优化供应链的案例,为企业数智化转型提供参考。