「优化计划」共找到 1744 篇相关文章
上交大智能计算研究院论文:不只算对答案,大模型如何真正学会运筹建模丨ICLR 2026
上海交大智能计算研究院提出 StepORLM,通过生成式过程监督提升运筹建模可靠性。研究反思传统训练范式局限,在多数据集测试中,小参数的 StepORLM 表现超大型模型,还分析现有方法缺陷并提出解决框架,有重要方法论和应用意义。
首钢园“产业跃升俱乐部”首秀:从WANOS全景声到波萝元宇宙
首钢园“产业跃升俱乐部”首期轮值活动“从WANOS全景声到波萝元宇宙”成功举办,标志开启月度轮值新机制。活动汇聚各方精英,探索创新驱动产业跃升路径,展示波萝元宇宙成果,还围绕技术与投资议题讨论。
天下苦CUDA久矣,又一国产方案上桌了
AI开发中,国产硬件增多,但开发者仍依赖进口生态。KernelCAT作为国产AI Agent应运而生,它能开发高性能算子,在昇腾芯片测试中表现出色,还能助力模型在国产平台高效迁移,限时免费内测。
马斯克刚刚真把 𝕏 平台推荐算法给开源了,核心也是Transformer
𝕏平台(原Twitter)将全新推荐算法开源,由与xAI的Grok模型相同的Transformer架构驱动。该算法预测用户行为对帖子排序。此前平台因算法问题被调查和罚款,开源或有此原因。
缩放定律Scaling正慢性死亡,算力收益递减,AI的下一个增长极是模型如何交互
前Google Brain科学家Sara Hooker论文指出,统治AI十年的缩放定律Scaling走向慢性死亡,算力收益递减,研究重点将转向推理时算力和模型如何交互,还分析了算力崇拜兴起、缩放法则裂痕及未来方向。
50万个AI生成的应用,正在赚钱
在2025秒哒创造者大会上可知,“三无”AI生成应用已诞生50万个商业应用,覆盖200多个细分领域。如“荣堂古村数字博物馆”等,它们变现能力强。秒哒是相关工具,操作简单,技术体系完整。
苹果光速撤回RLAX论文:用了谷歌TPU和阿里Qwen,作者中还有庞若鸣
苹果一篇新论文在 arXiv 公开后匆匆撤稿。该论文揭示基于 TPU 的可扩展 RL 框架 RLAX,用了谷歌 TPU、亚马逊云及阿里 Qwen 模型,还介绍其架构、策略支持等,实验结果亮眼,也分享 Debug 过程。
告别VAE压缩损耗,南京大学用DiP让扩散模型回归像素空间,实现10倍加速与SOTA级画质
南京大学、腾讯优图实验室和新加坡国立大学发布DiP框架,即将开源。该框架不依赖VAE,仅增0.3%参数量,推理提效10倍,在ImageNet获1.79的FID分数,解决扩散模型在像素空间难兼顾质效的问题。
基于AI大模型的故障诊断与根因分析落地实现
文章围绕基于AI大模型的故障诊断与根因分析展开,介绍项目背景、目标与原理,阐述要解决的运维痛点及技术架构、知识库构建,还提及ReAct模式实现、Dify工作流及ClaudeCode对比,目前根因定位成功率有所提升。
Claude Skills 写作指南:从0到1看完就会,不会来找我
本文介绍Claude Skills写作指南,指出传统提示词使用麻烦,而Skills能解决问题。阐述其适用场景、定义、原理,还讲了创建方法、作者实践及完整写作工作流,可按需管理提示词。