「优化问题」共找到 4183 篇相关文章
OpenAI公告正经解释:为什么GPT-5.5爱说“哥布林”
OpenAI官网发公告回应GPT-5.5爱说“哥布林”问题。原来是对“书呆子”人格训练时,无意中对使用生物比喻的模型给予高奖励,导致“哥布林”表述扩散。之后移除相关奖励和过滤数据来解决。
开源SOTA!商汤原生多模态一个大脑完成看图、推理、作画
商汤开源日日新SenseNova U1,用NEO - unify架构让像素和文字自由协作,多项指标达开源SOTA,适配10家国产芯片。它能完成看图、推理、作画等多任务,虽有局限,但后续优化值得期待。
开源「洁癖.skill」,让你的Agent越用越聪明。
作者开源了名为洁癖.Skill的工具,它能在Agent完成功能或解决BUG后,自动审查项目文档体系和记忆文件并迭代,适用于Claude Code、Codex等四个平台,解决上下文混乱问题,让Agent越用越聪明。
GPT-5.5好到不敢睡觉,奥特曼连夜写下五大宣言!
GPT-5.5代号「Spud」,在多项测试中表现出色,开发者实测反馈良好。奥特曼在GPT-5.5发布且口碑好时,写下AI五大原则,称AI要民主化、赋能等,还暗示政府需考虑新经济模式应对AI影响。
你写的Skill,正在拖慢模型?策略式Gene才是正确答案
EvoMap团队与清华围绕‘Skill拖慢模型’问题研究,提出‘Gene’概念。经实验,Gene在控制模型表现上优于Skill,还定义了GEP协议。其成果在CritPt基准测试表现出色,为Agent经验复用提供新方向。
GPU利用率不到15%,AI产业最大的浪费正在被这家公司改写|甲子光年
AI产业发展中算力成本高、利用率低问题凸显。趋动科技押注‘软件定义GPU’,试图把独占GPU变为共享算力池,其产品使客户GPU利用率平均提升约4倍,已服务超200家头部客户。
东南大学耿新团队:模型不是不会做,而是被「挤掉了能力」丨CVPR 2026
东南大学耿新团队针对模型多任务融合问题提出论文《Model Merging in the Essential Subspace》。指出多任务融合失败源于关键方向重叠冲突,提出 ESM 方法,能让不同任务在模型中稳定共存,实验显示其性能更优。
告别「想完再做」卡顿!清华StreamingVLA让VLA边想边行动,提速2.4倍
视觉 - 语言 - 动作(VLA)模型“观测 - 生成 - 执行”串行模式致交互卡顿,清华与联想合作提出StreamingVLA框架,引入两项技术实现并行处理,在测试中显著提升效率和流畅度,为VLA模型部署提供新方案。
上交大 x vivo 团队:一个简单改动,让 diffusion 全面提升丨CVPR 2026
上交大与 vivo 团队提出 C²FG 方法,针对当前 diffusion 模型缺稳定可控生成机制问题,通过 score 差异实现动态引导控制。实验显示,该方法能提升多维度指标,改进生成分布,揭示生成机制新方向。
全球1100万台出货,追觅打造最聪明的扫地机
追觅扫地机将AI打造成完整链路,实现从感知到决策的闭环。其X60 Pro采用超广角双目灵动导航避障技术,提升感知能力,引入强化学习优化决策,全球出货超1100万台,营收增长显著。