「复杂优化问题」共找到 4802 篇相关文章
庞若鸣还有苹果论文?改善预训练高质量数据枯竭困境
苹果基础模型原负责人庞若鸣在 Meta 任职期间,其在苹果参与的高价值研究仍不断发表。研究团队针对大模型训练中高质量数据枯竭问题,提出 Synthetic Bootstrapped Pretraining (SBP) 预训练流程,提升模型性能。
云厂商「进击」 Agent 开发平台
企业级智能体(Agent)市场崛起重构云服务竞争格局,云厂商需提供全栈能力。腾讯云宣布智能体开发平台3.0上线,优图实验室关键技术持续开源。文中还分析企业开发Agent难题及腾讯云应对举措。
3D生成到达3.0阶段,不止提升行业渗透率,也正催生3D原生新玩法 | 对话3D生成平台Tripo
AI 3D生成领域前景广阔但也有疑惑焦虑。量子位智库对话VAST创企,其创始人与CTO分享3D原生玩法、落地场景,还谈产品开发、需求发掘等认知,Tripo平台已覆盖众多用户。
配置驱动的动态Agent架构网络:实现高效编排、动态更新与智能治理
本文提出配置驱动的独立运行时 Agent 架构,解决低代码/平台化 Agent 方案企业级落地难题。介绍其核心架构、注册中心、配置定义等,还提及 Agent Studio、执行引擎等,阐述运行部署、协作、治理,提供通用可落地范式。
ChatGPT负责人深度复盘,爆4o复活内幕!过快下线是失误,将迭代模型人格
8月14日,ChatGPT负责人Nick Turley深度复盘GPT-5发布「风波」,总结失误如过快下线GPT-4o、低估用户情感依恋等,还分享OpenAI产品设计哲学,强调持续迭代模型人格。
谷歌DeepMind「粪坑淘金」全新方法,暗网毒数据也能训出善良模型
谷歌DeepMind研究团队发表论文提出生成式数据精炼(GDR)方法,不直接生成新数据,而是用大模型净化原始数据,保留有用信息。该方法能解决数据枯竭、隐私等问题,实验显示效果良好。
国科大 | 提出进化算法:EvolKV,自适应分配KV Cache,预算降至1.5%!
键值缓存(KV cache)是大模型快速运行核心技术,但输入文本越长,存储和处理问题越突出。国科大提出进化算法EvolKV,自适应分配KV Cache,实验显示其效果显著,预算可降至1.5%。
OpenVision 2:大道至简的生成式预训练视觉编码器
多模态大模型浪潮中,视觉模块是关键。此前OpenVision训练管线复杂,成本高。研究者提出OpenVision 2,移除文本编码器与对比学习,引入随机丢弃视觉token技巧,性能佳且效率高,挑战了对比学习范式。
开发速度不是瓶颈
文章围绕‘凭感觉编程’展开,指出开发速度并非产品成功的关键制约因素。分析原型与产品差异,以亚马逊、谷歌为例说明产品需不断尝试。强调真正瓶颈是验证和沟通,编码速度从来不是问题。
突破企业AI落地的瓶颈:LangGraph × OceanBase 的融合数据层深度实践与解析(附源码)
麻省理工报告显示约95%企业实施AI后未获商业回报。文章从企业级AI应用场景切入,探讨数据层需求,通过Demo展示LangGraph与OceanBase融合构建数据底座,解决企业AI落地瓶颈,附源码。