「探索与利用」共找到 7152 篇相关文章
GenEnv:智能体与环境模拟器之间的难度对齐协同进化 | 直播预约
训练高性能 LLM 智能体受限于真实世界交互数据的成本和特性,为此推出 GenEnv 框架,它建立难度对齐协同进化博弈,能让智能体表现提升,减少数据使用量,为扩展能力提供数据高效路径。
一文看清AI、开源与商业的真正博弈,GOBI 2025圆满收官!
12月21日,GOBI 2025全球开源商业创新大会在北京举办。会上多位专家、学者围绕AI开源商业展开讨论。杜莹芬强调开源可持续需制度支撑;汪华称中国开发者迎AI开源创业黄金窗口;蒋涛梳理AI开源商业化新逻辑。
单卡跑出集群效率!Hugging Face TRL 与 RapidFire AI 的超并行革命
Hugging Face宣布其核心微调库TRL集成RapidFire AI,重构大模型后训练阶段工作流。RapidFire引入超并行实验引擎,提升实验验证速度,解决算力受限团队的调参难题,带来效能质变。
“交互式Scaling”:增加Agent与环境交互的深度和频率来提升性能
在AI发展中,商业研究Agent是“黑箱”,开源研究Agent性能有差距。MiroMind团队推出MiroThinker v1.0,提出“交互扩展”提升性能,在多基准测试表现出色,也指出了当前版本的局限。
并行扩散架构突破极限,实现5分钟AI视频生成,「叫板」OpenAI与谷歌?
近日,CraftStory 推出 Model 2.0 视频生成系统,凭借并行扩散架构破解视频时长难题,可生成长达五分钟视频。其由 OpenCV 创建者 Victor Erukhimov 创立,此次突破或为企业带来商业价值,还计划开发新模型。
深度长文解读 “世界模型” :在虚构与真实交接之处凝视未来
本文深入解读“世界模型”,虽无明确定义,但从目的出发分为表征和生成两类。前者含生物大脑、视觉和语言中心预测;后者有基于规则模拟和数据驱动生成。还探讨LLM是否为世界模型,指出各类模型相辅相成。
如何为 GPU 提供充足存储:AI 训练中的存储性能与扩展性
文章通过分析 MLPerf Storage v2.0 测试结果,探讨不同存储系统在大规模 AI 训练中的表现。介绍三类训练负载及新的 Checkpointing 负载,分析共享文件系统类别,给出比较视角,解读各负载测试结果并总结选型要点。
企业数据“LLM ready”与“小Palantir”们的崛起 | AGIX PM Notes
文章指出当前 AI 仍处准备阶段,企业数据未就绪是落地大障碍,深层问题是流程 AI 原生化转型。还介绍本周市场、多家科技企业动态,以及巴菲特和芒格对 ETF 的看法及投资建议。
当代码遇上大模型:智能编程助手的架构设计与工程实践
在 InfoQ 举办的 QCon 全球软件开发大会上,字节跳动段潇涵介绍如何基于大语言模型构建智能编程助手。他分享实践经验,剖析研发痛点,介绍技术架构,还探讨未来发展方向,如认知增强、工具整合等。
不拼参数,拼认知:工业AI的边界与深水区 | 甲子光年
如今AI渗透工业各环节,形成“大小协同”格局,但面临场景复杂、数据孤岛等挑战。西门子凭借深厚积累构建工业体系,其Industrial Copilot等产品落地中国,还自研基础模型突破瓶颈,围绕‘AI for Real’理念布局。