「推理性能优化」共找到 4188 篇相关文章
千卡集群破壁之道:vivo视觉多模态大模型训练效率跃迁实战
多模态大模型在多领域需求增长,但千卡级 GPU 训练挑战大。vivo AI 架构师王兆雄在大会演讲,结合 LLaVA 和 DiT 模型实践,解析优化策略,分享提升训练效率与稳定性的经验,还展望了 AI Infra 未来。
用“因果规划”解决多智能体协作中的任务依赖难题|港科广&腾讯
港科广和腾讯研究团队提出CausalMACE方法,将因果推理机制引入开放世界多智能体系统。该方法含全局因果任务图,框架分“判断”“规划”“执行”环节,在基准任务中表现出色,已中稿EMNLP 2025 Findings。
英伟达H20,一个备胎的命运
8月22日消息称英伟达暂停H20芯片生产。H20自2023年底推出就备受争议,性能阉割、或有“后门”等问题不断。英伟达忙着开发新芯片,H20不到两年或“寿终正寝”,本文以其口吻写自白信。
奖励模型终于迎来预训练新时代!上海AI Lab、复旦POLAR,开启Scaling新范式
在大语言模型后训练阶段,奖励模型设计与训练是关键瓶颈。上海AI Lab、复旦推出预训练奖励模型POLAR,采用策略判别学习新范式,适配强化微调,性能和泛化能力强,为LLM后训练带来新可能。
独家干货!Apache Iceberg未来蓝图:Open Lakehouse闭门会核心洞察
作者分享 Open Lakehouse 闭门会洞察,介绍 Apache Iceberg 现状与未来。2025 年 6 月发布 V3 规范,实现跨引擎操作。现正筹划 V4,有元数据优化、CDF 演进等方向,还探讨了 BLOB 类型和 Lance 格式融合等。
刚刚,OpenClaw最猛升级!底层架构大换血,全网等了9天
OpenClaw「2026.3.22-beta.1」预览版上线,对插件系统重构,新SDK替代旧API,ClawHub成首选分发渠道;安全防护升级,封堵多个漏洞;模型配置升至GPT - 5.4,接入Anthropic Vertex等;多平台体验和Agent引擎也有优化。
GPT-5点赞!八大顶尖机构发布「自进化智能体」全面综述
在2025年,大语言模型已演变为智能体,但现有智能体部署后难以适应变化。格拉斯哥大学等机构学者发布综述,系统梳理自进化AI智能体核心框架与挑战,提出三定律,还介绍了优化技术、应用案例等,并指出未来方向。
Nanbeige4.2-3B:探索通用Agent小模型
在模型越做越大的当下,推理成本成了影响Agent大规模使用的关键因素。南北阁实验室推出Nanbeige4.2 - 3B,在架构、数据构造和训练pipeline层面做了系统工作,评测表现良好,还探索本地个人助手等应用。
Mythos:普通人能自由使用旗舰 AI 的时代,可能要结束了
两天前,Anthropic 发布最强模型 Claude Mythos Preview,各方位性能超 Opus 4.6 模型,却不公开发布,只面向少数合作方开放。这或预示普通人自由用旗舰 AI 的时代将结束,引发对 AI 未来商业与使用模式的思考。
小米神操作!认领榜一神秘模型Hunter Alpha,龙虾之父都忍不住打听
小米官宣MiMo-V2家族三款新模型Pro、Omni和TTS,其中Pro就是此前占领OpenRouter调用量榜单第一的神秘模型Hunter Alpha。它参数规模万亿,性能亮眼,Omni和TTS也实力强悍,此前身份引发全球网友好奇。