「优化动态」共找到 1536 篇相关文章
企业级消息系统构建指南
文章介绍企业级消息系统构建,阐述概念、价值、典型场景,对比主流开源系统如 Kafka、Pulsar 等。通过腾讯、华为等企业实践展示选型与优化,还提及运维保障,指出未来消息系统在 AI 领域机遇与挑战。
The Batch: 882 | Qwen3-Next 提速
阿里巴巴对开源权重模型 Qwen3 全新升级,发布 Qwen3 - Next - 80B - A3B 的 Instruct 和 Thinking 版本权重。其融合新研究成果,推理能耗低、速度快,还优化架构和训练方法提升效率与稳定性。
云厂商「进击」 Agent 开发平台
企业级智能体(Agent)市场崛起重构云服务竞争格局,云厂商需提供全栈能力。腾讯云宣布智能体开发平台3.0上线,优图实验室关键技术持续开源。文中还分析企业开发Agent难题及腾讯云应对举措。
ChatGPT负责人深度复盘,爆4o复活内幕!过快下线是失误,将迭代模型人格
8月14日,ChatGPT负责人Nick Turley深度复盘GPT-5发布「风波」,总结失误如过快下线GPT-4o、低估用户情感依恋等,还分享OpenAI产品设计哲学,强调持续迭代模型人格。
多模态大模型持续学习系列研究,综述+Benchmark+方法+Codebase一网打尽!
近年来,生成式AI和多模态大模型进展显著,但在动态环境下实现持续学习是挑战。中科院自动化所联合香港院AI中心系统性研究,提出综述、方法、Benchmark和Codebase,为相关人员提供全面支持。
科普向:一文解构大模型后训练,GRPO和它的继任者们的前世今生
文章深入解读大模型后训练,先对比 PPO 与 GRPO,指出 GRPO 优势及成本问题。又介绍 GRPO 后续改进算法,如 DAPO 解决训练问题、GSPO 提升训练稳定性、GFPO 可优化多属性,还提及 GRPO 其他缺陷。
混元3D世界模型1.0 lite版本发布,消费级显卡就能跑
腾讯混元3D世界生成模型HunyuanWorld 1.0发布即开源,可在消费级显卡运行,还能兼容传统CG管线。它分层实现3D生成,通过量化等技术降低显存开销,与同类模型相比优势明显。
金融智能体真的是大模型落地“最后一公里”?
InfoQ《极客有约》X AICon 直播栏目邀请业内人士探讨金融 AI 大模型实践现状。指出大小模型融合是主要方案,智能体有应用但也有问题。还分享了评估 AI 项目的要点、智能体应用案例及未来布局方向。
让64张卡像一张卡!浪潮信息发布新一代AI超节点,支持四大国产开源模型同时运行
浪潮信息发布新一代AI超节点“元脑SD200”,可让64张卡像一张卡。它支持四大国产开源模型同时运行,实现算力聚合突破,通过软硬协同优化提升推理性能,采用开放架构推动“智能平权”。
3D-R1:让AI理解3D世界的下一步
文章介绍新研究3D - R1,它是更通用、具推理能力的三维视觉语言模型,解决了当前3D VLM空间理解不足与推理能力薄弱问题,在多任务测试领先,有广阔应用前景。