双层优化框架」共找到 2652 篇相关文章

新闻资讯8

腾讯发布超低成本AI训练法!120元效果秒杀70000元微调方案

腾讯提出无训练组相对策略优化Training-Free GRPO,无需调整参数,在提示词中学习经验就能提升模型性能。实验显示,该方法在数学推理和网页搜索任务上效果显著,成本远低于传统方法。

量子位
开源动态8

LLaVA-OneVision-1.5全流程开源,8B模型预训练只需4天、1.6万美元

灵感实验室团队联合 LMMs - Lab 推出 LLaVA - OneVision - 1.5,全流程开源。其 8B 模型预训练 4 天、成本 1.6 万美元,在多模态基准上性能优,还公开数据构建与训练策略等细节,复现简单。

机器之心
推荐文章7

高性能全闪并行文件系统的设计和实践

焱融科技 CTO 张文涛在 QCon 大会分享‘高性能全闪并行文件系统的设计和实践’,介绍了焱融全闪文件存储架构和 YRCloudFile 技术细节,分享其解决 AI 训练存储难题的方案。

InfoQ
开源动态8

“零人”搞医学研究:清华AI智能体从灵感到论文全程自主

清华大学自动化系索津莉课题组发布全自主AI研究框架OpenLens AI,实现医学研究全链条自动化闭环,解决医疗信息学研究效率困局,将科研周期从“月级”缩至“小时级”,还在质量控制上设新标杆。

量子位
开源动态8

CrowdStrike联手Meta发布AI安全基准,让AI在真实网络攻击中证明自己

美国网络安全巨头CrowdStrike与Meta在Fal.Con 2025大会联合推出开源基准测试套件CyberSOCEval,旨在评估AI大语言模型在真实SOC环境下的网络安全能力,它源于Meta之前框架,开源供全球开发者使用。

AIGC开放社区
新闻资讯7

AI 项目总踩坑?小团队、渐进研讨带你找到正确打开方式

Cloud Native Summit 2025奥克兰大会探讨企业借Open Practice Library将协作模式转化成果。Andrea Magnorsky分享Byte - Sized Architecture方法,Ahilan Ponnusamy与Andreas Grabner介绍企业采用AI的迭代式框架,强调小规模持续研讨。

InfoQ
开源动态8

阿里开源 Wan2.2-Animate!统一角色动画和视频人物替换

阿里通义实验室开源 Wan - Animate,这是用于角色动画与替换的统一框架。它构建于 Wan 模型之上,支持角色动画和角色替换两项核心功能,性能超现有算法,还通过独特设计实现多种效果。

带你学AI
产品应用7

蚂蚁集团发布KAG-Thinker,多跳问答慢思考,医疗领域拿下87分

在LLM问答领域,多跳问题存在局限性。蚂蚁集团发布KAG - Thinker,它是基于KAG框架的模型,能解决复杂问题的逻辑连贯性和上下文一致性。还介绍了其工作原理、示例、医疗应用及稳定性表现。

CourseAI
新闻资讯8

专治智能体盲跑!微软发布AI Agent 5大可观测性,打通任督二脉

今天凌晨微软官网发布AI Agent 5大可观测性最佳实践,解决智能体盲跑等难题。介绍了智能体可观测性概念和好处,展示5个应用案例,还阐述5大实践,如选模型、持续评估、集成CI/CD等。

AIGC开放社区
新闻资讯7

AI 写 80%,人修最后 20%:这是什么新赛道?“ AI 代码补锅匠 ”了解一下。

Vibe Coding 成 2025 年 AI 驱动开发核心趋势,强调用自然语言提示让 AI 生成代码。虽可提升效率,但 AI 生成代码有质量、安全等问题,催生付费修复服务,未来“AI+专家”模式或成主流。

AI进修生