模型优化器」共找到 8273 篇相关文章

8

实测最强的Cowork Agent模型M2.7,这是龙虾最好的模型搭子

实测MiniMax新发布的M2.7模型,解决了Agent的笨拙感,是国内最强的Cowork Agent模型。它技能命中率高,能自进化,对办公场景做了优化,还能解决生产效率问题,加强了人设保持能力。

开源AI项目落地
算法论文8

NeurIPS 2025|CAKE:大模型驱动的贝叶斯优化新配方,让黑箱优化更智能、更高效

香港中文大学(深圳)等高校研究人员提出 CAKE 方法,被 NeurIPS 2025 接收。它利用大语言模型动态设计高斯过程核函数,构建自适应贝叶斯优化框架,在多领域实验中效果优,还具备可解释性。

机器之心
推荐文章8

揭秘千卡 GPU 集群如何高效训练多模态大模型:vivo AI 团队实战经验分享|AICon

在 InfoQ 举办的 AICon 大会上,vivo AI 架构师王兆雄分享多模态大模型训练经验。介绍了 LLaVA 和 DiT 模型训练挑战,从数据处理、模型计算等方面提出优化策略,还展望 AI Infra 未来发展方向。

AI前线
推荐文章7

150%训练效率提升:感知检测小模型训练优化方法

文章基于业务实践,总结感知检测小模型在不同算力卡上的训练方法,为智能驾驶场景提供借鉴。介绍测试环境、技术架构,分析环境依赖冲突、源代码适配等问题并给出解决方法,还提及性能优化及测试结果。此外还介绍用 RAGFlow 构建私有知识问答应用。

阿里云开发者
算法论文8

让大模型合成检查:UIUC团队挖出Linux内核90余个长期潜伏漏洞

伊利诺伊大学香槟分校张令明老师团队的论文提出KNighter,它让大模型生成静态分析检查,在Linux内核挖出92个长期潜伏漏洞,将LLM归纳能力沉淀为规则,带来可落地等好处。

机器之心
算法论文7

ENG APPL COMP FLUID | 西北工业大学曹文博、张伟伟等:基于参数化神经网络求解的层流翼型绕流代理模型

近年来,PINNs在流体力学中受关注,但在高维参数化与复杂流动问题中受限。西北工业大学曹文博团队基于TSONN构建层流翼型绕流参数化求解,训练出强泛化能力的代理模型,为工程层流气动分析提供新方案。

力学与人工智能
算法论文8

CNSNS|西工大曹文博、张伟伟:克服优化求解中的损失条件数瓶颈:一种良性损失函数

基于优化的偏微分方程求解方法受关注,但实际慢于经典迭代求解。本文从条件数角度审视效率瓶颈,指出标准MSE损失导致条件数平方放大、减缓收敛。提出稳定梯度残差损失SGR,在收敛速度与稳定性间建立平衡,实验验证其有效性。

力学与人工智能
新闻资讯8

沈向洋解读AI演进五大维度!IDEA研究院发布“万物可抓取”模型,GPU渲染打破国外垄断

沈向洋分享梳理智能演进的五个维度,包括算法范式、智能载体等,指出机会不仅来自技术本身。此外,IDEA研究院还发布“万物可抓取”DINO - X Grasp模型、MoonBit编程语言、GPU渲染Smart等创新成果。

量子位
开源动态8

蚂蚁dInfer框架,让扩散大语言模型推理速度再飙10倍,相同模型性能下超越自回归模型

蚂蚁开源dInfer框架,联合名校发论文阐述实现细节。它解决扩散模型推理难题,提出创新算法和系统优化策略,实验显示其推理速度远超Fast - dLLM和自回归模型标杆vLLM,代码已开源。

AIGC开放社区
开源动态8

千星项目LLMRouter:多模型路由,16+策略优化推理

UIUC开源智能模型路由框架LLMRouter,可自动为大模型应用选最优模型,有16+路由策略。该框架打通训练、评测等链路,解耦Route与Training模块,支持多轮协同等,还可插件式扩展。

新智元