「OpenAI 兼容模型」共找到 8833 篇相关文章
王兴一鸣惊人!美团首个开源大模型追平DeepSeek-V3.1
美团首个开源大模型Longcat-Flash-Chat发布即引发热议。它在部分benchmark上超DeepSeek-V3.1等,编程能力也出色。技术报告透露美团对大模型的理解,还有新发现,且性能好、训练效率高。
专为“超大模型而生”,新一代训练引擎 XTuner V1 开源!
9月8日,上海AI实验室开源书生大模型新一代训练引擎XTuner V1。它能应对复杂训练场景、速度更快,尤其在超大规模稀疏混合专家(MoE)模型训练中优势显著。还将一并开源AIOps工具DeepTrace与ClusterX。
啊?微博7800美元训的大模型,数学能力超了DeepSeek-R1
近日,微博发布自研开源大模型VibeThinker,15亿参数却在数学测试上击败6710亿参数的DeepSeek R1,后训练成本仅7800美元。其为AI产业带来新思考,还将推动微博AI应用发展。
全国首部AI大模型私有化部署标准,公开征集起草单位和个人!
近期AI政策频出,企业对AI应用需求攀升,倾向私有化部署,但行业面临技术错配等问题。国内首部AI大模型私有化部署标准《人工智能大模型私有化部署技术实施与评价指南》立项,正征集起草单位和个人。
清华朱军团队Nature Machine Intelligence:多模态扩散模型实现心血管信号实时全面监测
清华朱军等团队提出多模态生成框架 UniCardio,在单扩散模型中实现心血管信号去噪、插补与跨模态生成。它采用扩散模型和 Transformer 架构,结合持续学习范式,实验表现优,有望用于多领域。
Meta 再挖角4名OpenAI 华人研究员!网友:希望给的钱不要比Yann LeCun 多……
The Information报道,Meta再从OpenAI挖走四名关键华人研究员,这是第二波挖角。此前Meta刚斥巨资收购股份并挖来华裔CEO。此次挖角引发各方反应,也凸显AI人才竞争激烈。
OpenAI真正王牌,不是Ilya!刚刚,奥特曼罕见致谢这两人
大众视野里OpenAI故事只剩几个响亮名字,但Jakub Pachocki和Szymon Sidor这对从波兰高中走出的搭档,用默契把不可能变现实。从Dota AI到GPT - 4,他们身影贯穿OpenAI核心节点,奥特曼罕见致谢他们。
一键开关灯!谷歌用扩散模型,将电影级光影控制玩到极致
Google推出LightLab项目,可从单张图像精准控制光影,解决传统光影控制难题。其通过特殊数据集微调扩散模型,让模型学会控制光照,还介绍了方法、后处理流程等,实验显示表现优,有多种应用。
李飞飞团队新作:DiT不训练直接改架构,模型深度减半,质量还提高了
本文介绍「嫁接」技术,可在小计算预算下编辑预训练 DiTs 探索新架构。不从头训练,替换算子创建混合架构,保持质量同时减少计算量。还通过实验展示该技术在构建高效架构和文生图模型中的效果。
告别“试验田”:当大模型真正嵌入 ERP、供应链与核心决策流 | AICon
文章围绕大模型嵌入企业核心系统展开,邀用友罗小江等担纲。介绍鞍钢赵伟升级 RAG 技术、用友罗小江构建决策架构、京东耿东阳用大模型优化供应链的案例,为企业数智化转型提供参考。