Kimi K2.5模型」共找到 9049 篇相关文章

算法论文8

最新视觉大模型 DINOv3论文精读(逐段解析)

DINOv3是突破性自监督视觉基础模型,其创新围绕数据与模型协同扩展、Gram锚定技术、多阶段训练策略。它解决传统自监督学习难题,在多任务上无需微调达最优,为计算机视觉树立新标杆。

机器学习AI算法工程
产品应用8

14K Star!统御万模的 AI 聚合网关,一个 API 管理所有大模型

文章分享了AI聚合网关神器New API,它基于Go和React开发,是中转分发系统,像超级转换插头。集成30+模型服务,有多种特性,支持6种部署方式,能收敛混乱的模型调用。

开源星探
开源动态7

从“开放模型”到“开放生态”,AI 开源进入下半场

近期,Meta 推出开放权重模型,而开放模型商业使用收费渐成趋势。AI 开源面临成本、边界等问题,竞争从模型能力转向基础设施选择。世界人工智能开源大赛关注模型应用,凸显开源生态建设重要性。

AI前线
开源动态8

Hugging Face 推出 GOLD:让不同模型家族也能做知识蒸馏

Hugging Face研究团队提出GOLD方法,解决了知识蒸馏中老师和学生模型需用同一套分词器的痛点,让不同模型家族间也能做知识蒸馏。它通过三步解决跨分词器蒸馏,实验效果良好,已集成到TRL库。

AI工程化
开源动态8

你敢信?GPT-5的电脑操作水平只比人类低2%了

Agent S3刷新了计算机使用智能体(CUA)在「OSWorld」基准测试的记录,性能达69.9%,接近人类水平。它引入bBoN实现并行扩展,还精简框架、引入原生代码智能体,已开源并发布论文。

机器之心
新闻资讯8

模型竞赛转向:决胜关键为何是“后训练”?|甲子光年

模型价值主战场向后训练转移,Grok 4凭后训练成“宇宙最强”。产业应用中通用模型适配难,后训练方法也在进化,如采用SFT+RL等,还介绍了夸克和阿里云的后训练实践。

甲子光年
开源动态7

VeRL-Omni:面向扩散和全模态生成模型的通用RL后训练框架

VeRL-Omni是面向多模态生成模型的通用RL后训练框架,覆盖多种架构。它有高效多模态rollout、灵活奖励引擎等特性,支持多种硬件,团队还验证了不同训练方式,后续将扩展模型与算法支持。

机器之心
开源动态7

DeepSeek 新模型 R1-0528 悄悄开源,与o3 相当,实测来了。

DeepSeek团队悄无声息地在Hugging Face上开源推理模型新升级版DeepSeek R1-0528,基于DeepSeek-V3-0324模型,架构和训练方法有改进,性能与o3相当,实测表现不错。

AI进修生
算法论文8

AI失忆术!只需3个注意力头,就能让大模型忘记「狗会叫」

Meta和纽约大学团队发布论文《From Concepts to Components》,提出SAMD和SAMI方法。前者定位模型概念注意力模块,后者微调强度。能让模型‘失忆’,还可增强推理、控制安全,为AI研究开新方向。

新智元
新闻资讯7

全国首部AI大模型私有化部署标准,公开征集起草单位和个人!

近期AI政策频出,企业对人工智能应用需求攀升,倾向私有化部署,但面临诸多问题。国内首部AI大模型私有化部署标准《人工智能大模型私有化部署技术实施与评价指南》立项,现征集起草单位和个人。

AI工程化