端到端微调」共找到 2540 篇相关文章

新闻资讯7

Murati翁荔陈丹琦公司发布首个产品,让大模型微调门槛暴降,要重新发明一个OpenAI

Thinking Machines Lab发布首个产品Thinker,让模型微调像改Python代码一样简单。它是用于微调语言模型的灵活API,降低了大模型微调门槛,受业界关注。此外,该公司还尝试重新发明OpenAI,而OpenAI正打造社交模式。

量子位
开源动态8

告别 AI 流量焦虑!这款开源神器让你的品牌成为 AI 的「标准答案」

市面上 GEO 工具大多是 SaaS 订阅制,有收费高、数据不透明等问题。开源项目 GeoLook 是 GEO 实施平台,实现监测交付闭环,有数据主权、适配中文市场等亮点,还给出快速上手步骤。

开源星探
算法论文8

RL加持的3D生成时代来了!首个「R1 式」文本3D推理大模型AR3D-R1登场

强化学习首次被系统性拓展文本3D生成领域,上海人工智能实验室等机构研究者提出首个强化学习增强的文本3D自回归模型AR3D - R1,还提出Hi - GRPO范式和MME - 3DR基准,实验显示其性能优异。

机器之心
推荐文章7

自动驾驶优化:从复杂性实时工程

本文深入探讨自动驾驶技术栈架构,阐释从上下文感知传感器融合MPC求解器等优化技术,如何将原始传感器数据转化为安全控制指令,还介绍轨迹规划、实时计算预算及调试等内容。

InfoQ
算法论文8

充分激发模态协作,MokA量身打造MLLM微调新范式

当下多模态大模型微调多「照搬」单模态微调策略,忽视模态差异。中国人民大学和上海人工智能实验室团队提出 MokA 方法,兼顾单模态与跨模态建模,在多基座、多场景实验中显著提升性能。

机器之心
新闻资讯7

订单排2027年,全球AI算力建设急需中国光纤

AI产业发展使光纤需求暴增,价格飞涨,交货期排2027年。原因一是AI算力中心需大量光纤,二是俄乌战争消耗不少。中国光纤因长期内卷掌握技术、摊薄成本,订单已排2028年。

芯师爷
算法论文8

用LoRA微调VLM做乳腺癌病理分类,实战对比CNN

哈萨克斯坦团队论文对比CNN和用LoRA微调的VLM在乳腺癌病理分类上的表现。指出VLM微调后接近CNN水平,但CNN仍是王者。还介绍LoRA原理、实验设计、结果,给出实战代码及对从业者和研究者的启示。

机器学习AI算法工程
推荐文章8

大模型微调评测入门:看懂这些指标,才知道模型好不好

文章指出大模型微调中很多新手重“调”轻“评”,评测是决定模型落地的关键。介绍分类和生成任务评测指标,给出实操步骤,还说明如何综合判断模型好坏,最后展望评测技术朝自动化等方向发展。

机器学习AI算法工程
新闻资讯7

Cloudflare 如何将 Quicksilver 迁移多级缓存并处理数十亿个请求

Cloudflare 工程团队分享将全局键值存储 Quicksilver 过渡分层缓存架构的故事。从 V1 V2 迁移,采用多级缓存策略,解决存储、一致性等问题,提升性能,多数请求可在短时间内响应。

InfoQ
产品应用8

从Vibe CodingAgentic Engineering:重构后台开发全流程

文章介绍从 Vibe Coding Agentic Engineering 的转变,以真实需求为例,展示后台开发全流程,涵盖需求获取合入发布各阶段,介绍各阶段工具及操作,凸显 Agentic Engineering 优势,强调人编排、AI 执行的核心理念。

腾讯技术工程