全参数微调」共找到 2634 篇相关文章

新闻资讯7

Murati翁荔陈丹琦公司发布首个产品,让大模型微调门槛暴降,要重新发明一个OpenAI

Thinking Machines Lab发布首个产品Thinker,让模型微调像改Python代码一样简单。它是用于微调语言模型的灵活API,降低了大模型微调门槛,受到业界关注。此外,该公司还尝试重新发明OpenAI,而OpenAI正打造社交模式。

量子位
开源动态8

AI能帮忙厨房看火了!面壁智能开源模态模型MiniCPM-o4.5,边看边听还能主动抢答

面壁智能开源模态模型MiniCPM-o4.5,能边看边听还主动抢答。它引入双工多模态实时流机制,在多方向达模态模型领先水平。该模型是端侧原生,将与开发板配套,助力端侧智能硬件开发。

量子位
新闻资讯8

谷歌:栈AI之王

随着Gemini 3模型与第七代TPU的发布,谷歌打破OpenAI与英伟达主导的市场叙事。其栈AI战略从底层基础设施到用户产品覆盖,TPU进化、软硬件契合,吸引大客户,C端产品成发展引擎。

新智元
开源动态8

35B参数科学性能比肩万亿参数模型,『书生』科学大模型Intern-S2-Preview开源

5月15日上海AI实验室开源新一代大模型预览版Intern - S2 - Preview,尺寸小、科学能力强,在多方面有突破。其深化与昇腾算力生态协同,探索‘通专融合’,科学及智能体能力升级,还优化训推效率。

GiantPandaLLM
新闻资讯7

晶晨股份资收购无线通信芯片公司芯迈微

晶晨股份拟3.16亿资收购芯迈微,核心是战略补强,借此获取研发团队与技术IP,补齐广域网连接短板,构建栈解决方案能力,从单点技术竞争迈向平台生态竞争。

芯师爷
算法论文8

充分激发模态协作,MokA量身打造MLLM微调新范式

当下多模态大模型微调多「照搬」单模态微调策略,忽视模态差异。中国人民大学和上海人工智能实验室团队提出 MokA 方法,兼顾单模态与跨模态建模,在多基座、多场景实验中显著提升性能。

机器之心
产品应用8

腾讯 CodeBuddy IDE 如何成为一个“栈高级工程师”?

腾讯 CodeBuddy IDE 海外版开启内测,国内版预计 8 月上线。它定位‘下一代 AI 栈高级工程师’,内置 4 个智能体,助力链路研发。腾讯内部超 43% 代码由 AI 生成,编码时长缩短 40%。

AI前线
产品应用8

MiniMax Agent 再进化!正式走向商业级栈开发

MiniMax Agent 升级成‘栈开发师’,建立完整交付标准,构建技术生态。它能完成多任务,配置顺滑,可处理前端问题。还在 MCP 生态、支付集成等方面革新,从工具迈向数字化商业引擎。

特工宇宙
开源动态7

Kimi开源又放大招!20秒更新万亿参数的中间件来了

Kimi开源出新中间件checkpoint - engine,让Kimi K2万亿模型参数进入“秒更时代”。它能支持一次性发送更新权重,实现点对点动态更新,在K2中发挥重要作用,还可抵御单点故障。

量子位
算法论文8

用LoRA微调VLM做乳腺癌病理分类,实战对比CNN

哈萨克斯坦团队论文对比CNN和用LoRA微调的VLM在乳腺癌病理分类上的表现。指出VLM微调后接近CNN水平,但CNN仍是王者。还介绍LoRA原理、实验设计、结果,给出实战代码及对从业者和研究者的启示。

机器学习AI算法工程