可运行性」共找到 4689 篇相关文章

推荐文章7

图解Vllm V1系列4:加载模型权重(load_model)

文章聚焦vllm加载模型权重的流程。从入口函数切入,详细分析DefaultModelLoader的工作步骤,包括初始化模型架构和实际加载权重,还给出各步骤代码及作用,为想操作load_model的人提供框架。

GiantPandaLLM
新闻资讯7

MCP 火爆半年后,是时候对它“祛魅”了

2024 年 11 月 25 日,Anthropic 发布的 MCP 协议意义重大,解决了 AI 模型与工具、数据源集成的碎片化问题。文章深入探讨其架构、价值、影响及趋势,还采访专家解答相关疑问。

InfoQ
开源动态7

Memvid:把你的文档库变成一个小巧的视频,还能瞬间搜出你想要的!

传统向量数据库因高成本和复杂运维让开发者却步。开源项目Memvid将文本数据存入视频文件,能高效检索,解决存储冗余、检索延迟和网络依赖问题,使用简单,虽处概念原型阶段但值得尝试。

AI工程化
算法论文8

单卡即微调大模型!内存占用仅1/8,能依然拉满 | ICML 2025

基础大模型应用于下游任务时微调成本高,低秩适应(LoRA)方法虽降低成本,但能不及全量微调。华中科技大学和香港中文大学团队提出GOAT框架,在25个多领域任务验证效果好,内存占用仅1/8。

量子位
开源动态8

2天1k多星!BAGEL横空出世:字节跳动发布全球首个多模态全能AI,开启智能新纪元!

字节跳动推出开源多模态基础模型BAGEL,有70亿活跃参数。它在多模态理解排行榜超顶尖开源模型,文本到图像质量与SD3媲美,还具备世界建模等能力,文中介绍其方法、特及使用说明。

GitHubStore
开源动态8

狂涨10.3K star!最近爆火的微信记录训练专属数字分身,支持语音克隆,绝了!

在AI大模型时代,大家想让模型更个化。最近GitHub爆火的开源项目`WeClone`,用微信聊天记录训练专属AI打造数字分身,还能语音克隆。它全链路覆盖、支持多模型,有隐私保护等特色,操作也有介绍。

开源先锋
算法论文8

CVPR 2025 | SketchVideo让手绘动起来,视频生成进入线稿时代

中国科学院大学等团队提出基于线稿的控视频生成和编辑方法SketchVideo,发表于CVPR 2025。它基于预训练模型添加线稿控制网络,解决现有视频生成模型等问题,实现高质量视频生成与编辑。

机器之心
产品应用8

mem0推出王炸mcp工具OpenMemory,打造用户私有、跨应用的共享记忆层

mem0项目推出OpenMemory MCP,这是专为兼容MCP的AI客户端设计的私有记忆层,能解决跨AI工具的Context共享问题。它强调隐私和本地控制,功能实用,获用户积极反馈。

AI工程化
推荐文章7

中国AI突破「造芯方法论」!Agent军团接管芯片设计全流程

RSI成人工智能前沿方向,芯片设计因有确定验证体系,成其率先落地赛道。NovaSilicon完成融资,探索出芯片设计智能系统,发表论文介绍构建运行方法,将重塑行业。

新智元
新闻资讯7

Stripe为什么买OpenRouter?

Stripe愿花超70亿美元收购OpenRouter,因看清路由权即定价权。OpenRouter掌握AI请求分配权,能转化为议价权。Stripe不满足原有支付模式,收购后有望接管AI请求全链条结算。

newtype AI