「小模型性能」共找到 8886 篇相关文章

产品应用7

1美元训出专属滤镜,AI把ASCII游戏画质拉满

软件工程师Jeff Schomay用AI将ASCII风格游戏‘雷霆蜥蜴’实时‘翻译’成全动态图形游戏。他借助fal.ai平台解决速度问题,经历多次尝试平衡速度与画质,还训练专属LoRA模型提升画质,但仍面临帧间一致性难题。

AIGC开放社区
新闻资讯8

AI基础架构重大突破,计算成本暴降38倍

Perforated AI团队搞出‘穿孔反向传播’技术,给旧神经元加‘人工树突’。测试中计算成本最高降38倍,模型准确率不降反升,还近乎即插即用。这或引发行业变革,但也面临验证、生态和收费等挑战。

AIGC开放社区
开源动态7

智谱开源GLM-4.5工具调用超越Claude Opus 4.1,成本仅1.4%

开源模型GLM-4.5在伯克利工具使用榜单上超越Claude Opus 4.1,运行相同任务成本仅为1.4%。它采用MoE架构,在多场景表现卓越,推理速度快,成本低,还接入多款主流编程工具。

量子位
推荐文章8

从 0 到 1 做一款 AI 产品:技术怎么搭、成本如何控制、销售策略怎么定?

独立开发者 Arvid Kahl 分享从零构建 AI 播客产品 Podscan 及「节俭工程」经验,涵盖技术搭建、成本控制与销售策略调整。如用小众云服务降成本,从 PLG 转向 SLG 等,为小团队创业者提供实用借鉴。

Founder Park
推荐文章7

AI 产品定价指南:按量定价的卡点到底是什么?

本文编译 a16z 与 Scott Woody 访谈,探讨 AI 改变软件定价逻辑及企业应对策略,还补充定价专家 Madhavan Ramanujam 关于 AI 产品定价四象限观点,指出按量定价的难点、适用模式及企业转型要点等。

Founder Park
产品应用7

用Claude Code搭建工作流

作者原本考虑用n8n搭建工作流,现认为Claude Code的Sub - agents和自定义命令功能搭配MCP工具可满足需求。通过示例演示其工作流搭建,还测试换Kimi K2模型,显示其质量更好。

newtype AI
产品应用7

LLM加速利器LMCache,极大降低GPU资源消耗

LMCache是大语言模型服务引擎扩展组件,能降低首次响应延迟、提升吞吐量,适用于长上下文场景。它将KV缓存存于多级存储,跨服务实例复用任意重复文本的KV缓存,节省GPU算力,与vLLM结合优化显著。

GitHubStore
新闻资讯7

The Batch: 858 | 白宫重塑美国人工智能政策

特朗普提出积极的国家人工智能政策原则并推动实施,《赢得竞赛:美国人工智能行动计划》明确三大短期目标,包括激发创新、建设基础设施、确立全球领导地位,与拜登政府政策有差异。

DeeplearningAI
算法论文8

全球首个人形机器人通用视觉感知系统,Humanoid Occupancy建立多模态环境理解新范式

北京人形机器人创新中心推出 Humanoid Occupancy 感知系统,创新性融合多模态传感器信息,构建通用感知框架。它以语义占用表征为核心,有全编码和适配融合优势,经实验验证性能优,推动机器人迈向通用感知时代。

机器之心
产品应用8

让你抄袭都跟不上节奏

最近 Dia 连更两小版本,推出 Skills Gallery 和 Research 功能,即扩展技能库和深度研究能力。它更新似微信,节奏快创意足,让对手难抄袭。目前免费,仅 M 芯片苹果电脑可用,文末有邀码获取方式。

MacTalk