运行成本」共找到 2009 篇相关文章

开源动态8

斩获5.4K star!发现一款轻量快速开源利器,支持插件和主题,非常6!

开源君介绍轻量级文本编辑器`Lite XL`,它用 Lua 编写,基于「lite」优化,安装包仅几 MB,能在多系统流畅运行。其性能出色,还支持插件和主题定制,适合资源有限设备。

开源先锋
开源动态8

Qwen3-ASR的MLX原生实现:让SOTA语音识别跑满苹果芯片

Qwen3 - ASR是强大开源语音识别模型,但官方实现无法充分利用苹果芯片GPU能力。开发者完成MLX重写,让其能在苹果芯片上原生运行,实测性能佳,还有诸多核心功能及安装使用示例。

AI工程化
开源动态8

DeepSeek-OCR是「长文本理解」未来方向吗?中科院新基准给出答案

DeepSeek-OCR的视觉文本压缩技术降低长文本处理成本,中科院自动化所等团队推出VTCBench基准测试评估模型视觉认知,含三大任务及衍生版本,测试结果有‘U型曲线’,还评测多种尖端模型。

新智元
新闻资讯8

祝贺小马智行港交所上市!|5Y News

11月6日,小马智行在港交所主板挂牌上市,成2025年全球自动驾驶最大IPO。此前已在美上市,构建“美股+港股”架构。创始人称站在商业化前夜,其核心业务多元,成本下降,还拓展全球版图。

五源资本 5Y Capital
开源动态7

美团开源Agentic新王,速度拉满,工具调用打爆Kimi?

周末美团开源LongCat - Flash大模型,参数量560B,推理速度达100 token/s,成本低,在Agent工具调用表现超Kimi - K2。它有Zero - Computation Experts和ScMoE创新,不过市场表现未获太多认可。

探索AGI
算法论文7

递归神经网络的复兴:Mixture-of-Recursions

Google DeepMind研究者设计的语言模型,能判断关键单词并进行深度递归计算,通过轻量级“路由器”节省计算资源,在同等训练成本下表现显著优于传统模型,文中还提及其他解决动态算力分配问题的思路。

PaperAgent
算法论文8

腾讯混元TurboS技术报告首次全公开:560B参数混合Mamba架构,自适应长短链融合

腾讯公开混元TurboS技术报告,该模型是超大型Hybrid Transformer - Mamba架构MoE模型,融合Mamba与Transformer架构优势,有自适应长短思维链机制,激活参数56B。在多评测中表现佳,推理成本低。

AI前线
产品应用7

腾讯版Claude Design来了:多人实时同屏审设计稿,一键转代码直通IDE

腾讯公测AI设计智能体平台Ardot,有一句话生成可编辑UI设计稿、Figma文件零成本导入、一键转代码直通IDE、多人在线评审等功能。它能提升前期出稿效率,支持局部精准微调,适配主流IDE。

量子位
新闻资讯7

Clawdbot一夜爆红,首个0员工公司诞生!7×24h永不下班

退休码农造出的AI Clawdbot在硅谷爆红,搜索量超Claude Code。它是AGI雏形下的智能体,能在本地电脑运行,可被多方式操控,效率高。不过,它诞生不久,试用中有不稳定情况和安全隐患。

新智元
算法论文8

DeepMind 颠覆机器人学习范式:让机器像人一样 “自由成长”

谷歌DeepMind受大模型微调中强化学习阶段启发,提出面向机器人学的两阶段后训练方法,含监督微调与自我提升。实验显示该方法让机器人自主习得新技能、广泛泛化,但研究也存在标注成本高等局限。

AI科技评论