零Token部署」共找到 1623 篇相关文章

开源动态8

论文秒变海报!开源框架PosterAgent一键生成顶会级学术Poster

本文介绍开源框架PosterAgent,它能一键将论文转为可编辑的学术海报。相比GPT - 4o,其生成指标优、token使用量少、成本低。研究团队构建评估标准Paper2Poster,实验显示PosterAgent在多方面表现出色。

量子位
推荐文章7

超越 GoF:现代 AI 系统实用设计模式

文章指出AI系统需要设计模式,如GoF塑造软件设计,云计算引入新模式,机器学习社区也有相关模式。文中介绍现代AI系统的5类实用设计模式,含提示和上下文、负责任的AI、用户体验、AI - Ops和优化模式等,并举例说明。

InfoQ
新闻资讯8

微软 CEO 萨提亚·纳德拉:智能体即产品,SaaS 已死?

微软 CEO 萨提亚·纳德拉在 Build 大会后接受专访,称正经历软件与智能范式巨变,AI 驱动的智能体网络将重塑企业软件未来,SaaS 会融入其中。他还分享了 AI 时代软件与商业模式变革的核心洞察。

AI科技大本营
产品应用8

传统云还在「卖铁」,下一代云已在「炼钢」:火山引擎xLLM如何一张卡榨出两张的性能!

大模型上线部署时推理成本高、算力投入大但效果不成正比,企业面临推理效率难题。火山引擎 xLLM 大语言模型推理框架性能极致,成本低,集成关键创新,还被集成到 AI 云原生推理套件 ServingKit 中。

机器之心
开源动态8

The Batch:820 | Qwen3 向 DeepSeek-R1 发起挑战

阿里巴巴发布八个大型语言模型权重,含两个 MoE 架构和六个稠密模型。预训练数据达 36 万亿 token,支持 119 种语言及方言。测试中 Qwen3 家族表现出色,或终结 DeepSeek - R1 霸主地位,设计用于智能体系统。

DeeplearningAI
开源动态8

Hugging Face开源nanoVLM,750行代码可训练视觉语言模型,简单到令人发指!

Hugging Face开源全新视觉语言模型框架nanoVLM,仅750行代码就能从训练高效能VLM模型。它在单张H100 GPU训练6小时后,在MMStar数据集准确率达35.3%,且能在免费Google Colab跑。

AGI Hunt
算法论文8

从像素空间走向数据流形:生成模型的对抗净化新范式 | TPAMI'26

深度神经网络虽应用广泛,但对对抗样本脆弱,制约可靠部署。本文介绍发表于TPAMI 2026的工作,提出基于一致性模型的对抗净化方法(CMAP),实验表明其在不同场景下鲁棒性强,为对抗防御提供新视角。

量子位
推荐文章8

所有人看见了「大晓速度」,但真正值钱的是它背后的这套系统

过去一年大晓机器人在具身智能行业成果显著,首创研发范式和数据采集方案,推出世界模型并实现端侧部署,其行业方案进入真实场景。它从具身第一性原理出发,让信息低成本入模转化为生产力。

AI科技评论
新闻资讯8

梁文锋、马斯克同时开火!DeepSeek V4 Pro,Grok 4.6 发布

刚刚,DeepSeek悄悄上线DeepSeek V4 Pro正式版,马斯克高调推出Grok 4.6,两者性能直逼顶级闭源甚至有超越。每百万输出Token,Grok 4.6和DeepSeek价格优势明显。两者在多项评测中表现出色,且后续还有大招。

AIGC开放社区
新闻资讯8

50FPS、成本打掉70%,魔芯MoWorld把世界模型带进产业时代

近期,魔芯科技联合浙江大学潘云鹤院士、华为等发布实时交互世界模型MoWorld,推理速度超50FPS,部署成本仅为同规模GPU方案的30%。它全链路优化,将用于多行业,魔芯也完成亿元美金融资。

量子位