「量化版本」共找到 595 篇相关文章
突发!字节开源 36B 模型Seed-OSS
字节跳动Seed团队开源Seed-OSS系列36B模型,用12T tokens训练,采用Apache-2.0许可证。该模型能灵活控制推理预算,有两个基座版本,Instruct版在多方面表现强劲,性能碾压OpenAI开源模型。
梳理SGLang中DP Attention及其Padding问题
作者梳理SGLang中DP Attention及其Padding问题。介绍DP Attention背景、流程,指出padding分max和sum模式,旧版sum padding浪费计算、影响cuda graph使用,v0.4.10后有优化,max padding仍待完善。
比Vibe Coding强100倍!字节 Trae 2.0 携“上下文工程”登场:一句话,从需求干到上线!
字节跳动的AI编程助手Trae发布2.0版本,新增SOLO模式,支持端到端开发流程。上下文工程热度攀升,能解决AI代码落地问题。Trae迭代快,从基础问答进化为智能体系统。
实测首款3D AI伴侣EVE - 我收到了AI送的第一杯奶茶。
作者拿到EVE内测资格,分享体验。它是游戏化AI陪伴应用,有好感度、记忆等系统,有活人感和主动性,还能用Agent点奶茶。作者认为它是AI娱乐赛道希望,展现AI娱乐、生活体验。
超过GPT-image-1!大黑马Black Forest刚开源新模型,只用文本实现一键PS
今日凌晨,Black Forest开源文生图模型FLUX.1-Kontext开发者版本,功能类似PS,用自然语言就能一键P图。测试显示它超GPT-image-1,成最强开源文生图模型之一,还在架构、训练、工程层面做了优化。
RL救不了泛化性!揭示LLM数学Reasoning的深层瓶颈
大型语言模型在数学竞赛级任务依赖机械化推理,现有评测集有缺陷。UC Berkeley团队提出OMEGA基准量化其数学泛化能力,实验揭示复杂度引发性能崩塌等问题,指出LLM创新组合难,给出改进方向。
Cherry Studio 复盘:从 Chat 到 Agent,一款「套壳」开源产品如何推倒重来?
Cherry Studio最初是为用户在不同大模型间切换的聊天客户端,随行业从Chat转向Agent,它开启2.0版本重构,定位转向「个人Agent平台」,底层架构重写,要解决产品复杂性、完善协作等问题。
13.3K Star!终于有人把文档转 Markdown 这件事做好了!
AI 应用普及,企业常将不同格式文档喂给大模型,但转换工具存在诸多问题。Firecrawl 团队的开源项目 anydoc 支持 14 种格式统一转 Markdown,速度快、输出一致,还有浏览器版本保障隐私,提供多种编程接口。
AMD跑GLM 5.2,成本只要英伟达一半
推理优化公司Wafer公布数据,用AMD的MI355X芯片跑GLM 5.2,单节点吞吐达2626 tok/s,单流吞吐213 tok/s,成本不到英伟达B200的一半。该公司详述部署过程,还提及AMD软件生态的变化及英伟达面临的挑战。
Anthropic承认了!Claude Code木马门被抓包,明天回滚
Anthropic被曝在Claude Code中暗藏隐形代码,从2.1.91版本起,通过隐写术秘密传输信息。Claude Code负责人称是实验,明天回滚。同时,其下一代模型Fable 5或引入实名验证等机制。