「量产卡点」共找到 1046 篇相关文章
真·罗永浩直播干不过假·罗永浩?网友:不是老罗在演AI吧?
今年618,罗永浩数字人百度电商直播成绩斐然,带货单量超5月罗永浩真人首秀同期。它由百度慧播星打造,实现四大突破。其底层是多模协同数字人技术。数字人技术门槛降低,中小商家用它订单量猛涨。
传统云还在「卖铁」,下一代云已在「炼钢」:火山引擎xLLM如何一张卡榨出两张的性能!
大模型上线部署时推理成本高、算力投入大但效果不成正比,企业面临推理效率难题。火山引擎 xLLM 大语言模型推理框架性能极致,成本低,集成关键创新,还被集成到 AI 云原生推理套件 ServingKit 中。
小米模型实现声音理解新SOTA!数据吞吐效率暴增20倍,推理速度快4倍 | 全量开源
小米全量开源MiDashengLM - 7B模型,它基于Xiaomi Dasheng和Qwen2.5 - Omni - 7B Thinker,实现声音理解新SOTA。性能领先,推理效率高,革新训练范式,全栈开源,将赋能多场景。
GitHub 2.5万星!日本开发者打造的Hono火了:定义后React时代微框架的轻量未来
本周,Web 框架 Hono 在 X 官宣,GitHub 获 25000 星标。它由日本开发者 Yusuke Wada 于 2021 年创建,基于 Web 标准,可在多运行时运行,或指明后 React 时代 Web 框架方向。
本地LLM万字救场指南来了!全网超全AI实测:4卡狂飙70B大模型
文章围绕本地大语言模型(LLM)展开,针对实用性和经济性问题,用Dell Precision 7960塔式工作站对主流模型测试。涉及不同尺寸模型、推理框架等,给出不同配置下性能指标及使用建议,还模拟真实场景测试。
字节Seedream 4.0将全量开放!抢先评测来了,我们摸索出AI生图20种「邪修」玩法
近日,字节跳动内测豆包・图像创作模型 Seedream 4.0,支持多模态生图,核心能力显著提升。它将全量上线并开放给企业客户。实测显示其多模态融合出色,还与谷歌 Nano Banana 对比,各有优势。
阿里云发布为Agent而生的全新AI产品官网“千问云”,模型服务全面Skill、CLI化
5月20日,阿里云在2026阿里云峰会上发布全新AI产品官网“千问云”,提供150多款主流模型API,将模型服务核心能力封装为Skills和CLI工具,方便Agent调用,还提供便捷用量管理和多种付费模式。
不靠海量数据,如何精准喂养大模型?上交Data Whisperer:免训练数据选择法,10%数据逼近全量效果
上海交通大学等团队提出 Data Whisperer,首个免训练的注意力驱动数据选择框架。它利用模型自身能力打分挑数据,无需训练与人工标注,用 10% 数据让微调效果逼近全量数据,在多方面领先传统方法。
刚刚,北大校友Lilian Weng自曝公司首个产品?一篇论文未发,估值却已90亿
OpenAI前安全副总裁Lilian Weng疑似曝光90亿估值新公司Thinking Machines首个产品——手动调参仪表盘,训练中可手动调超参数。OpenAI也有AI硬件野心,设想让ChatGPT成全能硬件助手。
月下载量近亿的AI组件被投毒!Karpathy惊呼软件噩梦,你的所有密钥可能瞬间被偷光
知名AI底层依赖库LiteLLM的PyPI发布版本遭遇供应链攻击,攻击者可卷走机器关键凭证。其月下载量近亿,传染性强。虽带毒版本很快被发现,但凸显供应链攻击风险,让Karpathy改变软件工程观念。