产品速度」共找到 2174 篇相关文章

开源动态8

蚂蚁dInfer框架,让扩散大语言模型推理速度再飙10倍,相同模型性能下超越自回归模型

蚂蚁开源dInfer框架,联合名校发论文阐述实现细节。它解决扩散模型推理难题,提出创新算法和系统优化策略,实验显示其推理速度远超Fast - dLLM和自回归模型标杆vLLM,代码已开源。

AIGC开放社区
新闻资讯7

GPT-5正以o3的三倍速度打宝可梦,现已抵达冠军之路,直播进行中

GPT - 5直播独立运行宝可梦红版,速度比o3快近三倍,6105步抵达冠军之路,而o3需16882步。原因是其幻觉少、空间推理和规划能力强。直播已进行9小时,超2000人关注,OpenAI总裁点赞。

AGI Hunt
产品应用7

看到这个小红书卖虚拟产品获利百万的案例,我才发现AI翻译的信息差真大

作者建议AI开发者先了解大众需求再做产品。分享小红书上AI翻译变现案例,还展示智谱BigModel开放平台翻译智能体的多模态翻译案例,介绍其解决AI翻译问题的亮点及适用场景。

花叔
新闻资讯8

“今天的顶级智能,一年后就会沦为平庸的廉价品” OpenAI总裁:AGI 的终极交互是“没有界面,没有产品

OpenAI总裁Greg Brockman分享了对AI发展的看法,称2023年推出的插件功能失败,因当时大模型未准备好。他认为未来AGI是隐形虚拟助理,无界面和产品。还指出算力稀缺,智能折旧快,模型改进空间大。

AI科技大本营
推荐文章7

拒绝招聘、产品粗糙,却成史上最快增长软件公司!4个00后“整顿”创业圈:大家都不信,才是我们的机会

Cursor是极速崛起的AI编程工具,操刀手是4个00后。创始人Michael Truell分享经验,从早期失败项目获教训,虽有GitHub Copilot,仍因看好编程未来投身其中,3个月发布产品并不断迭代。

AI前线
8

对话百度文库:不做大模型能直接做的事,能力积累换来竞争壁垒|AI产品Time

百度文库从文档检索平台转型为一站式AI内容获取和创作平台,付费用户超4000万,AI MAU近亿,智能PPT访问量全球第一。访谈中,负责人分享产品理念、优势及运营经验,如不走大模型能直接做的事,从用户需求出发开发功能等。

量子位
开源动态7

推理成本骤降75%!gpt-oss用新数据类型实现4倍推理速度,80GB显卡能跑1200亿参数大模型

OpenAI在gpt - oss开源模型采用MXFP4数据类型,使推理成本降75%,内存占用为BF16模型四分之一,生成token速度提4倍,还能降低硬件资源需求。不过MXFP4也有缺陷,英伟达推出NVFP4提升质量。

量子位
开源动态8

腾讯AngelSlim升级,首个集LLM、VLM及语音多模态为一体的投机采样训练框架,推理速度飙升1.8倍

随着大模型应用成本与延迟问题凸显,腾讯混元升级 AngelSlim 训练框架,将投机采样技术拓展至全模态场景。它以 Eagle3 架构让推理速度最高飙升 1.9 倍,还具全模态训练、面向部署等亮点,有开源代码。

机器之心
产品应用8

GPT-5.2全力出击!碾压44类专业工作,实测编程同价位无对手、深度推理封神,但速度太拉胯了

GPT-5.2登场,有即时版、思考版与专业版。它在多方面大幅升级,能碾压44类专业工作。经济性强,编程能力佳但速度慢,还自评‘最优科研模型’,幻觉现象减少。今日起推送,优先面向付费用户。

InfoQ
产品应用8

GPT-5.2全力出击!碾压44类专业工作,实测编程同价位无对手、深度推理封神,但速度太拉胯了

GPT - 5.2 登场,有 Instant、Thinking、Pro 三个版本,在多方面大幅升级,能覆盖 44 类专业工作。它经济性强、编程能力佳、推理出色,但存在速度慢的问题,其价格 API 端有调整,未来还将推 Codex 优化版。

AI前线