性能成本平衡」共找到 3298 篇相关文章

新闻资讯7

AMD发布旗舰AI芯片,称性能比肩英伟达

当地时间6月12日,AMD CEO苏姿丰在大会展示多款AI新品,将新AI芯片与英伟达同类产品对比,称性能比肩且性价比高。还展示了新软件栈、介绍下一代AI机架产品,预计推理成未来AI发展主驱动力。

芯师爷
新闻资讯7

DeepSeek V3.2爆火,Agentic性能暴涨40%解密

文章解密了DeepSeek V3.2 Agentic性能暴涨40%的原因,即采用交错思维链机制。还对比了其与早期ReAct范式,介绍其效果、原理,以及MiniMax为落地该机制做的工作,最后提到多家模型达成技术共识。

新智元
开源动态7

AMD跑GLM 5.2,成本只要英伟达一半

推理优化公司Wafer公布数据,用AMD的MI355X芯片跑GLM 5.2,单节点吞吐达2626 tok/s,单流吞吐213 tok/s,成本不到英伟达B200的一半。该公司详述部署过程,还提及AMD软件生态的变化及英伟达面临的挑战。

量子位
算法论文8

1/15成本,实现AI水印新SOTA | 南洋理工大学&A*STAR

给AI生成作品打水印成行业共识,但传统方法有短板。南洋理工大学等机构研究人员提出局部鲁棒图像水印方法MaskMark,成本仅为Meta模型WAM的1/15,在多任务中表现优异。

量子位
推荐文章8

吴昊:AI 重构 SaaS,成本降百倍需求增千倍

SaaS市场经历‘惊魂六十天’,‘SaaS终结论’甚嚣尘上。但吴昊指出,AI让软件开发成本降100倍、需求增1000倍,会使行业洗牌,旧护城河崩塌,新壁垒出现,企业需转型。

AI科技评论
开源动态7

Uno Platform 6.6 发布:Android 启动性能最高提升 61%

Uno Platform 6.6发布,在五平台引入原生AOT发布、可选Vulkan渲染后端等。聚焦运行时性能,提升多平台启动速度,还简化XAML编写,增强AI辅助、无障碍及多语言支持等。

InfoQ
开源动态8

SGLang支持GPT-OSS:从Day 0支持到性能增强

SGLang宣布重大更新,聚焦openai/gpt - oss - 120b模型深度性能优化与新功能。预填充和解码阶段吞吐量显著提升,支持多GPU,有推测解码等功能,还支持智能体应用程序,且不损害模型推理能力。

GiantPandaLLM
算法论文8

SRO赋能Qwen-2.5-VL推理性能飙升16.8%

文本领域推理模型成就大,但多模态大型语言模型推理能力扩展遇阻,如冷启动初始化不足等。提出SRO三阶段训练框架,经测试,ReVisual - R1平均性能提升16.8%。

CourseAI
算法论文8

LLM算力告急?把文本变图片,推理成本直接减半!

大型语言模型处理长文本时计算成本高,本论文探索‘文本即图像’输入压缩策略,将长文本渲染为图像输入多模态模型,可减少近一半令牌,且任务性能不受显著影响,在多任务中验证了其有效性。

深度学习自然语言处理
产品应用8

Claude Managed Agents 公测发布!Agent 开发成本直降 500 倍

Claude 宣布 Managed Agents 进入公测,可大幅降低 Agent 开发成本。它能自动生成配置和代码,接管多项任务,实现长时间自主运行。多家早期客户使用后效果显著,还介绍了定价、接入方式及与自建的差异。

AGI Hunt