算力成本」共找到 2163 篇相关文章

开源动态8

让图像生成告别 AI 味!清华 + 港中大 + 腾讯混元联手推出SRPO

腾讯混元联合港中大、清华推出SRPO,解决文生图技术痛点。它结合Direct - Align和SRPO,提升图像审美等,训练时间缩至十分钟,在测试中碾压主流方法,不过对冷门风格控制和机制可解释性待提升。

AIGC开放社区
产品应用7

AI低质代码泛滥、API经济盛行,老牌科技厂商 F5 如何应对大模型应用“后遗症”?

F5亚太区CTO Mohan Veloo指出AI编程工具带来安全、低质代码、‘黑盒子’等问题。F5调查显示企业业务AI驱动下,安全成挑战。F5推出ADSP平台应对,还发布AI Gateway、AI助手等产品。

AI前线
推荐文章7

AI 原生应用全栈可观测实践:以 DeepSeek 对话机器人为例

本文以 DeepSeek 对话机器人为例,介绍 AI 原生应用架构可观测需求、挑战与方案实践。分析 AI 领域痛点,提出阿里云 AI 全栈可观测架构,剖析大模型应用可观测技术,分享实战案例,还给出未来规划。

InfoQ
算法论文7

EMNLP 2025 浙大&蚂蚁 | 提出动态压缩CoT推理新方法:LightThinker

随着AI发展,大语言模型处理复杂推理任务能力提升,但推理时产生大量中间步骤和文本,拖慢计算速度、增加资源压力。浙大、蚂蚁等机构研究者提出LightThinker,可动态压缩推理步骤,降低内存占用和计算成本

AINLPer
7

又一个Genie 3来了!刚上线挤爆服务器,Mirage 2把世界模型玩成在线游戏

全球首款AI原生UGC游戏引擎Mirage迎来2.0版本。它能将图像转为可互动3D世界,还能用文本重塑。和Genie 3相比控制类别更丰富,虽有进展但仍有动作控制、视觉稳定等问题待解决。

新智元
新闻资讯7

GPT-5波折超乎想象!奥特曼连夜回应一切:4o重新上阵,团队紧急补救

GPT-5发布后引争议,网友看法不一。奥特曼回应将全面更新,如翻倍ChatGPT Plus用户使用限额等。OpenAI团队在AMA问答中也解答诸多问题,包括让4o回归、研究多模型并用等。

新智元
开源动态8

万亿参数狂欢!一文刷爆2025年七大顶流大模型架构

文章深入剖析2025年顶级开源模型的创新技术,介绍了DeepSeek V3/R1、Kimi 2、Qwen3等七大顶流大模型架构,揭示滑动窗口注意力、MoE和NoPE如何重塑效率与性能。

新智元
新闻资讯7

「硅谷大乱」小扎挖人细节来了:4年总包3亿美金,第一年可直接获得1亿美金,被OpenAI多人拒绝

为组建Meta超级智能团队,挽回Llama4失败局面,扎克伯格简单粗暴挖人,开出四年总包超3亿美元、首年到手1亿的薪酬,还提供领先算力。至少10名OpenAI员工拒绝,这撕裂了硅谷“使命驱动”文化。

AI寒武纪
推荐文章7

为何我的 Docker 镜像如此庞大?使用“dive”进行深度剖析以找出臃肿之处

在AI项目里,Docker镜像可能臃肿庞大,影响开发与部署。本文以朴素BERT分类器镜像为例,指出未优化镜像会导致开发慢、CI/CD低效等问题,还介绍用dive工具剖析镜像,找出臃肿之处以优化。

InfoQ
推荐文章7

AI Infra 工程师们如何应对大模型流水线里的“暗涌”?

InfoQ《极客有约》X AICon 直播,邀请华为昇腾专家 ZOMI 酱、蚂蚁集团马介悦和 SGLang 尹良升探讨大模型 Infra 工程师实战日常。涉及大模型工程高频问题、版本迭代策略、推理部署优化、开源项目挑战等内容。

InfoQ