模型成本」共找到 8482 篇相关文章

算法论文8

ICLR 2026!代码优化不再靠玄学:大模型真正学会“又快又准”,效率提升71.06%,加速比达6.08x

ICLR 2026顶会文章提出全新大模型代码优化方案,切入代码优化核心难题。该方案将代码优化率提至71.06%,加速比达6.08x,正确性提至74.54%,有很强工程可用性。

AINLPer
8

超越英伟达B200!AMD最强AI芯:1.6倍大内存、大模型推理快30%,奥特曼都来站台

AMD发布最强AI芯片MI350X和MI355X,号称大模型推理比英伟达B200快30%,内存是其1.6倍。该系列本月初已批量出货,还发布ROCm 7软件栈。AMD还预告明年推MI400系列,由其与OpenAI联合研发。

量子位
新闻资讯8

Gemini 3预训练负责人警告:模型战已从算法转向工程化!合成数据成代际跃迁核心,谷歌碾压OpenAI、Meta的秘密武器曝光

2025年底大模型“年终决战”,Gemini 3强势突围。其预训练负责人Sebastian Borgeaud指出,谷歌转向“做系统”,AI进入“数据有限”阶段,合成数据等构成未来进化路径,还分享了预训练热点与挑战。

InfoQ
新闻资讯8

更全面的具身智能真机评测来了!CVPR 2026 ManipArena挑战赛邀你打榜

具身智能产业发展迅速,但缺统一、高标准真机评测体系,成发展痛点。中山大学等机构推出 ManipArena 挑战赛,提供科学评测框架,已测部分模型,揭示不同技术路线能力边界,为产业发展提供基础。

机器之心
算法论文8

告别玄学选LLM!弗吉尼亚理工选型框架入选ICML 2025

弗吉尼亚理工大学研究人员推出选型框架LensLLM,可预测微调后性能走势,解释大模型微调“玄学现象”。它基于全新PAC - Bayes泛化界限推导,降低成本近90%,被ICML 2025收录。

量子位
推荐文章7

我的AI订阅

作者分享四个AI订阅,介绍GitHub Copilot Pro+能在OpenCode调用模型,Perplexity Max准确性强、功能多,Grok多Agent编排出色,Gemini生态整合佳,还提及各产品优缺点及订阅费用。

newtype AI
产品应用7

grok 4一图流

文章展示grok 4核心数据,涵盖训练成本模型定价,还列举其在通用、专业、数学、推理、编程等能力测试中排名第一的成绩,不过实际水平还有待观察。

AI寒武纪
新闻资讯7

Anthropic再次挑衅AI输出范式, 谁才是标准?

Anthropic Claude Code团队工程师称HTML应成大模型输出新标准。文章探讨使用场景,如考虑为多看一眼付多少token、内容用途、交流对象等,建议按需选格式,HTML是可视化加班费。

CourseAI
开源动态8

14.5K!冲上Github Trending榜,字节最新开源Agent上下文"数据库"!

OpenViking是字节跳动火山引擎开源的AI Agent上下文数据库。它用文件系统范式管理上下文,有分层加载、递归检索、可视化轨迹和自动会话管理等特性,支持多种模型,测试效果显著。

GitHubStore
新闻资讯7

刚刚,OpenAI宣布关闭Sora

OpenAI宣布关闭Sora,此前其下载量下降、留存率低且成本高。有观点认为这是为聚焦下一代模型,释放资源;还有称是战略转移。迪士尼此前投资10亿合作,现放弃交易。

机器之心