大模型成本」共找到 9755 篇相关文章

新闻资讯7

刚刚,LMArena最新模型榜单出炉!DeepSeek-R1网页编程能力赶超了Claude Opus 4

LMArena最新模型榜单出炉,DeepSeek - R1(0528)表现亮眼。在文本基准测试中整体排第6、开放模型中排第一,细分领域也成绩优异,在WebDev Arena平台与闭源模型并列第一,超Claude Opus 4。

机器之心
开源动态8

更高智商更快思考!蚂蚁开源最新万亿语言模型,多项复杂推理SOTA

蚂蚁正式发布拥有万亿参数的通用语言模型Ling-1T,超越多个开源和闭源模型,在多项复杂推理基准中取得SOTA表现。它推理和代码能力强,研发采用‘中训练+后训练’,还提出新奖励机制和LPO方法。

量子位
推荐文章7

直播预约 | 如何缓解LLM-as-a-Judge的潜在偏好?UDA:一种无需人工标注的无监督去偏对齐框架

论文针对不同模型对同一组模型回答打分差异等问题,提出无需人工标注、模型无关、即插即用的UDA框架,以无监督方式动态调整Elo评分,实验表明该方法能降低打分标准差、提升与人类评分相关系数。

深度学习自然语言处理
推荐文章8

对话27岁博导张林峰:模型压缩获CVPR满分有点意外,上海交像我这样年轻老师很多

上海交27岁博导张林峰团队在模型压缩领域成果丰硕。其提出的数据集蒸馏方法获CVPR 2025满分,还在多方面探索模型加速,成果已开源。张林峰认为数据蒸馏会成模型压缩趋势,也分享了知识蒸馏阶段看法。

量子位
产品应用8

实测!DeepSeek V4-pro是第一个接近Claude开源模型,前Meta研究员震惊

DAIR.AI创始人、前Meta AI研究员Elvis用DeepSeek - V4 - Pro在Pi框架搭LLM知识库,该模型开箱即用,完成知识密集型多步研究任务表现出色,在开源模型里Agent编程和推理能力强,架构设计让推理快且成本低。

AI寒武纪
新闻资讯8

奥特曼点评中美AI牌桌:美国猛攻前沿,中国凭“两张王牌”错位竞争

OpenAI CEO 萨姆·奥特曼在贝莱德峰会上指出,从 o1 到 o3 模型,复杂推理成本降 1000 倍,2028 年末数据中心 AI 认知能力或超人类。他还拆解中美 AI 竞争,美国前沿领先,中国旧模型推理成本控制和基建推进有优势。

AI科技大本营
算法论文8

VLA动作预测必须经过LLM吗?TurboVLA仅0.2B参数,RTX 4090上跑出32Hz在线动作预测

近年来,VLA模型成通用机器人控制重要路线,但模型、动作更新慢的矛盾凸显。华中科技学联合华为提出TurboVLA,绕开语言模型,形成V+L→A路径,降低成本,保持操作能力。

机器之心
算法论文7

最新研究!模型“角色扮演”无效了?

沃顿商学院研究测试6个主流AI模型,进行超25000次测试,发现告诉AI扮演专家角色,不会让其回答更准确,反向设定‘低知识’角色有时表现更好,角色扮演不是提高准确性的万能钥匙。

AI工程化
算法论文8

像开发软件一样造世界,Agent2World来了,把世界模型做成可运行的符号环境

为让模型真正“能行动”,需可执行、可验证的符号世界模型,但现有自动生成路线有困局。研究团队提出 Agent2World,经实验验证有显著效果,能稳定产出高质量符号世界模型,开辟 AI 理解现实环境新可能。

机器之心
开源动态8

OpenAI去年挖的坑填上了!奖励模型首现Scaling Law,1.8B给70B巨兽上了一课

全新奖励模型「POLAR」采用对比学习范式,摆脱对海量人工标注依赖,有强Scaling潜力。它衡量训练与目标策略「距离」作奖励信号,用自动化合成数据预训练,小模型能超越数十倍规模对手。

新智元