「成本性能平衡」共找到 3298 篇相关文章
解道奥赛题成本5000美元?陶哲轩警告,AI下一步要规模化的「更便宜」
谷歌新一代 Gemini 进阶版在 IMO 竞赛达金牌水平,华人数学家陶哲轩对此关注且担忧。他认为评估 AI 表现应谨慎,AI 发展需从定性转向定量,要‘降本增效’,未来标准化评测很重要。
OpenAI最强对手出现!马斯克发布Grok-4,性能碾压Claude 4两倍!
半小时前马斯克发布Grok - 4,虽Grok3.5跳票、直播迟到被吐槽,但它训练量和算力投入大。在多项基准测试中碾压Claude Opus 4,还具备原生工具调用等能力,xAI目标是让其更快更智能。
DeepSeek研究员1200行代码复刻vLLM,H800硬件实测性能反超原版
DeepSeek研究员俞星凯搞出开源项目Nano - vLLM,仅用不到1200行代码实现最小化且完全可读的vLLM。它有快速离线推理、代码可读性强、含优化套件等特点,在H800硬件实测中性能反超原版vLLM。
奖励是假的,能让Qwen提升25%性能却是真的!
华盛顿大学博士生团队用Qwen模型对虚假奖励进行RLVR,使MATH - 500准确率显著提升约25%。研究发现RLVR不考虑奖励正确性,还分析了虚假奖励有效的原因,提示现有研究要在非Qwen模型验证。
刚刚,DeepSeek首曝V3降成本秘诀!软硬协同突破Scaling天花板
DeepSeek最新论文从硬件架构和模型设计双重视角,探讨如何相互配合实现低成本大规模训练和推理,分析硬件特性对架构选择的影响,研究两者相互依赖关系,还为未来协同设计提出建议。
兼顾效率、成本与能力,百灵开源旗舰推理模型 Ring-2.6-1T
5月15日,蚂蚁百灵开源旗舰级推理模型Ring-2.6-1T,权重文件上线Hugging Face、ModelScope平台。该模型有万亿参数,‘按需思考’,在代理执行、推理机制、训练范式三方面升级,评测表现出色。
SVG性能比肩GPT/Claude,腾讯开源3B模型HiVG,让Token「懂几何」
腾讯混元团队开源仅3B参数的HiVG,它是面向SVG生成的层次化分词框架,减少63.8% token数量,多项指标超越GPT-5.2等闭源模型及8B级开源模型,还在人类评测中表现出色。
超760万元奖金悬赏,谁能徒手重构 DeepSeek 与 Kimi 的性能底层?
在大模型工程化需求下,AMD 联手 GPU MODE 发起 2026 线上黑客松:AMD E2E Model Speedrun 全球挑战赛,豪掷 110 万美元。大赛分预选赛和决赛,各设丰厚奖励,目前预选赛已进入倒计时。
月费3万,成本为零:谁在收割企业的GEO焦虑?| 甲子光年
GEO指针对生成式AI进行结果优化,提高品牌被纳入回答的机会。当下GEO市场乱象丛生,多数服务商报价随意、技术原始,靠“黑帽”做法捞金。不过也有行业规范派在建立标准。其背后是流量入口争夺战,未来提示词或成新货架。
效果、性能双突破,快手OneSug端到端生成式框架入选AAAI 2026
查询推荐是电商搜索关键功能,传统方法有局限。快手提出OneSug端到端生成式框架,统一多阶段,提升效果与效率,成果入选AAAI 2026,已在快手电商全量推广,显著提升多项指标。