「推理优化技术」共找到 5304 篇相关文章
华为版《黑客帝国》首次亮相:训推复杂AI前先“彩排”,小时级预演万卡集群
华为首次亮相数字化风洞虚拟环境平台,可在训推复杂AI模型前“彩排”,小时级预演万卡集群。其包含Sim2Train、Sim2Infer、Sim2Availability,分别解决训练、推理、高可用问题。
爆冷!字节Seed 在CCPC 决赛只做出一道签到题,而DeepSeek R1 直接挂零?
第十届 CCPC 举行,字节 Seed 携 Seed - Thinking 参赛,结果意外,仅做出一题,DeepSeek R1 挂零。不同模型架构表现差异不大,暴露出大模型做算法题短板,推理模式表现更好。
当 AI 产品卷向同质化,支付成为最后的增长杠杆
AI应用商业化进入新阶段,头部效应显现,竞争同质化严重。支付成为关键变量,其复杂性远超预想,支付失败损耗大。优化支付需系统诊断,它是商业化基础设施,影响营收。全球支付格局复杂,Payinsider助力企业搭建支付架构。
AI让全人类思维越来越雷同!南加大研究实锤:认知多样性正在被抹平
南加州大学论文指出,AI正让全人类想法和表达同质化,体现在语言、视角和推理三方面。原因包括训练数据有偏差、训练目标求稳、人们过度依赖。研究人员虽在想办法,但效果有限,呼吁勿无节制依赖。
1个Token测出模型降级调包!成本砍到千分之一,API供应商的小伎俩全曝光了
法国研究人员开发新检测技术,能识别云端模型隐秘变动。对数概率追踪用于灰盒环境,成本仅传统千分之一;黑盒边界输入追踪用于黑盒环境,成本为先进方案1/30。这些工具让API供应商“调包”行为现形。
语言模型内部还藏着众多策略模型?自底向上强化学习重塑底层特征 | 直播预约
现有强化学习工作将语言模型作整体策略优化,研究提出以策略视角审视内部隐藏状态,分析层级和模块级策略,发现不同模型模式差异,还提出自底向上强化学习策略,为研究架起新桥梁。
苹果重磅官宣谷歌Gemini 将支持 Siri,OpenAI 被边缘化?马斯克比奥特曼还急:这不合理!
苹果和谷歌官宣多年期合作,下一代 Apple Foundation Models 将基于谷歌 Gemini 模型及其云技术构建,为 Siri 等提供支持。此合作引发行业讨论,马斯克质疑其权力集中,也改变 OpenAI 在苹果生态的角色。
不得了,这个新技术把视频压缩到了0.02%!
中国电信人工智能研究院的生成式视频压缩(GVC)技术,将视频数据压缩率干到0.02%,还能保持画面高清连贯和细节。它以‘用计算换宽带’为核心理念,在实测中表现优异,有诸多应用场景。
万万没想到,这家央企竟让香农和图灵又“握了一次手”
中国电信人工智能研究院研发布局的智传网(AI Flow),让信息技术和通信技术融合。在WAIC中,李学龙提出智传网三律,即信容律、同源律和集成律,打破传递智能的‘壁’,为数字世界带来深远影响。
阿里发布信息检索Agent,可自主上网查资料,GAIA基准超越GPT-4o | 模型&数据开源
阿里发布WebDancer信息检索Agent,能自主上网查资料。它具备多步推理等能力,采用四阶段训练范式,模型和方法已开源。在多个基准测试中表现优异,突显处理复杂任务的鲁棒性和有效性。