推理市场」共找到 2673 篇相关文章

算法论文7

G2ConS将微软GraphRAG的成本被打下来了~

传统Text - RAG处理多跳推理表现不佳,GraphRAG虽能提升准确率,但成本高。作者提出G2ConS方案,在3个多跳QA基准全面SOTA,平均节省30%费用,EM提升31.44%,整体流程仅3步。

PaperAgent
推荐文章7

破立之间:智驾芯片博弈的“新赛道”

全球汽车产业向智能化转型,智驾芯片成产业链核心。当前产业面临多重困境,国际巨头垄断高端市场,行业陷入“算力堆砌”。SDSoW技术是破局之道,有三大特征,能实现性能、能效等多方面提升。

芯师爷
8

上线一年用户破百万,这个AI健康管理产品只靠一只海獭? | 对话OtterLife

AI健康管理产品众多,多数陷入同质化或功能堆砌困局。OtterLife将虚拟海獭融入健康习惯养成,上线一年用户破百万。量子位智库对话其负责人相城,探讨产品特色、市场、设计等多方面问题。

量子位
开源动态8

1.58bit不输FP16!微软推出全新模型蒸馏框架,作者全是华人

微软推出蒸馏框架BitNet Distillation,实现几乎无性能损失的模型量化。它含三阶段,经实验在多下游任务表现近全精度模型,降内存开销、提推理速度,作者全是微软研究院华人。

量子位
算法论文8

北大彭一杰教授课题组提出RiskPO,用风险度量优化重塑大模型后训练

北大彭一杰教授课题组提出 RiskPO,解决大模型后训练陷入「均值陷阱」问题。它将风险规避理念融入优化目标,用「关注奖励分布左尾」替代「追求整体均值」,在多领域数据集上表现超越 GRPO 等。

机器之心
开源动态8

100美元、8000行代码手搓ChatGPT,Karpathy最新开源项目爆火,一夜近5k star

AI大神Andrej Karpathy发布开源项目nanochat,可教你100美元自建ChatGPT,覆盖LLM训练和推理。项目有8000行代码,不到12小时获超4500 star,功能丰富,但他认为它不适合个性化应用。

机器之心
算法论文7

大模型追逐星辰大海,GPT和Gemini国际天文奥赛夺金

新论文以国际天文学和天体物理学奥林匹克竞赛 (IOAA) 为基准测试,证明 GPT - 5 和 Gemini 2.5 Pro 能在天文奥赛获金牌。研究还分析不同模型表现、与人类成绩对比及错误类型,强调需全面评估模型科研潜力。

机器之心
产品应用7

让YOLO飞起来:从CPU到GPU的配置指南

文章指出默认安装的YOLO用CPU计算,处理大量图像或实时检测任务效率低。详细介绍将YOLO从CPU模式切换到GPU模式的步骤,对比性能,还给出常见问题解决办法,能显著提升运行效率。

机器学习AI算法工程
开源动态8

国产大模型新SOTA:蚂蚁万亿级旗舰模型赶超GPT-5

蚂蚁集团开源万亿参数旗舰大模型Ling-1T,属Ling 2.0家族。它激活比例低降低运算成本,训练有“Ling缩放定律”等方法,多项测试超主流模型,不过处理超长上下文成本较高。

AIGC开放社区
产品应用8

首家AIOS落地来自vivo:个人化智能复刻人类思维,手机还能这样用

2025年vivo开发者大会展示全新端侧AI能力,提出蓝心3B端侧多模态推理大模型,融入OS底层,实现系统级智能。其AI OS打造“个人化智能”体验,还开放生态,携手开发者推动AI应用落地。

机器之心