分层推理」共找到 2195 篇相关文章

8

国产GPU组了个开源局,把SGLang等核心开发者都摇来了!

国产GPU玩家摩尔线程举办SGLang × MUSA Meetup,邀请众多开源圈开发者。活动探讨如何让国产GPU进入大模型推理主流开源工程链路,显示国产GPU竞争迈向生态坐标之争。

量子位
开源动态8

一张4090就能爆改!面壁智能MiniCPM-V 4.6开源,1B多模态卷出新高度

今年是AI应用大规模落地年,参数小的端侧模型有特定场景性能优势。5月11日面壁智能开源MiniCPM-V 4.6,参数仅约1B,多模态能力超阿里、谷歌同类模型,还在多维度提升,站稳端侧多模态开源领域。

机器之心
算法论文8

图像编辑模型不止生成:BIGAI&上交大提出EAR范式,系统测试其视觉规划能力

上海交通大学联合北京通用人工智能研究院提出EAR范式,构建AMAZE基准,分析图像编辑模型视觉推理能力。研究发现模型零样本表现弱,扩散式模型更适合视觉规划,CoT效果不稳定等。

AI科技评论
新闻资讯7

GitHub Star明码标价5毛/颗,AI项目刷假星最猛

卡内基梅隆大学研究发现,GitHub约600万颗假星,18617个仓库涉假,AI/LLM项目是重灾区。造假产业化,有分层定价、售后保障。买星为融资,形成恶性闭环,判断项目好坏还得看硬指标。

量子位
新闻资讯7

谷歌TPU能撼动英伟达吗?前TPU工程师首次揭秘

在AI算力争霸时代,英伟达GPU市值狂飙,但蛋糕正被分食。前谷歌TPU工程师Henry揭秘TPU,从架构、产能、软件等维度分析其优缺点,指出在特定条件下TPU可挑战GPU,未来芯片市场将百花齐放。

芯师爷
开源动态8

鹏城实验室 X 中大hcp实验室推出 RADAR : 具身智能评测的新标杆

RADAR是鹏城实验室与中大hcp实验室为具身智能领域设计的评测基准,解决现有评测体系三大缺陷,通过创新设计揭示模型不足,为研究者提供方向,推动具身智能实用化。

AI科技评论
算法论文8

超越MLA!新架构MLRA百万token,解码最高2.8倍速 | ICLR'26

大语言模型处理长文本时,自回归生成受限于显存带宽。为减少KV缓存开销,业界尝试多种方法,但MLA有缺陷。宾夕法尼亚州立大学等研究人员提出MLRA,拆分KV缓存为四个并行分支,降低显存占用,实现4路张量并行,性能更优。

新智元
新闻资讯8

统计学最高荣誉回归华人!苏炜杰:AI需要一门新的数学语言

2026年,宾夕法尼亚大学苏炜杰教授获统计学界“诺贝尔奖”考普斯会长奖。他认为AI时代统计学会更重要,还提出AI需新数学语言,访谈中分享诸多对AI的思考与见解。

量子位
产品应用8

GPT-5.4 发布,OpenClaw的能力要被取代?OpenAI 新模型不仅会自己用电脑,编程能力也拉满了

今天 GPT-5.4 发布,整合推理、编程及原生计算机使用能力。其原生电脑操作能力提升,与 OpenClaw 竞争。还带来工具搜索降成本、减少幻觉,编程能力增强但价格也升级。

AI前线
新闻资讯8

IC产量增长10.9%、换道超车……今年“两会”的“芯”消息令人振奋

2026年全国“两会”进行中,“政府工作报告”显示2025年科技创新成果丰硕,如集成电路产量增长10.9%。代表委员对半导体等建言聚焦质的飞跃,还给出芯片产业化、算力布局等“解题思路”。

芯师爷