高被引论文」共找到 3540 篇相关文章

产品应用7

一档推理强度,成本可能翻几倍:大模型思考原理讲清楚

文章详细讲解推理强度原理,指出其不改模型,只改草稿长度。还说明模型多思考能提答题准确率的原因,剖析贵和慢的原因,介绍三种控制形态,并给出判断推理强度档位的框架。

AI Reading Hub
新闻资讯7

ICLR 2026清华霸榜,中国校包揽全球前五,美国质量底盘稳固

2026年ICLR已开幕,是人工智能学术风向标。中国机构论文数量优势明显,包揽全球前五,清华全量和Oral榜登顶;美国机构在质量Oral论文上底盘稳固;中国校是产出主力,企业力量也在崛起。

AIGC开放社区
新闻资讯8

我嘞个豆!中国企业牵头,ICLR这场Workshop挤爆了

ICLR 2026在巴西线下举办,华人活跃其中。一场由阿里妈妈牵头的Workshop围得水泄不通,聚焦机制设计与决策智能,这是ICLR历史上首个该方向Workshop,集结了顶尖校,探讨AI重写下的相关问题。

量子位
新闻资讯7

对话地平线前管牛建伟:万亿参数大模型如何重塑具身智能

具身智能赛道分“VLA派”“智驾降维派”和“大模型派”。地平线前管牛建伟认为VLA是弯路,主张用分层架构,以万亿参数“空间智能大模型”做大脑,VA小模型执行操作,目标是做物理世界的OpenClaw。

AI科技评论
新闻资讯7

龙虾社交上线40天Facebook收购!俩文科创始人加入超级智能实验室

刚上线40天的AI Agent社交网站MoltbookMeta收购,两位文科创始人将加入Meta超级智能实验室。Moltbook因人类冒充AI的假帖子爆火,但安全漏洞明显。Meta看中其让AI智能体在线连接的能力,或优先修复安全问题。

量子位
新闻资讯7

小米小爱同学:资源受限下,实现端侧大模型的性能推理

InfoQ对话小米小爱同学端侧AI负责人杨永杰,了解其团队在资源受限的端侧设备实现大模型性能推理的策略。目前端侧大模型商业化落地慢,团队提前布局,自研框架,实现超180 tokens/s推理速度,还分享未来突破方向。

InfoQ
产品应用7

GPT-5超越人类医生!推理能力比专家出24%,理解力强29%

最新研究显示,GPT - 5在医疗领域处理多模态信息能力出色,在多模态测试中推理和理解得分比GPT - 4o分别提近30%和36%,比人类医生还。其能力提升源于端到端多模态架构,但现实应用还需更多实战考验。

量子位
算法论文8

英伟达护城河AI攻破,字节清华CUDA Agent,让人人能搓CUDA内核

近日,字节跳动Seed团队和清华AIR的CUDA Agent引发轰动。它能编写经优化的CUDA内核,性能超torch.compile等。研究发布CUDA - Agent - Ops - 6K数据集,介绍系统管线设计、训练流程,实验结果佳,但有未对比复杂编译器等局限。

机器之心
算法论文8

模型声称会“脑补”,结果论文打脸了?潜在空间想象竟是“摆设”!

多模态大模型中“潜在视觉推理”概念很火,研究者让模型在潜在空间“想象”。但清华和北交学者论文指出,潜在 Token 不关心输入、不影响输出、没信息量。作者提出 CapImagine 方案,效果远超潜在空间方法。

深度学习自然语言处理
新闻资讯7

前OpenAI CTO企业遭重创!办公室偷情致团队崩盘,核心3人叛逃OpenAI

2026年1月,前OpenAI CTO Mira Murati创办的Thinking Machines Lab遭遇重创。联合创始人Barret Zoph因办公室恋情降职后逼宫索权,遭拒开除,随后与两名骨干叛逃OpenAI。这揭示了AI人才战争的残酷。

新智元