最佳论文奖」共找到 1192 篇相关文章

算法论文7

POF | 西北工业大学马榕池、高传强等:基于预解分析的圆柱绕流最优射流控制位置对雷诺数依赖性研究

本文提出预解分析有效增益指导控制位置量化设计方法,发现不同雷诺数下最优控制位置关系式,挖掘出射流与主流掺混作用的流动机理,即射流在科恩达效应有效行程内到分离点可最佳抑制涡脱。

力学与人工智能
算法论文8

大模型是否对问题难度有预判?最新研究揭示 LLM 内部的“难度感知机制”

近期论文《Probing the Difficulty Perception Mechanism of Large Language Models》系统性解答大模型能否感知问题难度等问题。研究基于数据集在主流 LLM 上训练轻量线性探针,定位负责难度感知的注意力头,还发现不同模型表现有差异。

深度学习自然语言处理
算法论文7

八年后,Meta教会了Transformer「显式思考」

10月20日Meta上线新论文《The Free Transformer》,作者François重写Transformer思维方式,造出Free Transformer新架构。它在解码器内加入随机潜在变量,让模型生成内容前先‘思考’,实验显示在多任务上性能显著提升。

机器之心
算法论文8

信息熵之后,清华提出状态熵!量化分析「系统智能性」的全新视角

清华大学科研团队从自治系统的演化动力学出发,提出状态熵概念,分析其与系统聚合度关系,为系统智能性度量提供新视角。论文给出状态熵统一定义及演化解析表达式,还在典型系统上分析其演化规律。

新智元
产品应用7

为 OpenAI 秘密提供模型测试, OpenRouter 给 LLMs 做了套“网关系统”

OpenRouter成立于2023年初,为用户提供统一API Key调用各类模型,OpenAI会用其秘密测试。平台token用量高速增长,还发布模型用量排行榜引关注。创始人认为大模型非赢家通吃,未来想成agent最佳推理层。

海外独角兽
开源动态8

马斯克开源新模型:能实时抓取社交平台数据,20万块H100训练

马斯克旗下xAI开源去年最佳模型Grok - 2.5,6个月内还将开源旗舰模型Grok 3。Grok - 2.5可实时抓取社交平台X数据,用超20万块H100训练,性能超GPT - 4o等,应用场景广泛。

AIGC开放社区
新闻资讯7

上线8个月、ARR破亿美元,45人团队每天支持用户构建 10 万个项目!CEO分享用人秘籍:高薪员工不一定是万金油

Lovable上线8个月ARR破亿美元,预计年底达2.5亿,未来12个月达10亿。CEO Anton Osika认为关键是打造最佳团队、品牌,行动要快。还分享用人、应对竞争等看法,如高薪员工非万能,更怕OpenAI。

InfoQ
开源动态8

超越O4-mini,多模态大模型终于学会回头「看」:中科院自动化所提出GThinker模型

现有多模态大模型在通用场景推理有瓶颈,缺乏对视觉线索校验与再思考能力。中科院自动化所提出GThinker模型,有创新的「线索引导式反思」模式,经两阶段训练,性能超O4 - mini,论文等已开源。

机器之心
新闻资讯8

马斯克发布 Grok 4 模型:推理能力较前代提升 10 倍,各学科测试接近满分

xAI 发布 Grok 4 及 Grok 4 Heavy 模型,推理能力较前代提升 10 倍,多测试接近满分。马斯克称其为世界最好 AI。它在多方面表现出色,如长任务能力强、推理效率佳等,但代码能力欠佳,且付费昂贵。后续还将推多款模型。

Founder Park
算法论文8

Cache Me If You Can:陈丹琦团队如何「抓住」关键缓存,解放LLM内存?

普林斯顿大学陈丹琦团队新论文聚焦长上下文语言模型 KV 缓存问题。传统 KV 缓存大小随输入文本长度线性增长,此前方法难公平比较。团队提出「KV 足迹」指标,改进方法并推出 PruLong 优化内存,节省空间且保性能。

机器之心