「顶会研究」共找到 3114 篇相关文章
ICML 2025 | 大模型能在信息不完备的情况下问出正确的问题吗?
当前大语言模型推理研究多聚焦被动推理,主动推理研究少,制约其在现实场景应用。为此提出 AR - Bench 基准评估大模型主动推理能力,实验显示大模型主动推理能力严重不足,并指出后续拓展方向。
刚刚,OpenAI前CTO:战胜LLM不确定性的方法找到了!
OpenAI前CTO创立的Thinking Machines Lab发布研究《战胜LLM推理中的不确定性》。研究指出LLM推理不确定性主因是批处理大小变化,而非常见认为的GPU并行性等。还给出实现批处理不变性的方案及实验结果。
LLM-based Reranker效果到底如何?一项关于SoTA模型的全面分析
在信息爆炸时代,重排序是信息检索系统核心。论文对22种重排序方法实证研究,构建无污染数据集FutureQueryEval。结果显示LLM重排序器泛化能力被高估,轻量级模型有优势,为研究和应用提供指南。
你敢把「龙虾」放在手机上跑吗?手机 Agent 离落地还差一道「隐私关」
港中深联合腾讯混元研究揭示,手机 Agent 落地关键不在成功率,而在隐私边界。研究设计隐私交互协议,构建模拟 App 记录过程,将常见越界行为归类检查,评估多个模型发现诸多隐私问题。
ACL Fellows 2025名单公布:西湖大学张岳与UIUC季姮入选
国际计算语言学学会(ACL)公布2025年度会士名单,共11位学者入选,其中有2位华人学者,分别是西湖大学张岳和伊利诺伊大学厄巴纳 - 香槟分校季姮,文中还介绍了各位会士的入选理由和个人简介。
对话斯坦福终身教授徐升:我找到了可穿戴的“宝藏”
本文对话斯坦福终身教授徐升,他研究方向从基础材料转向柔性可穿戴超声。其团队成果包括可穿戴心脏超声成像贴片、连续胎儿血流监测贴片等。他认为可穿戴电子缺‘AlphaGo时刻’,还分享学术与创业经验。
动物间谍:一只披着羊皮的狗……
中国科学院派披着羚羊皮的深圳云深处X30四足机器人混入可可西里藏羚羊群,观察其行为。该机器人装备多类传感器和定位系统,能实时传输数据,还可远程控制,此前也有不少用机器人研究动物的案例。
微软上线Deep Research:OpenAI同款智能体,o3+必应双王炸
今天凌晨微软在官网宣布,Azure AI Foundry中上线Deep Research公开预览版,这是支持API和SDK的OpenAI高级智能体研究能力产品。它通过必应搜索与GPT系列模型深度协同,将研究流程全面自动化。
连肝12小时!一轮狂刷1500篇论文,写4.2万行代码,AI科学家卷疯科研圈
Kosmos是一款全程无需人类插手的AI科学家,最长能连续工作12小时,平均一次研究读1500篇论文、写4.2万行分析代码,79%研究结果可被人类复现,已在多领域有7个真发现。
苹果传统强项再发力,视觉领域三种模态终于统一
苹果在大模型领域常受挫,但计算机视觉研究是其强项。其研究团队提出 ATOKEN,这是首个能在主要视觉模态统一处理的分词器,兼顾重建质量与语义理解,成果朝通用视觉表征迈进一步。