华人研究者」共找到 413 篇相关文章

算法论文8

大模型「越用越快」!SpeedupLLM首次验证,大降56%推理预算

Emory大学研究者提出SpeedupLLM框架,利用动态计算资源分配和记忆机制,使LLM处理相似任务时推理成本降56%、准确率提升,论文系统性验证了LLM“越用越快”,为AI模型发展提供新思路。

新智元
新闻资讯7

寻人启事!CVPR 2026 杰出审稿人名单出炉,快来评论区「认领」你的神仙导师和同门!

随着CVPR 2026开幕临近,官方公布杰出审稿人名单。今年17491名学者参与审稿,仅前5%入选。名单中华人学者众多,官方未附机构信息,媒体邀大家评论区互动补齐信息。

AI科技评论
产品应用8

Hugging Face 论文页面功能指南

为助开发者与研究者把握AI前沿动态,Hugging Face推出论文页面,Daily Papers已收录超1万篇高质量论文。本文介绍其认领、提交论文等“隐藏功能”,助你把页面用到极致。

Hugging Face
新闻资讯8

奥特曼亲自点名:他定义了OpenAI的技术路线,却几乎没人知道他是谁

2026年7月28日,Altman在播客推Alec Radford至台前,称其为领域重要却鲜为人知的研究者。他主导GPT、CLIP、Whisper等研发,为AI发展贡献大。2024年他离开OpenAI,此后发布Talkie,持续探索模型能力来源。

DeepTech深科技
算法论文7

告别Reasoning模型的“灵光一现”,推理能力可控了

当前GPT - 4o、DeepSeek - R1等大模型推理的‘高级操作’随机触发,不可控。研究者受经典推理三要素启发,教会模型三种‘元能力’,经三阶段训练,模型效果提升,让推理能力可控。

深度学习自然语言处理
开源动态8

AI智能体也有「蜘蛛感应」,防御延时骤降至8.3%

传统Agent防御机制易致延时积累,研究者联合推出Spider - Sense智能体防御框架,利用两大核心技术将防御延时从200% + 降至8.3%,在主流数据集和新基准测试中表现优异。

新智元
算法论文8

长思维链里的推理步骤,哪些最关键?三招锁定LLM的「命门句子」

杜克大学和 Alphabet 研究者提出在句子层面分析推理痕迹,找出长思维链中关键步骤,提高 LLM 可解释性等。提出三种互补方法,还提供开源工具,研究为调试推理失败等提供可能。

机器之心
算法论文8

UofT、UBC、MIT和复旦等联合发布:扩散模型驱动的异常检测与生成全面综述

多伦多大学、麻省理工学院等高校研究者合作完成长文综述,聚焦扩散模型在异常检测与生成领域的应用,梳理图像、视频等异常检测任务进展,提供分类体系,展望未来趋势。

机器之心
算法论文8

DeepResearch的概念、核心挑战与进化路径

华为、利物浦大学等研究者撰写综述文章《DEEP RESEARCH AGENTS》,梳理了DeepResearch进展。它由大语言模型驱动,超越RAG等现有技术,介绍其核心技术组件,指出面临的挑战并指明未来发展方向。

AI工程化
新闻资讯7

不怕被挖!谷歌晒IMO金牌团队大合照,还挨个圈出了联系方式

谷歌获IMO金牌后部分成员被小扎挖走,但其IMO金牌团队晒全家福回应。团队负责人透露赛前准备细节,还介绍核心成员情况,包括4位华人成员。

量子位