端侧推理」共找到 2145 篇相关文章

新闻资讯8

刚刚,DeepSeek论文登上Nature,更多细节披露!

9月17日,梁文锋担任通讯作者的DeepSeek - R1推理模型研究论文登《Nature》封面,它是全球首个经同行评审的主流LLM。不靠人工标注,靠强化学习激发推理能力,学会‘自我反思’,在多任务上优于传统模型。

PaperAgent
产品应用7

GPT-5超越人类医生!推理能力比专家高出24%,理解力强29%

最新研究显示,GPT - 5在医疗领域处理多模态信息能力出色,在多模态测试中推理和理解得分比GPT - 4o分别提高近30%和36%,比人类医生还高。其能力提升源于端到端多模态架构,但现实应用还需更多实战考验。

量子位
算法论文8

思维锚点:破解LLM Reasoning黑箱的关键句

文章提出思维锚点概念,指推理轨迹中影响后续步骤和答案的关键句。开发三种归因方法,系统论证高级组织句影响力更大,锚点主导错误修正。研究为理解LLM推理机制开辟新途径,开源工具支持可视化分析。

深度学习自然语言处理
算法论文8

突破Agent长程推理效率瓶颈!MIT&新加坡国立联合推出强化学习新训练方法

AI Agent处理复杂任务时显存、算力问题凸显,MIT和新加坡国立大学联合提出MEM1框架。它基于强化学习,让智能体学会管理记忆,实现近似常量级显存开销,在多方面表现超越大模型。

量子位
开源动态8

刷新复杂Agent推理记录!阿里通义开源网络智能体超越DeepSeek R1,Grok-3

互联网信息检索中,复杂问题让普通开源模型力不从心。阿里通义实验室提出WebSailor方案,通过SailorFog - QA数据集和DUPO算法等创新,提升模型能力,在多基准测试中超越诸多开闭源模型。

量子位
算法论文8

Gemini准确率从21%飙到97%!谷歌只用了这一招:复制粘贴

Google Research研究发现,将输入问题复制粘贴一遍,能让大模型在非推理任务上准确率惊人提升,如Gemini 2.0 Flash - Lite从21.33%升至97.33%,且几乎不影响生成速度,但不适用于推理场景。

新智元
开源动态8

社区供稿丨AgentCPM-Explore开源,4B 参数突破端侧智能体模型性能壁垒

清华大学、中国人民大学等联合研发的 AgentCPM-Explore 智能体模型开源,它基于 4B 参数,在深度探索类任务表现佳。有打破参数壁垒等亮点,还开源配套工具,提供应对小模型挑战方法,邀伙伴共建生态。

Hugging Face
新闻资讯7

林俊旸离职后首次发声!复盘千问的弯路,指出AI的新路

林俊旸离职阿里千问后发声,反思千问技术路线,认为千问合并两种模式未做好。他指出推理时代已过,未来是智能体时代,智能体思考将成主流,还阐述了其与推理思考区别及面临的挑战。

量子位
算法论文8

推理时间减少70%!前馈3DGS「压缩神器」来了,浙大Monash联合出品

在AR、VR等领域,3DGS是新视角合成(NVS)领域备受关注的技术方案。现有前馈3DGS模型存在编码器容量有限等问题,ZIP Lab和Monash团队引入信息瓶颈原理,推出轻量级模块ZPressor,有效解决信息过载难题。

量子位
新闻资讯7

AI时代终端大变局

随着算法、芯片、场景深度融合,端侧AI计算成终端智能化核心引擎,重塑IoT终端应用场景智能体验。端侧AI芯片作为技术底座,正重塑终端产业格局,虽面临挑战,但未来前景广阔。

芯师爷