模型链」共找到 7815 篇相关文章

算法论文7

微软等提出「模型链」新范式,与Transformer性能相当,扩展性灵活性更好

随着大语言模型发展,扩展 Transformer 架构成趋势,但参数规模增长带来训练负担。微软等研究者提出 CoR 概念,构建模型链学习范式,应用于语言模型得 CoLM 系列,实验显示其性能相当且扩展性、灵活性更好。

机器之心
算法论文8

年度AI论文!全球三大顶尖模型的防蒸馏机制全面告破:小模型“套出”大模型隐藏思维,Kimi-K3重现概率异常

这篇论文指出三大前沿AI模型厂商API有密码学旁路漏洞,攻击者用轻量级模型就能恢复大模型隐藏思维数据。还揭示部分模型训练或借鉴大模型思维,此漏洞也致企业数据隐私安全问题。

AI前线
产品应用8

马斯克挖不动的清华学霸,一年造出 “反内卷 AI”!0.027B 参数硬刚思维模型,推理完爆 o3-mini-high

新加坡 Sapient Intelligence 推出小型模型 HRM,参数仅 2700 万却能解决复杂推理难题,其不依赖“思维”,借鉴人类大脑工作方式。该模型准确率超先进思维模型,推理能力强,具经济性,可提升任务效率。

InfoQ
开源动态8

给GUI Agent装上「世界模型」:阿里通义用混合数据+统一思维,让模型学会预判屏幕变化

伴随多模态大模型发展,GUI Agent成人机交互新范式,但构建高可用、跨平台的GUI Agent面临诸多挑战。阿里通义实验室开源Mobile - Agent - v3.5框架及GUI - Owl - 1.5模型家族,解决了相关技术壁垒。

量子位
算法论文8

模型越反思越错,原来是长推理通过自我说服加重幻觉 | 北邮

北邮研究团队通过思维审计实验,揭示大模型推理‘越想越错’现象背后的元认知偏差。研究基于RFC协议文档构建受控知识域,分析推理过程,发现反思会加重幻觉,且现有检测方法难以应对。

量子位
产品应用8

马斯克挖不动的清华学霸,一年造出 “反内卷 AI”!0.27B参数硬刚思维模型,推理完爆o3-mini-high

新加坡Sapient Intelligence推出小参数AI模型HRM,能解决复杂推理难题。它受大脑启发,提出“隐性推理”路径,准确率碾压先进思维模型,推理能力超越o3 - mini - high,经济性突出,任务效率可百倍提升。

AI前线
推荐文章8

告别“试验田”:当大模型真正嵌入 ERP、供应与核心决策流 | AICon

文章围绕大模型嵌入企业核心系统展开,邀用友罗小江等担纲。介绍鞍钢赵伟升级 RAG 技术、用友罗小江构建决策架构、京东耿东阳用大模型优化供应的案例,为企业数智化转型提供参考。

InfoQ
新闻资讯8

前沿模型被曝年度重大漏洞:加密思维可被轻松提取,GPT,Claude,Gemini 无一幸免

一篇 116 页论文揭示前沿模型思维重大安全漏洞,Anthropic、OpenAI、Google 的 API 因架构问题,模型隐藏推理过程可通过两次 API 调用被大规模提取,还会带来多种安全威胁。

AGI Hunt
算法论文8

田渊栋:连续思维效率更高,可同时编码多个路径,“叠加态”式并行搜索

AI大牛田渊栋团队利用连续空间“叠加态”让大模型并行推理,提升图可达性等任务表现,为连续思维提供理论支持。还设计注意力选择器等机制,实验显示连续思维模型准确率更高。此外,田渊栋还是科幻小说家。

量子位
8

模型思维推理速度倍增!——RoT新框架把思维「画」进隐空间

随着大模型规模扩展,思维(CoT)成处理复杂推理任务标准范式,但显式CoT依赖长序列生成,隐式CoT面临优化挑战。腾讯提出RoT新框架,利用视觉编码器将文本推理步骤转为视觉嵌入,实现Token压缩与推理加速,且过程可分析。

腾讯技术工程
上一页1 / 782下一页