大语言模型」共找到 9286 篇相关文章

新闻资讯7

PDF文件长出「AI脑」?网友惊呼:这操作太「黑科技」了!

极客Aiden Bai将大语言模型塞进PDF,可让AI讲故事、聊天,Linux系统也能在其中运行。项目嵌入小型语言模型,如TinyStories、Pythia和TinyLLM,利用PDF支持的JavaScript实现,虽有局限但潜力

新智元
算法论文8

模型越反思越错,原来是长链推理通过自我说服加重幻觉 | 北邮

北邮研究团队通过思维链审计实验,揭示模型长链推理‘越想越错’现象背后的元认知偏差。研究基于RFC协议文档构建受控知识域,分析推理过程,发现反思会加重幻觉,且现有检测方法难以应对。

量子位
算法论文8

模型智能体不止能写代码,还能被训练成白帽黑客

Amazon AWS AI的Q Developer团队发布两项训练网络安全模型的新方法Cyber - Zero和CTF - Dojo。前者不依赖真实环境生成训练数据,后者构建实战环境让模型学发现漏洞,二者结合为AI白帽黑客成长提供路径。

机器之心
算法论文8

VLA模型做长任务总断片?同济KC-VLA用关键帧链给治好了

VLA模型记性是短板,处理非马尔可夫任务常束手无策。同济学等提出KC - VLA框架,用关键帧链接赋予机器人全局时间感知能力,还构建了长时序记忆依赖基准测试,实验显示其性能优越。

PaperAgent
算法论文8

模型如何"不训练"也能学习?——上下文学习的隐式权重更新机制

语言模型能通过上下文学习(ICL)在推理时即时学习新任务,无需修改模型参数。本文首次证明自注意力层与MLP层组合能隐式将上下文信息转为MLP层低秩权重更新,解释了ICL原理,为构建AI系统开辟新路径。

深度学习自然语言处理
开源动态8

如何选择最佳多模态模型压缩方案?哈工、度小满开源EFFIVLM-BENCH基准测试框架

金融科技智能化转型中,LVLM部署受算力瓶颈制约。哈工与度小满联合开源EFFIVLM - BENCH基准测试框架,能为多模态模型压缩方案出具‘体检报告’,还揭示LVLM加速复杂性,推动技术发展。

机器之心
新闻资讯7

GPT-5.2考赢人类!OpenAI警告:模型能力已过剩,AGI天花板不是AI

GPT - 5.2在ARC - AGI - 2基准测试超人类,Poetiq系统让其准确率从60%提至75%。OpenAI称模型进入‘能力过剩’阶段,未来AGI进展不止靠模型,更需人机协同。

新智元
算法论文8

真·开外挂!MIT新研究:架构0改动,让模型解锁千万级上下文

MIT CSAIL团队提出递归语言模型RLM,不改动模型架构,让GPT - 5、Qwen - 3等模型具备千万级token超长文本处理能力。它将上下文处理“外包”,实验显示其处理规模超前沿模型,复杂任务优势显著,多数场景性价比高。

量子位
新闻资讯8

首家央企AI独角兽浮出水面!背靠自研模型,4家国家队资本背书

中电信人工智能科技(北京)有限公司成为央企首家AI独角兽,完成首轮增资,引入四家国家级战略投资方。其靠自研“星辰”系列模型,在多领域突破,实现技术与市场认可闭环,有望推动AI产业落地。

量子位
推荐文章8

深度解析模型技术演进脉络:RAG、Agent与多模态的实战经验与未来图景

模型作为产业变革核心引擎,RAG、Agent与多模态技术重塑AI与现实交互边界。本文解析技术演进脉络、实战经验与未来图景,介绍三者在各领域应用及面临挑战,为产业升级提供指引。

腾讯技术工程