生成式推理」共找到 4293 篇相关文章

算法论文8

最新12种GraphRAG技术全面评测

6月两篇论文对12种GraphRAG技术评测。GraphRAG通过构建图结构组织知识,在复杂推理等任务中优于传统RAG。不同GraphRAG技术在图构建、知识检索上表现各异,如RAPTOR图构建慢但令牌消耗少。

PaperAgent
产品应用8

开箱即用、本地安全、多 Agent 协同解决方案!

过去一年,Agent热度高,但企业应用面临算力、安全和部署门槛。5月22日浪潮信息推出元脑智能体工作站Z3,整合大模型本地推理等功能,解决本地多Agent运行问题,降低使用门槛,保障安全。

GitHubStore
算法论文8

2026论文解读,ASAHI:自适应切片助力小目标检测,速度提升25%、精度创新高

高分辨率航空图像小目标检测难,传统检测器表现差。2026年4月都灵理工大学团队提出ASAHI,用自适应切片框架,在VisDrone2019上mAP50达56.8%,推理速度比SAHI提升20 - 25%,还介绍了实战代码等。

机器学习AI算法工程
算法论文8

【梁文锋署名】DeepSeek再发新论文:75%思考+25%记忆,这是他们算出来的最优解

DeepSeek新论文《Conditional Memory via Scalable Lookup》提出Engram模块,指出大模型用计算模拟查字典是浪费算力,Engram能给模型装“记忆”,还发现参数分配呈U型缩放定律,推理和长上下文能力提升显著。

花叔
产品应用8

53.7% 高学历政企人员“看走眼”!公文写作AI智能体首次通过图灵测试

2025数博会期间双盲测试中,53.7%高学历政企人员将‘方寸智脑’生成公文误判为人类作品。它与华为云合作,解决政务AI落地困局,实现政务公文写作三阶跨越,已服务众多用户。

InfoQ
7

代码里插广告,腾讯 Codebuddy 们 “背锅”?DeepSeek “极你太美”事件,其他模型也逃不掉?

网友发现腾讯 Codebuddy 改写代码时插入广告,字节 Trae 国内版生成结果有‘极’字 bug,根源指向 DeepSeek V3.1。除 DeepSeek 外,Gemini、Grok、Qwen3 等模型也有类似问题。大家对原因有多种猜测。

InfoQ
推荐文章9

GPT-6数学封神,遭顶尖数学家公开质疑“算力截胡”?OpenAI内部研究员撕开Astra真相:人脑更容易被污染,而AI只看概率

OpenAI推出GPT-6 Astra,接连在埃尔德什单位距离猜想、纳维-斯托克斯方程等多个顶级数学难题上取得突破性进展,引发顶尖数学家对学术伦理与传统研究模的争议,本文为OpenAI内部研究员的深度对谈编译,拆解AI数学推理的核心逻辑。

AI科技大本营
开源动态7

DeepSeek-R1今天一次「小更新」,颠覆了大模型格局,网友:尽快放R2

昨晚,DeepSeek官方宣布其R1推理模型升级到最新版本(0528),并公开模型及权重。该版本参数量高达6850亿,采用MIT许可证,性能提升明显,在多个基准测试中成绩优异,网友实测代码能力也大幅提升,但仍存在过度思考问题。

机器之心
推荐文章7

特征工程、模型结构、AIGC——大模型在推荐系统中的3大落地方向|文末赠书

文章指出大模型在三个层次改变推荐系统,一是改变“知识学习”方,带来知识输入革命;二是改变“智能体”结构,探索推荐模型新范;三是创造“新世界”,实现个性化内容生成。还介绍了相应落地应用及对从业者的建议。

AI前线
算法论文8

大模型如何"不训练"也能学习?——上下文学习的隐权重更新机制

大型语言模型能通过上下文学习(ICL)在推理时即时学习新任务,无需修改模型参数。本文首次证明自注意力层与MLP层组合能隐将上下文信息转为MLP层低秩权重更新,解释了ICL原理,为构建AI系统开辟新路径。

深度学习自然语言处理