「免训练加速」共找到 2732 篇相关文章
Meta联合Google新作:语言模型到底“记”了多少东西?
Meta和Google合作的论文探讨现代语言模型对训练数据的“记忆”情况。研究发明新方法精确测量“记忆”量,发现模型记忆有上限且与参数线性相关,还揭示学习转折、隐私规律等重要结论。
南开 && UIUC | SearchAgent-X,打破「效率瓶颈」,让复杂「AI搜索智能体」走向现实
南开大学和伊利诺伊大学厄巴纳 - 香槟分校的研究提出SearchAgent - X框架,解决大型语言模型驱动的搜索智能体效率痛点。它剖析制约效率的原因,通过两大‘加速引擎’优化性能,实验显示效果显著。
阿里开源自主搜索AI Agent,搜论文、网站资讯无所不能
今天凌晨,阿里开源创新自主搜索AI Agent——WebAgent,具备端到端自主信息检索与多步推理能力。还介绍了WebDancer框架从数据构建到训练优化各阶段,助其完成复杂信息检索任务。
爆火论文颠覆RL认知!「错误奖励」让LLM推理暴涨24.6%,学界惊了
最新爆火论文颠覆传统RL训练认知,华盛顿大学等团队证实「伪奖励」可让LLM推理性能提升。研究设置多种伪奖励形式实验,发现其对Qwen模型有效,但并非对所有模型都有效。
大模型微调知识与实践分享
文章详细介绍大型语言模型(LLM)微调知识与实践,包括模型结构、参数量等知识,以及Prompt工程、数据构造、LoRA微调等技术点。还给出微调实践流程,介绍相关平台和框架,如星云、TuningFactory等。
字节跳动2步突破,复杂文档布局解析,为啥如此惊艳?
文章指出现有文档图像解析方案有局限,介绍字节跳动的Dolphin解决方案。它采用分析 - 解析范式分两阶段解析文档,避免传统方法弊端,运行效率高,还给出训练方案、实战代码和试用链接。
以加代乘?华为数学家出手,昇腾算子的高能设计与优化,性能提升30%!
大模型落地面临推理难题,华为团队基于昇腾算力发布三项硬件亲和算子技术研究,包括以加代乘的AMLA算子、融合算子技术、SMTurbo加速技术,实现能效、协同和速度突破,未来将拓展应用场景。
万字实录:VLA 范式,具身智能的曙光与迷雾丨GAIR Live
2025年5月9日,雷峰网等举办“具身智能之VLA的实践与突破”线上圆桌沙龙。多位专家探讨VLA定义、起源、技术路线等,指出其面临推理、数据等瓶颈,还讨论了与强化学习结合、数据选择、提升泛化性、长程任务及落地场景等问题。
RAG系统设计:揭秘语义搜索被低估的核心价值与KG驱动的架构选型策略
在AICon大会上,Hugging Face的尹一峰探讨基于语义搜索的RAG系统重要性,揭示其被低估原因,分析本质与作用,分享设计高效架构方法,还讨论KG驱动的RAG系统及范式选择。
AI时代,CRM的底层逻辑正被重构|甲子光年
AI正加速改变CRM及SaaS产品形态和市场格局。纷享销客发布ShareAI平台,从连接型向智能型CRM跃迁。AI重构CRM底层逻辑,还助海外SaaS破局,中国厂商或借AI探寻商业化路径。