大模型Agent」共找到 10509 篇相关文章

推荐文章7

深刻理解Token:语言模型(LLM)是如何看待这世界?

文章指出在语言模型(LLM)中,Token是处理文本的基本单位。介绍了Token的概念、分词方法、向量化过程,还阐述了分词对模型性能的影响,如导致模型在数学、多语言处理上表现不佳等。

AINLPer
算法论文8

模型长脑子了?研究发现LLM中层会自发模拟人脑进化

帝国理工学院等机构研究人员发表论文,指出型语言模型(LLM)学习中会自发演化出类似生物脑的协同核心结构。研究对多个模型剖析,揭示其内部处理规律,为模型可解释性开辟新路径。

机器之心
开源动态8

击败 GPT-5!理想汽车开源 RubricHub:模型开放生成从此有了专业裁判

理想汽车基座模型团队联合高校发布RubricHub数据集,解决开放式任务评价难题。该数据集可将主观评价转化为量化标准,经其训练的Qwen3 - 14B小模型在医疗基准测试中超越GPT - 5。

AI科技评论
推荐文章8

推荐系统进入“模型时刻”:昇腾NPU如何支撑千亿级生成式推荐落地

文章基于华为郭威在2025 AICon会演讲,复盘华为推荐技术探索。介绍FuXi-α、β模型设计,解决训练和推理难题;分享“多阶段统一建模”进展,提出Performance Law;还介绍了训推系统优化及未来聚焦“强算力”“强模型”融合。

InfoQ
推荐文章7

模型微调知识与实践分享

文章详细介绍型语言模型(LLM)微调知识与实践,包括模型结构、参数量等知识,以及Prompt工程、数据构造、LoRA微调等技术点。还给出微调实践流程,介绍相关平台和框架,如星云、TuningFactory等。

阿里云开发者
推荐文章7

Manus首次揭秘:Agent的关键在上下文工程

Agent模型主战场,构建方法待探索。Manus发blog揭秘,认为成功的AI Agent依赖上下文工程。团队选此实现快速迭代,虽实践不易,但总结出围绕KV缓存设计等关键点,其经验影响Agent表现。

AI寒武纪
新闻资讯7

最新外国「自研」模型,都是套壳国产?

本周,Cursor发布新代码模型Composer,Cognition推出新AI模型SWE - 1.5,二者均被指背后基于中国AI模型。业界佬认为有证据指向中国开源模型,国产开源模型已成AI领域主流,改变全球竞争格局。

机器之心
算法论文8

逐个token太慢!模型原生并行出token,CMU、英伟达新作Multiverse

卡耐基梅隆学(CMU)和英伟达研究者提出Multiverse,这是能实现原生并行生成的新型生成模型。它解决了现有并行生成模型缺乏连贯性等问题,通过多方面协同设计构建推理模型,还开源了生态系统。

机器之心
算法论文8

精准调控模型生成与推理!浙&腾讯新方法尝试为其注入“行为定向剂”

ACL 2025中选论文里,浙与腾讯联合团队提出STA方法,深入模型内部分析神经元激活模式,干预关键神经元,抑制有害行为、保留通用性能,还在多模型实验验证效果,并将部分方法开源。

量子位
推荐文章8

揭秘模型Steering:从底层机理到系统评估,全面破解模型行为控制之谜

近期《Science》研究表明可解析AI内部表征实现通用引导与监控。浙联合阿里两篇ACL 2026主会论文,揭示Steering工作原理与能力边界,还开源一站式框架EasyEdit2,全面展示了Steering价值。

机器之心