大模型对齐」共找到 9183 篇相关文章

算法论文8

模型长脑子了?研究发现LLM中层会自发模拟人脑进化

帝国理工学院等机构研究人员发表论文,指出型语言模型(LLM)学习中会自发演化出类似生物脑的协同核心结构。研究对多个模型剖析,揭示其内部处理规律,为模型可解释性开辟新路径。

机器之心
算法论文7

英伟达放话:小模型才是Agent的未来!

英伟达论文指出,当前用模型构建AI Agent是资源浪费,提出小模型才是Agentic AI未来,给出三点理由,还提供从模型迁移到小模型的六步流程,并分析三个开源项目,呼吁行业追求效能。

探索AGI
开源动态8

击败 GPT-5!理想汽车开源 RubricHub:模型开放生成从此有了专业裁判

理想汽车基座模型团队联合高校发布RubricHub数据集,解决开放式任务评价难题。该数据集可将主观评价转化为量化标准,经其训练的Qwen3 - 14B小模型在医疗基准测试中超越GPT - 5。

AI科技评论
推荐文章8

推荐系统进入“模型时刻”:昇腾NPU如何支撑千亿级生成式推荐落地

文章基于华为郭威在2025 AICon会演讲,复盘华为推荐技术探索。介绍FuXi-α、β模型设计,解决训练和推理难题;分享“多阶段统一建模”进展,提出Performance Law;还介绍了训推系统优化及未来聚焦“强算力”“强模型”融合。

InfoQ
推荐文章7

模型微调知识与实践分享

文章详细介绍型语言模型(LLM)微调知识与实践,包括模型结构、参数量等知识,以及Prompt工程、数据构造、LoRA微调等技术点。还给出微调实践流程,介绍相关平台和框架,如星云、TuningFactory等。

阿里云开发者
新闻资讯7

最新外国「自研」模型,都是套壳国产?

本周,Cursor发布新代码模型Composer,Cognition推出新AI模型SWE - 1.5,二者均被指背后基于中国AI模型。业界佬认为有证据指向中国开源模型,国产开源模型已成AI领域主流,改变全球竞争格局。

机器之心
算法论文8

逐个token太慢!模型原生并行出token,CMU、英伟达新作Multiverse

卡耐基梅隆学(CMU)和英伟达研究者提出Multiverse,这是能实现原生并行生成的新型生成模型。它解决了现有并行生成模型缺乏连贯性等问题,通过多方面协同设计构建推理模型,还开源了生态系统。

机器之心
新闻资讯8

从MiniMax到DeepSeek:为何头部模型都在押注「交错思维」?

昨日推特博主公布国内几开源模型在 mini - SWE - agent 测试成绩,MiniMax 新一代模型 M2 表现最佳。其采用的「交错思维」技术成亮点,解决了状态漂移问题,正成高性能 Agent 模型标配。M2 既强又省,还给出使用最佳实践。

机器之心
算法论文8

精准调控模型生成与推理!浙&腾讯新方法尝试为其注入“行为定向剂”

ACL 2025中选论文里,浙与腾讯联合团队提出STA方法,深入模型内部分析神经元激活模式,干预关键神经元,抑制有害行为、保留通用性能,还在多模型实验验证效果,并将部分方法开源。

量子位
推荐文章8

揭秘模型Steering:从底层机理到系统评估,全面破解模型行为控制之谜

近期《Science》研究表明可解析AI内部表征实现通用引导与监控。浙联合阿里两篇ACL 2026主会论文,揭示Steering工作原理与能力边界,还开源一站式框架EasyEdit2,全面展示了Steering价值。

机器之心