后训练范式」共找到 4432 篇相关文章

算法论文8

北大团队发布首篇大语言模型心理测量学系统综述:评估、验证、增强

随着大语言模型(LLM)能力迭代,传统评估方法难满足需求。北大宋国杰教授团队论文首次系统梳理LLM心理测量学研究进展,革新评估原则,扩展测量构念与方法,还给出增强方法与未来研究方向。

机器之心
算法论文8

九成以上模型止步白银段位,只有3个铂金!通用AI下半场评测标准来了

OpenAI研究员姚顺雨提出AI发展步入新阶段,下半场关键在评估模型真实智能。新加坡国立大学等团队提出“通才智能”评测框架,剖析多模态大模型短板,推出五级评估体系和测试集,测试结果暴露模型弱点,引发社区积极反响。

机器之心
算法论文8

CoT推理大溃败?哈佛华人揭秘:LLM一思考,立刻就「失智」

新研究揭示思维链CoT会分散模型「注意力」,使大模型推理时易出错。研究指出在需遵守指令任务中,用CoT推理模型准确率下降,还总结了四大模式,并提出四种缓解策略。

新智元
算法论文8

Qwen突破:用「并行计算」代替「堆参数」,新方法内存降22倍、延迟降6倍

LLM进化依赖「堆参数」,存在训练成本高、推理慢等问题。论文提出ParScale,用「并行计算」代替「堆参数」,让模型「分头思考」,推理效率提升22倍,旧模型也能改造,落地价值大。

深度学习自然语言处理
推荐文章7

智源技术分享:大模型行业应用新模式和关键实现路径

在 AICon 大会上,智源研究院周华分享大模型行业应用。分析落地问题,提出以大模型为核心的技术路径,涵盖数据、训练等环节,还给出数据生产流程建议,分享最新开源成果。

InfoQ
算法论文8

网页藏毒,劫持Agent?你需要会「追凶」的自进化女警系统

AI Agent接入外部环境,易遭遇隐蔽的网页藏毒、prompt注入攻击,传统防御要么成本过高要么易被新型攻击绕过,本文介绍新提出的自进化防御系统CAITLYN,验证了其防御效果。

新智元
算法论文8

浙大 × 字节 × 港中深最新研究:告别高斯堆砌,终结 3D 冗余|ECCV 2026

本文解读浙大、字节跳动、香港中文大学(深圳)联合收录于ECCV 2026的PointSplat研究,针对3D高斯溅射的跨视角冗余问题,提出以人为中心的新框架,解决3D表示体积过大问题,适配实时场景。

AI科技评论
新闻资讯7

刚刚!Ilya首个模型曝光了

前OpenAI首席科学家Ilya离开两年,X网友爆料其创办的SSI正探索基于TTT的小型推理引擎,当前版本或8月向少数用户开放。该爆料与Ilya观点及英伟达合作等线索相符,但也面临安全难题。

量子位
推荐文章8

对话涌生智能杨梦:AI for Bio的下一场竞争,是把实验闭环验证真正做出来

随着科技巨头进入生命科学领域,AI for Bio竞争升级,焦点转向模型能否进入科研流程。涌生智能与上海人工智能实验室发布成果,为跨越鸿沟提供新路径。对话涌生智能杨梦,探讨相关技术路径、产业思考等。

DeepTech深科技
推荐文章7

跟上 AI 的节奏:为演进式架构构建上下文存储库

本文探讨AI辅助开发带来的上下文认知断层问题。在开发中,AI前期提效但期难题凸显,企业面临团队执行和管理层决策层面隐患。可通过融合三大工程规范构建上下文存储库解决,确保开发逻辑可控。

InfoQ