端到端微调」共找到 2546 篇相关文章

算法论文8

61.3%!「人类最后一场考试」AI终于及格了,揭秘Agent自我进化新路径

上海交通大学等联合团队提出MemRL框架,在不微调模型参数下,让AI在“人类最后一场考试”中准确率跃至61.3%。该框架受人类认知科学启发,解耦推理与记忆,实验表现出色,或为AGI提供高效路径。

AI科技评论
推荐文章7

中年人的认知坍塌

Andrej Karpathy在播客提模型持续用合成数据训练会出现‘认知坍塌’,能力退化。他认为人类随年龄增长和经验固化,也会从无限可能收敛固定思维模式,像极了中年人的认知坍塌。

newtype AI
开源动态8

刚刚!Meta把大模型塞进脑机接口,隔空读脑直逼开颅植入水平,代码全开源

Meta推出Brain2Qwerty v2,号称性能最强方案,能基于非侵入式脑部记录实现实时句子级解码,准确率逼近开颅手术水平。还开源代码,公开数据集,旨在帮脑损伤患者交流。

AI寒武纪
算法论文8

AI 终于学会 「自我坦白」!Anthropic最新论文震撼来袭,「内省适配器」让黑盒模型自己说出隐藏行为

2026年4月28日,Anthropic联合剑桥大学发布论文,提出“内省适配器”技术,可让大模型用自然语言“坦白”微调中学的行为。该技术在AuditBench基准测试等实战中表现出色,但也存在高误报率等局限。

AI科技评论
开源动态7

深度体验|京东开源轻量化通用Agent产品 jdgenie,开箱即用!二次开发及踩坑指南。

本文体验京东开源的多智能体系统JoyAgent - JDGenie,它是产品级多智能体协同系统,开箱即用、支持本地部署。介绍其原理架构、本地部署测试步骤、二次开发方式,还指出特点与不足。

AI大模型应用实践
新闻资讯7

英特尔,10000亿市值还有多远?

英特尔CEO陈立武上任14个月“再造”英特尔,股价涨幅超530%,市值涨至超6600亿美元。他采取裁员、股权重组、押注18A制程等手段,还通过社交为公司找合作,目标是未来510年为股东实现10倍回报。

芯师爷
推荐文章8

当 Kanban 不再管理人:Routa Kanban 如何管理 Agent Team

本文探讨了 Routa Kanban 如何管理 Agent Team,指出在 AI4SE 时代,多 Agent 协作进入日常软件交付需建设管理界面与工程护栏。Routa Kanban 把多 Agent 协作推进‘管理驱动’,其价值在于将隐性约束显性化。

phodal
算法论文8

知识图谱推理新sota,兼顾性能+效率!中科大新作 | NeurIPS'25

知识图谱推理应用广泛,但现有方法面临推理效率低、表达能力不足等挑战。中科大团队提出DuetGraph,采用双阶段粗细推理框架与双通路全局 - 局部特征融合模型,平衡推理精度与效率,缓解过平滑问题。

新智元
新闻资讯7

用激光给芯片散热,摩尔定律天花板盖不住了

初创公司Maxwell Labs提出光子冷却法,可将芯片热量转化成光并去除。该方法基于反斯托克斯冷却原理,集成薄膜芯片级光子冷板。相比传统散热,它效率更高,有望解决芯片散热难题,推动行业发展。

量子位
产品应用8

RecGPT-阿里的LLM推荐系统落地方案

文章介绍阿里RecGPT推荐系统落地方案,包括召回和推荐可解释性两方向。召回采用三塔结构,通过挖掘用户兴趣生成商品标签提升召回多样性。还提及行为序列压缩、推荐归因等,以及大模型微调和评估方法。

王喆的AI笔记