「自适应路由」共找到 1230 篇相关文章
LLM内部竟藏着众多策略模型?自所&腾讯团队首次揭示大模型RL新机制
中国科学院自动化研究所与腾讯AI Lab团队从可解释性分析出发,发现LLM内部含多个可采样内部策略,揭示不同模型推理熵模式,提出BuPO算法,在复杂推理任务上性能显著优于传统算法。
突破Claude-4编程上限!自进化Agent框架拿下新SOTA,底模越好性能越高,已开源
中科院、清华等提出SE - Agent自进化框架,突破Claude - 4编程上限。它让智能体系统性修订、重组与精炼思考过程,在SWE - Bench Verified上刷新开源框架SOTA,已开源。
网友晒 21 页 PDF 质疑 Grok 3 套壳 Claude,Grok 3 自己承认了!xAI 工程师被喷无能
网友 GpsTracker 爆料,埃隆·马斯克旗下 xAI 公司的 Grok 3 模型在“思考模式”下自称是竞争对手 Anthropic 公司的 Claude 3.5。网友提供对话记录和 21 页 PDF 佐证,引发社区对模型异常原因的讨论。
21 页 PDF 实锤 Grok 3“套壳”Claude?Grok 3 玩自曝,xAI工程师被喷无能!
网友 GpsTracker 爆料,xAI 公司的 Grok 3 在“思考模式”下自称是 Anthropic 公司的 Claude 3.5。多种模式测试显示异常回应仅在“思考模式”触发,21 页 PDF 记录也证实其“自曝”。此事引发热议,有人吐槽预训练团队水平差。
刚刚,小米一口气发布三颗自研芯片!玄戒O3安兔兔跑分522万,安卓首破500万
小米玄戒技术沟通会上,负责人朱丹介绍三款芯片。主推AI旗舰SoC玄戒O3,安兔兔跑分超522万,下月将在小米18 Fold首发。还介绍了玄戒O100和玄戒D100,预计明年商用。
OpenAI自研芯片内幕曝光!18个月前开始用AI优化芯片设计,比人类工程师更快
OpenAI与博通官宣合作,将共同部署10GW规模AI加速器。双方头头齐聚爆料合作契机与细节,OpenAI总裁称已用AI优化芯片设计,比人类工程师更快,且合作已持续约18个月。
突发!OpenAI推出首款自研AI芯片:能效暴打当前SOTA,今年底G瓦级部署
OpenAI和博通联合发布自研AI推理芯片Jalapeño,它专为大模型推理设计,每瓦性能优于当前最先进水平,九个月完成设计制造,是全栈战略一部分,2026年底开始吉瓦级部署。
NeurIPS 2025 | ARGRE框架实现高效LLM解毒:自回归奖励引导,安全对齐更快、更准、更轻
北航等机构研究提出自回归奖励引导表征编辑(ARGRE)框架,在LLM潜在表征空间可视化毒性变化路径,实现测试阶段高效“解毒”。实验显示其降低毒性、缩短推理时间,不影响模型能力,优于基线方法。
2026开年关键词:Self-Distillation,大模型真正走向「持续学习」
2026年刚开场,Self - Distillation成大模型领域高频词汇。传统强教师依赖范式难适配大模型持续进化,MIT等顶尖机构发布三项成果,用不同方法实现自蒸馏,推动模型持续学习。
如何破解海量内容审核难题?快手安全大模型技术探索与应用实践
在数字内容爆炸式增长下,传统内容审核模式难应对挑战。快手安全算法中心负责人刘梦怡分享自研多模态大模型技术方案与应用实践,涵盖架构、数据、训练等,还介绍审核智能化应用及未来展望。