上下文学习」共找到 1970 篇相关文章

算法论文8

DiffMoE:动态Token选择助力扩散模型性能飞跃,快手&清华团队打造视觉生成新标杆!

清华大学和快手可灵团队推出DiffMoE,通过创新的动态token选择机制和全局token池设计,拓展了扩散模型的效率与性能边界。实验表明,DiffMoE在多方面超越现有模型,未来集成先进技术或有新增益。

机器之心
推荐文章8

翁荔新博客提出「自进化先从Harness开始」,DeepSeek崔添翼转发附议

前OpenAI安全副总裁翁荔新博客探讨AI自进化,提出从Harness开始的现实路径。DeepSeek崔添翼转发附议,认为Harness方向自进化很可能出成果。翁荔梳理研究,展示优化递进趋势,也指出实现递归自我改进存在的瓶颈。

量子位
8

专访贾奎:世界模型不是Demo是生意,10亿融资到位,跨维智能冲刺IPO|甲子光年

甲子光年专访跨维智能创始人贾奎,他提出“Physical Token经济学”,认为物理AI不能只依赖巨量投入和宏大叙事。跨维智能近期完成10亿B轮融资,正冲刺世界模型赛道第一股。贾奎还介绍了公司技术路线、世界模型选择和落地进展。

甲子光年
推荐文章7

为什么你的 AI Coding 账单越涨越快?十个节约 Token 的工程办法。

文章指出今年大模型Token账单涨得快,尤其AI编程重度用户。从工程角度总结降低Token消耗的方法,如上下文清场、代码导航等,还分析AI Coding的Token变贵原因及各方法适用边界。

AI大模型应用实践
算法论文8

大模型"温故而知新"实现了!无需历史数据,Octopus 效果超越全数据训练|CVPR‘26 Octopus

上海交通大学与vivo团队提出全新持续学习框架Octopus,首创无需历史数据的梯度正交化技术。实验显示,它在UCIT基准上表现超SOTA方法,还实现正向后向迁移,适合端侧部署。

量子位
算法论文8

TRM思考奖励模型上线,大模型推理质量终于能量化了 | ICML‘26 Oral

大模型推理评测多只看答案,忽略推理过程。上海多校团队提出TRM,用ME² principle刻画推理质量,DAG-based pairwise evaluation还原结构,训练奖励模型,让推理质量可度量、训练和优化。

量子位
开源动态8

7,700+ star 微软 SkillOpt 可以训练的Skill

微软研究院开源了SkillOpt(7700+ star),把Skill文档当成‘可训练的权重’来优化。它有独特的6阶段流水线、核心验证门控、Protected Regions机制,还有SkillOpt - Sleep预览功能,让Skill文档可系统化训练。

CourseAI
开源动态8

35B参数科学性能比肩万亿参数模型,『书生』科学大模型Intern-S2-Preview开源

5月15日上海AI实验室开源新一代大模型预览版Intern - S2 - Preview,尺寸小、科学能力强,在多方面有突破。其深化与昇腾算力生态协同,探索‘通专融合’,科学及智能体能力升级,还优化训推效率。

GiantPandaLLM
产品应用8

动动嘴写SQL!Codex+终身记忆,OpenAI把查询难度直接归零

2026年初,OpenAI曝光数据分析智能体,将数据查询从「天数级」缩至「分钟级」。它用Codex驱动,有六层上下文架构,能补齐数据语义、沉淀经验记忆,让工程师提问取代手动查表。

新智元
开源动态7

HeyGen开源HyperFrames框架:Remotion劲敌,用HTML写视频的时代来了

HeyGen开源HyperFrames框架,解决视频制作专业工具学习成本高、简单工具缺灵活性的矛盾。它基于HTML,与Remotion设计哲学不同,渲染快、输出体积轻,有诸多特性和应用场景,安装简单。

AI工程化