自监督关联校正」共找到 196 篇相关文章

算法论文8

彻底改写Transformer!「能量驱动架构」横空出世,通用推理时代要来了?

UIUC、斯坦福与哈佛联合提出全新「能量驱动Transformer(EBT)」架构,打破「前馈即推理」旧范式,以能量最小化模拟人类思维,训练更高效、推理更精准,在多方面超越传统Transformer。

新智元
算法论文8

这个推理模型:HRM ,只用2700万参数,超越了DeepSeek和Claude

Sapient Intelligence研究者受大脑机制启发提出分层推理模型HRM,它是全新循环架构,仅2700万参数、1000个训练样本,就在复杂推理任务上表现卓越,还引入近似梯度等方法,有推动通用计算变革潜力。

AINLPer
算法论文8

端到端GUI智能体首次实现“犯错-反思-修正”闭环,模拟人类认知全过程

南洋理工大学MMLab团队提出框架GUI - Reflection,让端到端多模态GUI智能体有“自我反思”能力。它在各训练阶段引入“反思与纠错”机制,实验证明该框架能提升智能体能力。

量子位
算法论文7

SMO | 西工大宁晨伽、张伟伟等:基于共享并行神经网络架构的多精度气动融合方法

高可靠性气动数据降本增效是关键命题。本研究总结主流多精度建模方法,提出基于共享并行架构的融合策略,区分公共与私有特征,提升融合框架表征能力,还通过算例验证方法有效性。

力学与人工智能
开源动态8

DeepSeek-R1发布后的100天复现之旅方法总结

DeepSeek团队发布「推理大模型」DeepSeek-R1 ,其技术细节未完全开源,全球研究团队开启“复现竞赛”。论文总结100天复现经验,介绍推理大模型与普通大模型区别、复现方法、关键发现及未来方向。

深度学习自然语言处理
新闻资讯7

刚刚,Karpathy亲自辟谣:我没走!

Karpathy入职Anthropic 68天时,因简介里「Anthropic」不见引发离职猜测,后他亲自辟谣。此前他简介改动常与离职有关,此次事件还与开源闭源之争相关,他曾是开源信仰者,如今力挺闭源Claude。

新智元
新闻资讯7

DeepSeek大招曝光?梁文峰督战超级智能体:能自主学习,或年底发布

据彭博社爆料,DeepSeek正开发AI智能体,打造无需复杂指令、可自主学习与执行的下一代AI系统,年底发布。此前DeepSeek R1表现出色,曾推动开源发展,此次新动作彰显竞争决心。

新智元
产品应用7

6K星 Qwen围绕Web AI,打造Agent Search新生态

自Manus带火深度研究代理后,新兴方向面临多模态代理推理能力不足等问题。千问2025年推出系列工具完成web智能搜索生态闭合,本文分享WebWatcher训练及解决问题的方法。

CourseAI
算法论文8

AMM|西工大 董戴玮、索玮、寇家庆、张伟伟:PINN-MG——受多重网格启发的迭代法与物理信息神经网络混合求解框架

西北工业大学团队提出PINN - MG框架,结合迭代法与物理信息神经网络。迭代法消除局部高频振荡误差,PINNs校正全局低频误差,在多方程测试中加速效果显著,还克服不定亥姆霍兹方程求解发散问题。

力学与人工智能
新闻资讯7

让你「鞭打」Claude,被Anthropic直接发「律师函」了吧

有人搞「badclaude」项目督促Claude干活,充满玩梗性质引数百万人围观。但Anthropic发停止侵权通知函,因项目用「Claude」易让用户误认有关联。此举动引发网友不同看法。

机器之心