「研究范式」共找到 2739 篇相关文章
大模型赋能的具身智能:自主决策和具身学习技术最新综述
具身智能是通往通用人工智能的关键路径,但传统方法有泛化瓶颈。电子科大最新综述梳理大模型赋能具身智能的自主决策与具身学习,还将‘World Model’纳入统一框架,为研究者提供路线图。
加一个字母就可以绕过AI围栏,新的漏洞:TokenBreak
提示词注入攻击威胁大模型及应用,当前主要防护方法是用BERT模型检测。HiddenLayer团队发现TokenBreak漏洞,通过加字母绕过检测。研究表明BPE和WordPiece分词策略易受攻击,Unigram不易,建议优先选Unigram类模型。
让你抄袭都跟不上节奏
最近 Dia 连更两小版本,推出 Skills Gallery 和 Research 功能,即扩展技能库和深度研究能力。它更新似微信,节奏快创意足,让对手难抄袭。目前免费,仅 M 芯片苹果电脑可用,文末有邀码获取方式。
关键突破:理论验证了 RL for LLM 路线的可行性
传统RLHF依赖人工标注偏好数据训练奖励模型,成本高且难扩展。本文发现任何通过Next - token预测训练的LLM内部隐含通用奖励模型,从理论和实验证明其可高效实现模型对齐。
AI写爆款博客火出圈,主笔竟是Claude!
Anthropic为Claude开博客展示写作能力,内容经团队把关。AI写内容已不新鲜,但多有翻车。普华永道研究称AI提升员工创效,重塑企业运营逻辑。多公司推行AI战略,不过学生用AI作弊引担忧。
统一架构新思考,北大团队UniWorld-V1统一大模型
北大袁粒课题组提出统一大模型架构UniWorld-V1。通过对GPT - 4o - Image实验,发现其依赖语义编码器提取视觉特征,据此设计架构,在多基准测试表现优异,开源代码等促进研究。
DeepMind:Transformer存在拓扑缺陷,思维链治标不治本
谷歌DeepMind论文指出,Transformer架构不擅长追踪状态,思维链只是给结构性缺陷打补丁,成本高。论文主张用循环架构替代或补充纯前馈结构,还提出多个研究方向,认为下一代模型需构建‘流动的现实表示’。
陶哲轩:用了GPT-5 Pro后,小尺度、宏观尺度很赞,中尺度有点垮
著名数学家陶哲轩用ChatGPT - 5 Pro研究曲率有界的球面问题,记录AI在不同层面的表现。小尺度和宏观尺度AI有用,中尺度帮助有限。虽问题未解决,但他学到新知识,也意识到与AI协作要谨慎。
北航,清华,北大联合发布: 异构智能体协同强化学习!
北航、清华、北大联合发布异构智能体协同强化学习论文。提出 HACRL 新范式,实现异构智能体双向互学与独立部署统一;还有 HACPO 算法弥合智能体差异。实验显示性能提升且成本降低,为多智能体协同学习指明方向。
刷榜多元时序预测,性能波动0%!打破CI/CD二元对立 | ICLR'26
在多元时间序列预测领域,长期存在通道依赖(CD)与通道独立(CI)路线之争。浙江财经大学团队提出CPiRi框架,结合时空解耦架构与置换不变正则化策略,解决范式矛盾,取得优异效果。