「动态分块机制」共找到 1203 篇相关文章
阿里:RL强化LLM推理,是技巧还是陷阱?
近年来,强化学习(RL)成为解锁大型语言模型(LLM)复杂推理能力的关键工具,但该领域也面临技术选择困境。阿里联合多所高校的论文通过大规模可复现实验,揭示主流RL技巧的机制与适用场景,还发现极简组合(Lite PPO)性能超越复杂方案。
AI 基础知识从 0.5 到 0.6—— Transformer 架构为何能统治AI领域?
文章围绕Transformer架构展开,先介绍其诞生背景,对比CNN、RNN等模型,阐述其在多领域的核心地位。接着剖析工作流程、实现原理,包括QKV机制、多头注意力等。最后列举T5、GPT等常见架构模型,并提及通义千问3与MCP协议。
Google开源MCP数据库工具箱轻松连接各类数据库
近日Google开源新项目genai - toolbox,它是为数据库设计的MCP服务器,能让开发者用不到10行代码将数据库工具集成到AI应用。该项目封装复杂问题,有动态工具注册机制,支持主流数据库,提供多语言SDK和多种部署方式。
MiniMax开源首个视觉RL统一框架,闫俊杰领衔!推理感知两手抓,性能横扫MEGA-Bench
MiniMax开源首个视觉RL统一框架V-Triune,由闫俊杰领衔。该框架通过三层组件设计和动态IoU奖励机制,让VLM能联合学习推理和感知任务。还开发Orsta模型系列,在MEGA - Bench表现出色,且MiniMax多模态布局动作多。
生财有术小连:微信问一问蓝海机会,用搜索玩法抢占流量先机
生财有术小连分享微信问一问运营经验,指出其支持真人分享、有“去AI化”特点及“强SEO搜索、排名”机制。介绍视觉霸占、抢词根等玩法,还给出内容与ID绑定等运营建议,称当前是SEO玩法的蓝海时期。
AGI时代最稳的饭碗是什么?3Blue1Brown创始人:技术会淘汰,但信任不会
科普视频博主 Grant Sanderson 在播客中指出,AI 因缺乏肉身和生理模仿机制,写不出触动人类灵魂的文章,即便证出黎曼猜想,若证明冗长,对人类也无意义。他还探讨了 AI 在数学领域的进展、局限,以及人类教师和科普作者在后 AI 时代的价值。
拥抱大模型:深入剖析ReAct的核心原理、技术架构及其对AI领域的深远影响
文章深入剖析ReAct,它是普林斯顿大学和谷歌团队提出的智能体架构范式,将推理与行动协同,构建TAO闭环。介绍其原理、架构,指出解决传统AI难题,也存在局限,未来可与强化学习等融合。
Anthropic顶级Claude模型被逆向开源,这几个模块借鉴了DeepSeek
22岁开发者逆向开源Anthropic的Claude Mythos Preview模型架构,名为OpenMythos。其核心模块借鉴DeepSeek,采用带混合专家路由机制的循环Transformer,有独特设计和稳定机制,重新框定扩展性争论。
因果发现进入基础模型时代:CDFM 如何从数据中推断因果结构 | GAIR Paper 120
因果发现正从“手工挑选算法”走向“大模型统一零样本推断”范式。广东工业大学等团队提出CDFM,能统一处理多种情况,解决传统方法痛点,在多方面展现良好性能,是因果发现基础模型时代的重要起步。
全球首个,连续时间具身世界模型!任意帧率自由生成
来自清华AIR与UC Berkeley BAIR的团队提出全球首个连续时间具身世界模型ODEWorld。它学习世界在每个时刻的变化方向与速度,能任意帧率自由生成,统一了离散模型分散的生成能力。