「堆叠自回归」共找到 1219 篇相关文章
编程能力开源SOTA,网络安全提升2倍!智谱发布GLM-5.3
智谱发布GLM-5.3,743B参数模型,编程能力达开源SOTA。网络安全能力涌现,基准得分是GLM-5.2两倍多。全部提升来自后训练缩放,还自研Z.ai Code Bench评估,安全评估加固后权重将开源。
马斯克庭审手撕OpenAI!3800万捐款变「笑话」,11年理想碎了
2026年4月,马斯克出庭指控OpenAI违背2015年非营利使命,接受微软约100亿美元投资。他曾捐3800万美元,要求赔偿1300 - 1500亿美元,让OpenAI回归非营利。庭审交锋激烈,还引出OpenAI内部矛盾。
Cursor发布首个编程大模型!代码生成250tokens/秒,强化学习+MoE架构
Cursor 2.0正式发布,搭载自研大模型Composer。它30秒完成复杂任务,比同行快400%,每秒生成250个tokens。还带来原生浏览器工具等新功能,基于强化学习,但模型底子透明度遭质疑。
一帮机器人公司苦练一年,冠军被搞手机的给抢了
亦庄人形机器人半程马拉松赛上,荣耀自研机器人“闪电”以50分26秒夺冠,刷新历史最好成绩,还超越人类男子半马世界纪录,且荣耀包揽前六名。众多机器人参赛,现场有不少有趣“名场面”。
马斯克发起编程人机大战!卡帕西说了不
马斯克邀卡帕西与Grok 5编程对决,卡帕西婉拒,称更愿合作。网友看法不一,有人认为是马斯克伸橄榄枝,也有人猜测因xAI核心工程师离职,卡帕西或成接班人,未来是否回归待察。
TPAMI 2026 | 北大彭宇新团队提出CPL++框架,实现视觉定位模型的「自知之明」和「自我纠错」
北大彭宇新教授团队提出CPL及进阶版CPL++框架。CPL用单模态匹配构造伪标签,引入静态验证模块;CPL++进一步自监督升级,具备纠错能力。实验显示,CPL++缩小了弱、全监督方法性能差距。
又走一个!OpenAI研究VP离职,转投Anthropic做RL研究员
OpenAI研究副总裁Max Schwarzer宣布离职,转投Anthropic做RL研究员。他曾主导o1、o3和GPT - 5系列post - training,因渴望回归一线研究而离开。OpenAI近年人才流失严重,而Anthropic虽面临与五角大楼交锋危机,但仍吸引人才。
四问智谱上市|甲子光年
2026年1月8日,智谱AI在港交所上市。本文围绕其上市提出四问:是否为“中国OpenAI”、投资人押注点、商业模式健康度及“钱路”方向。指出它应卸下标签,回归技术与商业本质。
NeurIPS 2025|VFMTok: Visual Foundation Models驱动的Tokenizer时代来临
传统视觉 Tokenizer 存在缺乏高层语义信息、冗余度高、表征混乱等问题。香港大学 CVMI Lab 和阶跃星辰 AIGC 团队提出 VFMTok,用预训练视觉基础模型构造视觉 Tokenizer,实验显示其性能优异。
8K Star!给所有 AI 编程工具加个智能调度中心,节省 20-40% Token!
AI编程圈火了个工具9Router,它是智能调度中心,能连接主流编程工具,自动路由到40多家AI提供商和100多个模型,自带RTK Token节省器,还有实用的三级降级机制,安装配置简单。