自回归基座模型」共找到 7859 篇相关文章

开源动态7

DeepSeek推理再提速80%,V4正式版定档7月中旬

DeepSeek两天前开源DSpark推理加速框架,已在V4预览版在线服务跑真实流量,使生成速度提升60% - 85%。DSpark化解推测解码问题,在多模型超Eagle3和DFlash。V4正式版7月中旬上线,将引入峰谷定价。

AIGC开放社区
算法论文8

腾讯提出SPO,告别Group

腾讯团队提出Single - stream Policy Optimization(SPO),回归单流策略梯度范式,解决组基方法瓶颈。它有多项亮点,如告别组同步、采用自适应价值跟踪等,在实验中提升了模型性能和训练吞吐。

深度学习自然语言处理
算法论文8

MetaAI解锁Transformer潜意识,仅额外3%计算开销,性能提升最高55%

Meta FAIR研究员François Fleuret提出《The Free Transformer》,对解码器Transformer扩展。它通过引入随机变量,让模型先计划后执行,用约3%计算开销,在编程等任务上性能提升最高达55%。

AIGC开放社区
新闻资讯8

挤不动的世界机器人大会上,自变量秀出了真·通用具身智能

2025世界机器人大会上,自变量机器人展示多项成果。通用轮式双臂机器人“小量”“小白”能完成制作香囊、家务整理等任务;“量子2号”仿人形机器人动作精准自然;其具身智能基座模型WALL - A有强大泛化性。

机器之心
产品应用8

9.1K Star!这个工具把 Claude Code 的幸福感拉满了,终于不用手撸 JSON 配置了!

Claude Code等让开发者回归终端开发,但配置“反人类”。GitHub上的cc-switch工具基于Rust + Tauri开发,支持多款模型快速配置切换,有可视化面板及多种功能,还集成Skills库,大大提升使用体验。

开源星探
算法论文8

北大、字节、中科院自动化研究所等提出图像并行生成新范式

北大、字节等团队发现多模态模型先思考后作画会降低图像语义保真度,因自回归架构有误差传播问题。为此提出并行多模态扩散框架MMaDA - Parallel,构建ParaBench基准,多项优化后在测试中击败Bagel。

AIGC开放社区
新闻资讯7

对话赵天奇:从AI短剧到互动影游,聚力维度的“升维”之战

本文是对聚力维度创始人赵天奇的访谈。他认为 3D AI 技术潜力大,团队聚焦 AI 漫剧/短剧,用自研赛娲大模型降成本。还将拓展 3D 互动影游,认为它是游戏终极形态,从业者要回归影视本质,创业者需拥抱变化。

AI科技评论
新闻资讯8

Google 在 AI 竞赛中如何从落后到反超的故事

本文讲述 Google 在 AI 竞赛中从落后到反超的历程。曾因傲慢错过先机,ChatGPT 问世后 Google 陷入恐慌,后通过创始人回归、团队合并、召回人才等举措,让 Gemini 模型多项指标超越 ChatGPT,实现逆袭。

宝玉AI
开源动态8

告别Transformer!北大、北邮、华为开源纯卷积DiC:3x3卷积实现SOTA性能,比DiT快5倍!

北大、北邮和华为研究提出纯卷积扩散模型 DiC,抛弃自注意力机制回归 3x3 卷积。它性能超 DiT,推理速度快 5 倍,证明精心设计的卷积网络在生成任务中也能表现卓越。

机器之心
产品应用8

Qwen3.7:智能体新前沿

阿里云正式发布面向智能体时代的Qwen3.7-Max模型,将通过API提供服务。它能力全面,编程、办公、长周期执行等表现出色,适配多框架,在多场景评测中领先,能驱动生产力跃升,还经多实战测试验证实力。

千问大模型