「动作生成大模型」共找到 8796 篇相关文章
20000 GPU·h砸出 106 个SOTA模型架构:AI 科研进入“自我加速”时代
模型架构发现领域迎来突破,ASI - ARCH超级智能体无需人类预设搜索空间,完成科研闭环。经20000 GPU·h、1773次实验,发现106个超越人类SOTA的线性注意力架构,且已开源。
Kimi K2 Thinking突袭!智能体&推理能力超GPT-5,网友:再次缩小开源闭源差距
Kimi K2 Thinking发布并开源,主打“模型即Agent”,能边思考边用工具,连续工具调用200 - 300次。在多评测基准超GPT - 5等闭源模型,代码权重遵循MIT协议,可在官网和应用实测。
推理“刹不住车”?新框架让DeepSeek-R1们告别过度思考,已开源
DeepSeek - R1等推理模型能力增强,但出现过度思考问题,如步骤繁冗、表述拖沓、输出冗长。浙大等团队提出Self - Braking Tuning(SBT)框架,能让模型适时终止推理,在多数据集测试中效果显著。
Claude Code 生成 13 种编程语言代码基准测试:动态语言更快更省成本
Ruby 代码提交者远藤裕介评估 Claude Code 用 13 种编程语言生成代码的效率。经 600 多次测试,动态语言更快、更省成本且更稳定,静态类型语言慢且成本高。实验有局限,也引发质疑与回应。
只用国产GPU训练的大模型性能飙升100%!国内唯一,更懂你
科大讯飞发布全国产算力训练的讯飞星火X1.5,推理效率暴涨100%,综合性能跻身全球顶级。还首发非自回归语音大模型架构,效果提升、成本降低。此外,展示多领域应用成果,发布相关产品,开源智能体平台。
o系列模型开创者,OpenAI研究副总裁官宣离职,还是codex,GPT-5,GPT-4核心
OpenAI研究负责人Jerry Tworek工作近七年后宣布离职,他是“波兰帮”成员、研究副总,贡献包括o1和o3模型、Codex等,离开是为探索在OpenAI难进行的研究。
拍我AI V5模型发布,AI视频的“不可能三角”被解开了?
拍我AI推出V5模型,一上架就到Artificial Analysis榜单前列。它在多维度升级,维持速度和性价比优势,试图解开AI视频生成“不可能三角”。文章实测其运动、二次元、商业等场景表现,还提及速度与价格优势。
扩散模型自引导新范式:直接交换token就能变强! | CVPR‘26 Oral
上海交大和vivo研究者提出自交换引导(SSG),不依赖文本条件、不加噪声、不改模型,只交换token特征。在多数据集实验中,SSG表现超现有方法。不过,其缺理论支撑、计算开销大。
用AI把一段视频变成可视化网页,Google的新模型又卷飞了。
Google将Gemini 2.5 Pro更新为05 - 06版,此版代码能力在WebDev Arena盲测竞技场登顶,还提升视频理解能力,可将视频变成可视化网页,虽产品有不足,但模型进步值得肯定。
OpenAI新模型GPT-5.1发布,不跑分不刷榜,主打一个说人话
OpenAI发布GPT-5.1,主打更智能、更具对话性,无跑分打榜,有人设说人话。包括Instant和Thinking两个子模型,简单问题快,复杂问题智能。本周逐步向用户免费开放,还更新了语气风格等功能。