过渡期与终局」共找到 6545 篇相关文章

新闻资讯8

Greg Brockman(OpenAI 联合创始人)把“那场宫斗”讲完整了:董事会、请愿书、马斯克控制权

OpenAI联合创始人Greg Brockman做客播客,讲述公司“宫斗”内幕、马斯克谈判细节等。还谈及模型能力、算力瓶颈、AI应用等,如GPT 5.1到5.2有质的飞跃,算力将成基本人权,AI推翻物理假设。

宝玉AI
开源动态8

告别“音画割裂”“人物崩坏”!AutoMV:首个听懂歌词、卡准节拍的开源全曲级MV生成Agent

现有AI视频生成模型做全曲MV有时长限制、音画割裂和一致性差等问题。AutoMV作为开源多智能体系统,模拟人类影视制作流程,能生成长达数分钟、叙事连贯且音画同步的完整MV。

量子位
算法论文8

GUI智能体训练迎来新范式!半在线强化学习让7B模型媲美GPT-4o

浙江大学通义实验室团队推出UI - S1,提出半在线强化学习训练范式。它融合离线在线学习优势,用三项关键技术构建核心架构,新评测指标SOP更贴近真实表现,实验显示UI - S1 - 7B性能卓越,逼近GPT - 4o。

量子位
开源动态8

告别VAE压缩损耗,南京大学用DiP让扩散模型回归像素空间,实现10倍加速SOTA级画质

南京大学、腾讯优图实验室和新加坡国立大学发布DiP框架,即将开源。该框架不依赖VAE,仅增0.3%参数量,推理提效10倍,在ImageNet获1.79的FID分数,解决扩散模型在像素空间难兼顾质效的问题。

AIGC开放社区
开源动态8

混元开源PhoneBuddy-4B5篇系列论文:多项手机Agent真机评测超过GPT-5.4

腾讯混元Phone - use Agent团队发布PhoneBuddy - 4B及5篇系列论文。研究探讨如何训练真实可用的Phone - use Agent,采用Real + Mock方式,实验显示该方法提升效果显著,4B模型多项任务超GPT - 5.4。

量子位
开源动态8

加速200倍,单显卡1.8秒生成5秒高清视频!清华Vidu解开了视频扩散模型的速度枷锁

清华、生数科技伯克利联手用TurboDiffusion解开视频扩散模型速度枷锁。它改造注意力机制、引入步数蒸馏和量化策略,在多模型测试中加速100 - 205倍,且画质几乎无损。

AIGC开放社区
开源动态8

面向6G环境感知通信!西电开源3Dx3D无线电地图数据集生成式基准框架

面向6G,西安电子科技大学等团队联合提出高分辨率多模态三维无线电图谱数据集UrbanRadio3D,构建三维无线电图生成框架RadioDiff-3D,弥补了当前主流RM构建方法数据集的局限。

新智元
新闻资讯8

谷歌OpenAI同获ICPC 2025金牌!GPT-5满分夺冠,Gemini攻破人类队伍都没解出的难题

ICPC是计算机程序设计领域的“奥林匹克”。今年GPT - 5满分、Gemini 2.5 Deep Think解10题,达金牌水准,超越人类强队,标志AI在算法竞赛“超车”,证明其具备临场推理等能力。

AI科技大本营
推荐文章7

如果生活是一场“拟像”,爱和痛苦也是假的吗?

豆瓣读书联合南京大学出版社·守望者,邀四位嘉宾围绕《拟像拟真》,结合文艺案例生活现实,探讨波德里亚思想在当下的重要性及“拟像世界”。嘉宾们分享接触波德里亚的经历,解析“拟像”概念、其在文艺作品中的呈现及理论困境。

豆瓣读书
算法论文7

宇宙尺度压缩:Scaling Law的边界,柏拉图表征收敛于物质和信息交汇,解决PNP问题,Simulation假说……

超对称公司在BigBang - Proton实现跨尺度跨结构科学多任务学习,提出宇宙尺度压缩构想。文章论证其科学基础、工程可行性意义,探讨Scaling Law边界,还给出宇宙尺度压缩计划和相关假设。

AI科技大本营