「扩散Transformer架构」共找到 2157 篇相关文章
以孔子命名,超越Claude 4.5 Opus,Meta发布工业级自我进化AI软件工程师CCA
Meta与哈佛联合推出工业级软件工程师CCA,它是一套让AI在工业级代码库协作的方法论,解决长上下文推理等难题。其三维解耦设计、精细记忆机制、自我进化能力获数据验证,还适合引入强化学习。
普林斯顿大学等Nature揭秘:人类大脑与大语言模型共享同一套语言处理时钟
普林斯顿大学等机构研究发现,大语言模型层级计算序列精确映射人类大脑处理语言的毫秒级时间动态,其与人类大脑理解语言的先后顺序高度一致,为理解大脑和开发神经网络架构开辟途径。
AutoDev 3.0 → Xiuper:咻!全平台、全流程智能体编程平台
AutoDev Xiuper 3.0.0-alpha 发布,它是基于 Kotlin Multiplatform 构建的全生命周期 AI 编程助手,覆盖完整开发流程且支持全平台运行。其名 Xiuper 寓意 AI 自然“存在”于开发流程,承载多平台架构新变化。
Light-X来了!全球首个「镜头×光照」双控4D视频生成框架,单目视频秒变电影级
新加坡南洋理工大学等科研机构联合推出Light - X,全球首个「镜头×光照」双控4D视频生成框架。它解耦相机与光照,在扩散模型中融合,还构建Light - Syn数据管线,实验显示其效果显著优于现有方法。
模力工场 022 周 AI 应用榜:记忆型 AI Infra PowerMem 登顶榜首,本周 AI 应用全面升级“长期主义”
模力工场 022 周 AI 应用榜揭晓,PowerMem 登顶。榜单涵盖底层基础设施与各类应用,体现 AI 满足多样需求趋势。采访 PowerMem 开发者,介绍其功能、优势、使用反馈及未来目标,还推荐了 GetDraft 起稿等应用。
世界模型和具身大脑最新突破:90%生成数据,VLA性能暴涨300%|开源
国产世界模型玩家获突破,VLA模型性能涨300%,90%训练数据由世界模型生成。极佳视界开源GigaWorld - 0及训练框架,在多方面优化,经对比性能领先,还验证其生成数据对具身任务的提升作用。
Telegram创始人搞了个狠活:100%隐私的去中心化AI网络
Telegram创始人帕维尔·杜罗夫推出专注机密AI计算的去中心化网络Cocoon,或终结中间商垄断。它基于TON区块链,有三层架构,四步完成AI查询,但面临延迟和竞争挑战,未来将采用DAO治理。
IDE?字节TRAE搞了个大升级,现在能全流程开发了
国内首个原生AI IDE TRAE推出SOLO正式版,升级为集成多智能体协同架构与全流程开发工具链的AI协作平台。新增SOLO Coder智能体,三栏布局更高效,升级思路贴合开发者需求。
从VLA到RoboOmni,全模态具身新范式让机器人察言观色、听懂话外音
复旦大学等联合推出全模态端到端操作大模型RoboOmni,统一多模态,实现动作与语音协同控制。它重新定义机器人交互范式,让机器人具备“察言观色”能力,还构建了OmniAction数据集,实验表现全面领先。
美团杀入视频生成模型赛道,LongCat-Video 136亿参数媲美顶尖模型,效率提升10倍
美团LongCat团队发布LongCat - Video基础视频生成模型,有136亿参数量,多任务表现出色。它核心亮点多,还建立了数据处理流水线,采用特殊架构和训练方法,提升了生成效率,性能媲美顶尖模型。