「离散扩散架构」共找到 2051 篇相关文章
何恺明改进了谢赛宁的REPA:极大简化但性能依旧强悍
扩散生成模型在建模复杂数据分布表现出色,但与表征学习领域关联不大。谢赛宁团队提出REPA,不过较麻烦。何恺明团队提出Dispersive Loss,简化且性能强,无需预训练等,适用于多种模型。
谷歌Gemini Diffusion:1500 token/秒,快如闪电!
谷歌DeepMind在I/O 2025上推出实验性模型Gemini Diffusion,将扩散技术用于文本生成。它每秒能生成约1500个token,比Gemini 2.0 Flash - Lite快5倍,具备高响应速度、文本连贯性等优势。
RAG 2.0 深入解读
文章深入解读RAG 2.0,指出其虽在多行业落地,但面临多模态处理、检索质量等挑战。还介绍架构升级,阐述检索、重排序等关键技术,最后探讨统一多模态大模型、安全等发展方向及挑战。
0.7nm制程芯片问世!摩尔定律又活了
IBM推出全球首款0.7纳米芯片制程节点,指甲盖大小芯片可集成近1000亿晶体管,性能或能效大幅提升。靠‘纳米堆叠’架构实现突破,最早5年内量产,有望让芯片微缩延续十年。
π0.7发布,VLA押出了机器人的GPT-3时刻
今天凌晨,Physical Intelligence发布VLA模型π0.7,首次在机器人领域证明组合泛化。它用多样化prompt处理多样数据,涌现多种能力,还证明数据过滤可能是伪问题,架构基于前作,推动VLA回归。
除了AGI已来和死亡,我们为黄仁勋重磅访谈总结了50条AI最前沿判断
2026年3月23日黄仁勋在播客访谈提出众多前沿判断,如AGI已来,Agent时代开启;智能会成商品,人性才稀缺;推理成本高;合成数据非旁门左道等,还谈及公司架构、算力、供应链等话题。
告别AI「鬼画符」!一行指令「复活」王羲之、苏轼,带连笔、懂排版,项目已开源丨ICLR'26
UniCalli由香港科技大学(广州)等团队推出,是全新统一扩散框架,能精准生成书法排版和连笔,将书法生成和古籍识别统一,工作被ICLR2026接收,代码、数据集开源,还有在线Demo。
字节跳动开源视频生成模型Alive:12B参数,个人电脑也能跑
字节跳动开源视频生成模型Alive,12B参数,支持四种模式,硬件门槛低。在评测中表现出色,技术架构精心设计,解决音视频同步等问题,虽有小瑕疵,但更适合普通玩家。
整体工程:有机解决复杂演进系统中的问题
软件开发中项目延期、架构偏离等问题,常由非技术力量导致。整体工程将这些力量纳入技术决策,能解决复杂演进系统问题,还介绍了实践方法及好处。
OpenAI产品线拉出来吓我一跳,奥特曼不愧是YC出身
风投人Deedy整理OpenAI产品线,其有协作工具、新型AI等众多产品。OpenAI先靠ChatGPT抓用户,再扩张生态,变现、构建生态、布局未来,但也被指离AGI更远,只将AI融入现有架构。