「应用构建」共找到 3776 篇相关文章
告别Transformer!北大、北邮、华为开源纯卷积DiC:3x3卷积实现SOTA性能,比DiT快5倍!
北大、北邮和华为研究提出纯卷积扩散模型 DiC,抛弃自注意力机制回归 3x3 卷积。它性能超 DiT,推理速度快 5 倍,证明精心设计的卷积网络在生成任务中也能表现卓越。
Meta为他豪掷2亿美元,上交校友庞若鸣,晒出在苹果的最新论文
苹果基础模型团队负责人庞若鸣即将加入Meta,Meta为其开出2亿美金天价。7月9日庞若鸣宣传在苹果参与的研究《AXLearn: Modular Large Model Training on Heterogeneous Infrastructure》,介绍了AXLearn系统优势、架构、实验评估等。
OpenAI反挖四位特斯拉、xAI、Meta高级工程师,目标星际之门
本周二消息,OpenAI从特斯拉、xAI、Meta等公司挖来四位工程师加入扩展团队,该团队负责“星际之门”项目,构建AI基础设施。此前Meta挖走多位OpenAI员工,OpenAI承诺正面交锋。
ICML2025|宁波东方理工大学刘野,陈云天:DragSolver:用于真实汽车风阻系数估计的多尺度Transformer方法
当汽车高速行驶,空气阻力影响车辆性能。传统风阻系数测算方法耗时久,难以满足实际需求。宁波东方理工大学等机构研究者提出DragSolver模型,能快速准确估计风阻系数,经实验验证效果优,有降本增效等价值。
苹果出手!改进GRPO,让dLLM也能高效强化学习
苹果研究团队针对扩散语言模型(dLLM)在编码任务中表现不明的问题,基于7B级代码生成MDM DiffuCoder展开研究,定制优化GRPO提出coupled - GRPO算法,填补开源dLLM训练和推理机制空白。
数据「熵增」时代,AI 如何以标准重构治理秩序?
Agent热潮下数据分析与治理有短板,Gartner预测到2027年多数数据治理举措或失效。瓴羊Dataphin高级技术专家周鑫阐述以数据标准为核心的数据治理方法论及AI赋能自动化治理实践路径。
文本分类重大创新:持续学习新增类别,不会灾难遗忘
在生成环境中,传统文本分类方法新增业务标签需从头训练,易致知识灾难性遗忘。今天介绍的自适应分类器,通过四项创新,可实现动态类添加和持续学习,而不会发生灾难性遗忘。
啊?豆包居然也开始卷AI编程了?
作者体验发现豆包更新了“应用创造1.0”标识的AI编程功能。该功能不仅能生成代码,还能可视化修改网页结果,用户操作轻松,降低了AI编程门槛,体验远超其他同类产品。
A 路径 VS B 路径:先攻新加坡还是直取美国?中国科技出海的生死选择题
文章围绕中国科技出海展开,对比 A、B 路径,分析中美市场特点,指出中国软件市场是试炼场,还阐述开源项目全球化路径,认为新加坡可作出海首站,最后推荐 AICon 北京站活动。
每一幕皆可控!字节发布多主体视频生成神器,人人皆主角
字节发布多主体视频生成神器MAGREF,基于一张参考图像,能生成主体高度一致的视频,多人同台也不串脸。它采用三阶段数据处理流程,构建在DiT架构上,实现复杂视频生成任务。