「端到端生成」共找到 4192 篇相关文章
VLM剪枝新SOTA:无需重训练,注意力去偏置超越6大主流方案
常用的attention机制存在位置偏置和padding异常,影响剪枝效果。上海大学曾丹团队提出无需重新训练的attention去偏方法,在多模型、剪枝策略及基准上验证有效,为多模态模型部署提供新思路。
刚刚,谷歌DeepMind登Nature封面!人类40亿年生命代码「开源」了
谷歌AlphaGenome登上Nature封面,可一次性「读入」100万个DNA碱基对,对数千种分子特性高度预测。它已在GitHub开源,诺奖得主称未来十年AI将治愈所有疾病,其重构了生命科学底层逻辑。
2026年,腾讯正式用元宝派杀入了AI社交。
2026年开年,腾讯用元宝派进军AI社交赛道。元宝派玩法新颖,有独特社交体验,还能与元宝交互,如生成图片、总结消息、制定日程等。虽内测有小毛病,但未来可期。
GEO破圈,豆包爆火,为什么我劝你别轻易丢掉SEO?
A股GEO概念股大涨、罗永浩与豆包对话爆火,让老板和SEO朋友焦虑是否转型GEO、SEO是否凉了。作者认为GEO是未来要重视,但不能丢SEO基本功,还给出构建“SEO+GEO”双引擎的建议。
刚刚,AI企业IPO最速纪录刷新!MiniMax的技术野心,价值超800亿港元
1月9日,MiniMax挂牌上市,成全球从创立到IPO用时最短AI企业。招股书现硬核数据,ToC收入反超ToB。其技术成果多,团队年轻,但未盈利,面临与Claude Codex竞争、市场压力等挑战。
LightX2V fp4 quant kernel代码笔记
这是关于 LightX2V 里 `lightx2v_kernel` 做 FP4 量化 GEMM 的读码笔记,解释接口和约束、kernel 关键路径等问题,还介绍 NVFP4 和 MX-Formats 量化原理、代码实现,以及 LightX2V 项目中的实际使用。
上交大 × 华为小艺推出LoPA:7B扩散语言模型单样例1000+ tokens/s!
上海交通大学DENG Lab联合华为小艺团队提出无需训练的解码算法LoPA,配合自研的LoPA - Dist分布式推理系统,显著提升扩散大语言模型(dLLMs)的推理并行度和吞吐量,将推理效率推向新高度。
AI 医疗全景更新:为什么硅谷 healthcare 领域出现了最多的 AI 独角兽?
本文基于对全美700余位医疗行业高管的调研及关键人物访谈,梳理AI医疗落地路径与商业化逻辑。指出医疗行业正推动AI商业化,投资增长催生独角兽,落地呈现“非线性加速”,还介绍了投资格局、应用场景等情况。
深度拆解沐曦MXMACA软件栈功能,算力自主+生态兼容,破解国产GPU落地难题
近日,刚 IPO 的沐曦股份发布 MXMACA 软件栈 3.3.0.X 版本。该软件栈可实现多语言支持、算子自动优化与跨框架平滑适配,能让现有 CUDA 项目近乎‘开箱即用’迁移,还兼容主流 AI 框架,助力国产 GPU 解决落地难题。
求稳的安全IP,安谋科技如何守正出奇?|甲子光年
12月24日,安谋科技推出新一代SPU IP——“山海” S30FP/S30P,构建覆盖芯片底层至应用层的一栈式安全防护体系,有抗物理攻击强等五大亮点,能适配不同场景安全需求,完善产品布局。