「性能优化」共找到 2844 篇相关文章
无VAE扩散模型! 清华&可灵团队「撞车」谢赛宁团队「RAE」
清华大学智能视觉团队和快手可灵团队联合推出《Latent Diffusion Model without Variational Autoencoder》,提出 SVG 框架,用预训练视觉特征编码器替代传统 VAE,解决了传统「VAE + Diffusion」范式的效率与通用性痛点。
谷歌最强AI,被港科大开源超了?让海外创作者喊出「King Bomb」的P图大杀器来了
图像编辑与生成模型爆发,冲击Photoshop地位。港科大贾佳亚团队开源DreamOmni2,优化升级多模态指令编辑与生成能力,效果获海外创作者认可,还在实测中表现出色,其采用创新技术方案构建多模态生成体系。
锁死一致性!Vidu Q2「参考生」可算来了,新功能强到离谱,APP全面进化
生数科技Vidu Q2「参考生」功能全球正式上线,APP端全面改版。新上线「视频延长」功能,最长扩展5分钟,还在一致性、速度、成本等方面优化,在镜头语言、语义理解等表现出色,APP社交体验好。
jina-reranker-v3刷新全球重排榜,效率狂飙4.79%
jina-reranker-v3作为LLM时代向量模型,提出“最后但不晚”交互机制,解决文档检索效率与效果权衡、多语言文档重排性能与效率平衡、模型泛化能力和适应性等问题,架构与训练方案有创新。
国产手机正从底层重构安卓!vivo版AI OS亮相了
在vivo开发者大会上,OriginOS 6正式亮相,AI功能全面更新,还首次上线Live Photo的AI消除。它用自研技术重构安卓底层核心,首发蓝河流畅引擎,从计算、显示、存储三大模块优化。
从全局到部件:腾讯全新开源Hunyuan3D-Part和Omni
腾讯全新开源Hunyuan3D - Part和Omni。Hunyuan3D - Omni支持多模态输入,统一信号到跨模态架构提升融合鲁棒性。Hunyuan3D - Part含P3 - SAM和X - Part,分别用于部件分割与生成,在对应领域达先进水平。
Prompt的尽头,居然是MBTI。
文章介绍了用MBTI人格优化大模型对话的技巧。论文《心理学增强AI智能体》证明给AI一个MBTI人格很有用,不同人格AI处理任务表现各异,还能组建性格互补的AI团队完成不同工作。
Nvidia GPU深度解析
文章深度解析Nvidia的B30A(传闻)、HGX H20、H100、B200和B300(Ultra)五款GPU,从架构、性能、内存、封装工艺和应用场景等方面对比差异,助读者选合适GPU。
Qwen3-Next全新架构,32K场景MTP吞吐提升10倍
随着模型大小和上下文长度增加,为应对成本和部署挑战,Qwen3 - Next有突破性架构创新,解决上下文长度和总参数缩放问题。它采用混合注意力、超稀疏MoE等,MTP机制让其长上下文推理吞吐量比前身高10倍以上。
扎克伯格的豪赌初见成效?Meta新方法让LLM长上下文处理提速30倍
Meta Superintelligence Labs提出REFRAG高效解码框架,解决LLM长上下文输入效率瓶颈。它通过四步流程优化解码,让首个token生成时间加速达30.8倍,扩展上下文,且精度不降反升,不过价值待实际检验。