「性能工程」共找到 2606 篇相关文章
源神阿里!图像生成Ovis-Image再开源,7B小参数媲美GPT-4o和20B开源模型
阿里Ovis团队发布Ovis - Image,7B参数文本到图像模型,在文本渲染任务媲美GPT - 4o和20B + 开源模型。它架构优化、数据工程精细、训练范式独特,实测数据表现佳,显存占用低、推理快。
AI 芯片迎来 “三国杀” 时代?谷歌被曝截胡 Meta 芯片大单,英伟达 10% 收入遭抢,AMD 躺枪大跌
近日外媒报道,Meta 考虑采购谷歌 TPU 芯片,预计 2027 年投入使用。此消息使英伟达股价下跌,谷歌股价上涨。谷歌 TPU 有性能优势,虽 Meta 采用或面临集成挑战,但合作若成,AI 芯片竞争格局或变。
开源 VibeSDK:把一句话变成线上应用,用它一键搭好自己的 AI平台
Cloudflare VibeSDK 是开源 AI vibe coding 平台,跑在 Cloudflare 开发者生态上,支持自然语言生成全栈 Web 应用,有分阶段代码生成、交互式聊天等功能,适用于多类人群和场景,还对比了同类项目。
AI太空竞赛?英伟达H100刚上天,谷歌Project Suncatcher也要将TPU送上天
11月2日英伟达将H100 GPU送入太空,谷歌宣布开展Project Suncatcher,2027年初发射原型卫星将TPU送上天。该项目利用太阳能卫星群,可扩展AI计算规模,谷歌还分享早期研究成果,不过仍面临工程挑战。
Airbnb 的 Mussel V2:下一代的键值存储,以统一流和批处理
Airbnb工程团队推出Mussel v2,对内部键值引擎彻底重构,统一流和批处理,简化运维、扩展工作负载。它结合NewSQL后端与Kubernetes控制平面,解决了v1的局限,迁移虽有挑战但成功完成。
开源大模型SOTA又刷新!中国MiniMax M2全球排名第五,开源榜一
中国AI独角兽MiniMax发布模型M2,刷新开源SOTA。它采用混合专家架构,平衡了智能、速度和成本。在多个权威测试中表现优异,价格仅为Claude 3.5 Sonnet的8%,还提供多种部署方式和限时免费服务。
无VAE扩散模型! 清华&可灵团队「撞车」谢赛宁团队「RAE」
清华大学智能视觉团队和快手可灵团队联合推出《Latent Diffusion Model without Variational Autoencoder》,提出 SVG 框架,用预训练视觉特征编码器替代传统 VAE,解决了传统「VAE + Diffusion」范式的效率与通用性痛点。
jina-reranker-v3刷新全球重排榜,效率狂飙4.79%
jina-reranker-v3作为LLM时代向量模型,提出“最后但不晚”交互机制,解决文档检索效率与效果权衡、多语言文档重排性能与效率平衡、模型泛化能力和适应性等问题,架构与训练方案有创新。
从全局到部件:腾讯全新开源Hunyuan3D-Part和Omni
腾讯全新开源Hunyuan3D - Part和Omni。Hunyuan3D - Omni支持多模态输入,统一信号到跨模态架构提升融合鲁棒性。Hunyuan3D - Part含P3 - SAM和X - Part,分别用于部件分割与生成,在对应领域达先进水平。
Nvidia GPU深度解析
文章深度解析Nvidia的B30A(传闻)、HGX H20、H100、B200和B300(Ultra)五款GPU,从架构、性能、内存、封装工艺和应用场景等方面对比差异,助读者选合适GPU。