「数据架构」共找到 3994 篇相关文章
从哲库到小米,从造芯之“死”到造芯之生
文章回顾华为、小米、OPPO造芯历程,分析OPPO哲库夭折与小米重启造芯的原因。指出小米重启造芯有财务、组织架构、经验等优势,且赶上制裁“窗口期”,AI时代也需自研芯片。
Index-AniSora:B站开源动画生成模型,斩获多项SOTA入选IJCAI25
B站开源动画视频生成模型Index - AniSora,支持多种二次元风格视频镜头一键生成。基于AniSora系统,全面提升动画生产效率与质量,开源内容丰富,还构建奖励数据集和奖励模型提升对齐性能。
刚刚,何恺明团队新作,「嵌入式语言流」ELF来了
何恺明团队提出ELF模型,将扩散过程置于连续向量空间,只在最后翻译成词。它用一个网络实现去噪和解码,引入自条件机制。实验显示,ELF用不到其他方法十分之一数据,生成质量全面领先。
DeepSeek多模态新范式:一张图压缩7056倍,思考能力反超GPT和Claude
DeepSeek上线多模态并开源新范式技术。该研究让AI用视觉原语思考,弥合语言与视觉指代鸿沟。它构建紧凑模型架构,信息压缩率达7056倍,训练分三阶段,测试中表现出色,也存在局限。
GPU时代落幕?硅谷巨头集体「叛逃」,英伟达1500亿疯狂自救
去GPU化浪潮来袭,AI竞争焦点从算力规模转向能效比与延迟。谷歌TPU性能提升且成本低,走向商用受青睐。英伟达天价收购Groq,多元架构正终结GPU单极时代,国产芯片需底层创新。
今夜无显卡!老黄引爆Rubin时代,6颗芯狂飙5倍算力
CES 2026上,英伟达黄仁勋发布Vera Rubin超算架构,推理性能比Blackwell提升5倍,训练性能提升3.5倍,成本降10倍,已投产,下半年商用。还展示自动驾驶模型等,且无新显卡发布。
DeepSeek悄悄开源LPLB:用线性规划解决MoE负载不均
昨天,DeepSeek 在 GitHub 上线新代码库 LPLB 解决 MoE 负载不均。它利用线性规划算法优化专家并行工作负载分配,能处理动态波动,但也存在忽略非线性成本等局限,对 MoE 架构训练加速有参考价值。
大模型幻觉检测新方法:实时高亮不确定内容
来自苏黎世联邦理工学院等机构团队,开发流式幻觉检测器,能在生成过程中即时标记幻觉实体。核心是识别具体“实体”是否虚构,实验表现出色,团队已将数据集和代码开源,有局限但应用前景好。
GPT-5认为这个模型是开源界的Claude 3.5——陈天桥朋友圈里的 MiroMind ODR 让我眼前一亮
陈天桥用GPT - 5评测自家开源模型MiroMind ODR,让其应对复杂问题。GPT - 5评价该模型是“开源界的Claude 3.5”,其能力让GPT - 5“点赞”,有闭源模型稳定性和可用性,还具全开放架构。
昨晚,云计算一哥打造了一套Agent落地的「金铲子」
亚马逊云科技在纽约峰会推出全新 AgentAI 方案,涵盖开发架构、多模型支持及多种工具升级。如 AgentCore 改变开发规则,Strands Agents V1.0 降低多 Agent 协作门槛,还推出 Kiro 等应用,推动 Agentic AI 落地。