「混元3D 2.1」共找到 3824 篇相关文章
DeepSeek 推出快速模式和专家模式
DeepSeek web 端灰度测试快速模式和专家模式,快速模式用于日常会话,专家模式适合复杂任务,但不支持文件上传,上下文仅 128k。目前两模式能力与 v3.2 没差别,或为 v4 做准备。
Meta华人实习生搞出超级智能体!自己写代码实现自我进化
Meta研究团队论文结合哥德尔机思想与达尔文开放算法,提出达尔文哥德尔机,进而定义超级智能体Hyperagents。它能持续自我迭代,实现元学习,实验证明其能有效自我提升,且改进有迁移性。
DeepSeek又又又又发新论文了!这一次,他们重构了AI看图的方式
DeepSeek发布论文DeepSeek - OCR 2,指出传统AI看图方式有误,提出视觉因果流概念。其两阶段级联推理解法效果显著,还可能整合进即将发布的DeepSeek V4,有望实现原生多模态。
谷歌月Tokens消耗量领跑全球了:1300000000000000(别数了是千万亿)
谷歌月处理Tokens用量达1.3千万亿,较一年前的9.7万亿大幅增长。横向对比,谷歌在该指标上远超微软等大厂。Tokens消耗量可衡量模型多方面能力,谷歌为行业树立新标杆。
多模态RAG哪家强?9 个 Embedding、4 类 MLLMs、4 大框架实景比拼
现有文档 RAG 评测存在不足,华南理工和华科推出 DOUBLE - BENCH 进行多模态 RAG 实战评测,结果显示检索是瓶颈,模型爱胡说。快手开源 Keye - VL - 1.5 - 8B,PaperAgent 有实操指南。
ACL 2026|证据摊开看,场景图画清:让流式视频大模型拿捏「何时开口」
随着多模态和大语言模型发展,人类与 AI 交互走向共生。现有视频大模型难把握响应时机,西北工业大学等团队在 ACL 2026 提出 Response - G1 框架,实验显示其提升了模型性能。
马斯克狂烧14万亿,5000万H100算力五年上线!终极爆冲数十亿
马斯克宣布5年内实现5000万张H100的算力,成本超2万亿美元。他已有Colossus超算集群,Grok系列模型也展现强大实力。目前Colossus 2在分批落地,供电采取多元化措施。
12秒生成1万token!谷歌推出文本「扩散模型」Gemini Diffusion,研究员:演示都得降速看
谷歌将图像生成常用的“扩散技术”引入语言模型,推出Gemini Diffusion,12秒能生成1万tokens,速度比Gemini 2.0 Flash - Lite更快。它通过逐步优化噪声学习生成输出,目前是实验性演示,可申请体验。
成本砍半!国产黑马攻破机器人「瘫痪」难题,大厂纷纷上车
深圳机器人产业生态优越,产业链完整。小象电动聚焦轴向磁通路线,实现技术突破,累计出货近7万台,进入华为等大厂供应链,完成超亿元融资,体现深圳产业链整体优势。
ICCV 25 Highlight | 扩散过程「早预警」实现6x加速,AIGC生图的高效后门防御
随着AIGC图像生成技术流行,后门攻击威胁开源社区,传统防御技术难适配。本文作者来自多所高校,提出输入级防御框架NaviT2I,基于神经元激活差异检测样本,加速检测,性能优。