3DMEM - BENCH」共找到 2123 篇相关文章

产品应用8

灭霸带着复联放烟花!16秒,让手搓 AI 视频拥有大片即视感

生数科技的Vidu Q3超越Sora 2,位居全球第二、中国第一。它能16秒声画同出、叙事能力强、镜头和文字渲染出色,还降低了视频制作门槛,可用于漫剧、短剧、影视剧制作。

AI科技评论
新闻资讯7

OpenAI「至暗时刻」已至,谷歌一剑封喉奥特曼

昔日盟友倒戈Anthropic,宿敌谷歌技术反超,OpenAI统治地位受威胁。谷歌Gemini 3表现出色,OpenAI技术领先优势缩小,财务也面临压力,但奥特曼表示会推出新模型追赶。

新智元
产品应用8

Agent+Code,打开AI开发新范式

当下企业级AI叙事逻辑转变,传统AI应用有瓶颈。京东云在JDD 2025大会提出“深度应用”理念,推出“Agent+Code”新范式,其包含JoyAgent 3.0和JoyCode 2.0,还通过开源引领行业创新。

InfoQ
产品应用7

文档解析OCR全新升级,追平Gemini2.5pro,超越MinerU、碾压Qwen2.5VL-72B

CourseAI介绍PP - StructureV3实战、能力、性能与架构。它在通用版面解析等方面能力强,更新PP - OCRv5提升准确率,超主流OCR方案,轻且速度快,但遇特殊情况需重新训练。

CourseAI
开源动态7

DeepSeek最新模型意外泄露~

DeepSeek最新模型DeepSeek-V3-0526疑似泄露,消息源于https://docs.unsloth.ai/basics/deepseek-v3-0526-how-to-run-locally ,其性能媲美GPT - 4.5 / Claude Opus,或成最强开源模型,信息若属实将很快发布。

PaperAgent
新闻资讯8

李飞飞发布:全球首个多模态世界模型

李飞飞团队的World Labs发布全球首个多模态世界模型Atlas,是多模态自回归扩散Transformer,能相机控制生成、3D重建等,已向部分伙伴开放早期访问,未来将成底层模型。

量子位
开源动态8

告别评估乱象!首个视觉解释综合性基准发布,附人类真值 | KDD'25

埃默里大学团队推出首个视觉解释基准Saliency - Bench,构建8个任务的数据集,提供标准化评估流程与开源工具包,解决评估缺乏标准等问题,推动可解释AI向可靠、透明发展。

新智元
开源动态8

这个春节P图不求人!小红书开源图像编辑新SOTA

今日小红书基础模型FireRed - Image - Edit亮相,在复杂编辑指令、风格化转换等核心指标表现强,在多项权威测试达SOTA。该项目代码等已开源,模型权重将开源。团队还推出RedEdit Bench评测方案。

量子位
新闻资讯8

OpenAI和DeepMind大佬离职联手,誓用AI科学家实现室温超导!已融3亿美元

OpenAI后训练负责人和DeepMind的AI4S大佬离职成立Periodic Labs,专注用AI Agent改造科研,攻克室温超导等难题,已获3亿美元融资。团队目标是培养AI科学家,构建自主实验室,还将应用于产业。

新智元
开源动态8

阿里开源QwenLong-L1:首个以强化学习训练的长上下文推理大模型

LRMs扩展到长文本场景是挑战,阿里开源QwenLong-L1框架,是首个用强化学习训练用于长文本推理的模型。它含三个核心组件,QwenLong-L1-32B性能领先,与Claude-3.7-Sonnet-Thinking相当。

PaperAgent