混合视觉标记器」共找到 894 篇相关文章

开源动态7

腾讯助力Deepseek完善DeepEP,RoCE提升100%,InfiniBand提升30%

Deepseek团队合并腾讯提交的代码完善DeepEP,称有巨大速度提升,RoCE提升100%,InfiniBand提升30%。DeepEP是为混合专家模型和专家并行设计的通信库,有多项创新特性,适合现代AI应用。

CourseAI
新闻资讯7

GPT-5.4意外泄露!OpenAI最新模型瞄准这2大能力突围

GPT - 5.4疑似泄露,此前在OpenAI编码助手、GitHub代码拉取请求等多处有踪迹。传闻其将搭载200万Tokens上下文窗口,具备像素级精准视觉分析能力,不过也可能是炒作,网友关注其准确率。

量子位
新闻资讯7

Anthropic偷偷在Claude Code中植入了隐形代码,只为识别中国用户。

近期Claude大面积封号,国内用户几乎被封完。Reddit大佬逆向Claude Code发现,其会静默读取本地信息,通过操作系统时区和环境变量识别中国用户,用隐写术传输标记数据,引发开发者不满。

数字生命卡兹克
新闻资讯7

DeepSeek深夜更新后自曝:我是V4(?!)

DeepSeek网页端深夜大更新,推出「快速模式」和「专家模式」,还有「视觉模型」开启灰度测试。虽官方未说明,但网友推测专家模式可能是V4或V4 Lite,完整版V4或许不远。

量子位
算法论文8

中山大学梁小丹团队论文:让视频生成从「看起来真实」到「物理上正确」丨CVPR 2026

中山大学梁小丹团队提出《ProPhy: Progressive Physical Alignment for Dynamic World Simulation》,通过分层建模和逐步对齐,引入视觉语言模型作监督,解决视频生成模型物理建模问题,提升物理正确性和视频质量。

AI科技评论
算法论文8

GPT-4o-Image仅完成28.9%任务!上海AI实验室等发布图像编辑新基准,360道人类专家严选难题

上海人工智能实验室等团队针对图像编辑AI提出问题,推出RISE任务及配套评测基准RISEBench。测试九个视觉编辑模型,结果显示当前模型完成复杂指令能力欠缺,闭源与开源差距大。

量子位
产品应用8

新晋顶流Agent颠覆设计师!Lovart一手实测来了:是该刷屏爆火

新晋顶流Agent Lovart火爆全网,可一句话搞定专业视觉设计,支持二次编辑。量子位实测其设计能力强,背后是多模型融合调度。它定位人机协作,适合中小企业,官网可申请内测。

量子位
算法论文8

DeepSeek又又又又发新论文了!这一次,他们重构了AI看图的方式

DeepSeek发布论文DeepSeek - OCR 2,指出传统AI看图方式有误,提出视觉因果流概念。其两阶段级联推理解法效果显著,还可能整合进即将发布的DeepSeek V4,有望实现原生多模态。

花叔
产品应用8

你奶奶也能看懂:DeepSeek-OCR的秘密。

本文介绍DeepSeek-OCR,它并非普通OCR工具,而是用“上下文光学压缩”将大量文本信息转为少量视觉Token。其架构含编码器和解码器,压缩效果惊人,重新定义AI“记忆”,或改变AI认知方式。

AI大模型应用实践
新闻资讯7

「AI生成的内容全部加水印」OpenAI、Anthropic、Google都签了

OpenAI、Anthropic、Google等公司签署欧盟《AI生成内容透明度行为准则》,承诺推进AI生成内容标记与检测。Claude已公布落实方案,文本水印早有先例,但「水印」可信度遭质疑。

机器之心