「视觉理解模型」共找到 8247 篇相关文章

新闻资讯8

大模型上天、马斯克发射GPU?中国团队直接建「太空超算」

2025年11月,英伟达送H100入太空,谷歌计划2027年发射81颗搭载TPU的卫星。美国欲打造太空生态闭环,中国中科天算等团队也在行动,中科天算目标是在太空建超算中心。

新智元
推荐文章8

从《塞尔达传说》理解 Agent 的上下文工程:Claude Skills 还是被低估了

Claude Skills 是为 AI 设计的「技能包」,能把复杂任务指令打包。作者认为其信息分层设计哲学是关键突破,以《塞尔达传说》为例,介绍了信息分层和按需加载理念,还阐述了三层架构及应用案例、挑战和通用原则。

Founder Park
新闻资讯7

创新中心| AI视觉创意不再拼“出图快”,而是拼“人味浓”?

北京AIGC视听产业创新中心位于朝阳区,是推动影视制作基地建设的举措。由多方参与,首创郎园运营,提供六大服务平台,截至2025年8月汇聚60余家伙伴。首创郎园拓展能力,项目延伸多地。

郎园Station
产品应用8

拜拜Claude!阿里最强万亿模型编程秒了Opus4,实测在此

阿里推出总参数达1万亿的Qwen3 - Max - Preview (Instruct),比前一代Qwen3(235B)强四倍,发布即上线。官方测评显示它打败Claude Opus 4等对手,实测其编程能力出色,后续正式版值得期待。

量子位
开源动态8

告别“炼丹玄学”:上海AI实验室推出首个大模型数据竞技场OpenDataArena

上海人工智能实验室OpenDataLab团队推出开放数据竞技场OpenDataArena,致力于将数据质量评估从“玄学”变为“科学”。它有数据评测榜单和完整可复现的数据价值验证体系,为多类需求提供解决方案,还开源了核心工具。

量子位
产品应用8

凌晨战神Qwen又搞事情!新模型让图像编辑“哪里不对改哪里”

Qwen团队发布Qwen-Image-Edit,作为Qwen-Image20B图像编辑版,能精准修改文字,还可新增、消除、重绘、修改元素,支持IP编辑、视角切换等玩法,在多方面表现出色。

量子位
产品应用8

AI「解码」古罗马,重现千年铭文真相!DeepMind新模型再登Nature

借助DeepMind推出的生成式AI工具Aeneas,考古学家面对古代碑文不再抓瞎。它是多模态生成式神经网络,能助历史学家解读、归属和修复残缺文本,还可适应其他古代语言、文字和媒介。

新智元
算法论文8

首篇潜空间推理综述!模型思考不必依赖Token,带宽暴增2700+倍

史上首篇潜空间推理综述全面总结新兴推理范式,分析循环、递归等推理形式并总结成框架。潜空间推理用潜式思维链,带宽比显式CoT提升2700多倍,还介绍无限深度推理实现途径。

量子位
算法论文8

告别盲选LLM!ICML 2025新研究解释大模型选择的「玄学」

弗吉尼亚理工大学研究团队提出 LensLLM 框架,基于 PAC - 贝叶斯泛化界限揭示 LLM 微调性能“双相演进”,可精准预测微调性能、大幅降低计算成本,为 LLM 选型提供新工具。

机器之心
产品应用8

实测腾讯Hunyuan-Image2.0,首个毫秒级实时图像生成模型

今天上午腾讯发布混元图像2.0,以“更智能、更开放、更中国”为理念。其参数规模提升,推理时间大幅压缩,实现毫秒级实时生成,还在画面质量等方面升级,新增实时绘画板功能。

带你学AI