分镜能力」共找到 3753 篇相关文章

新闻资讯7

中美AI竞争的四种未来:OpenAI情报与调查团队指出决胜点

OpenAI情报与调查团队对中美未来几年AI竞争进行推演,指出美国有资本、算力等优势,但面临电力等问题;中国靠国家意志推动,有工业协调等优势。未来博弈有四种结局,决胜看中国算力自救、全球‘朋友圈’和本土市场消化能力

AIGC开放社区
算法论文8

读万卷书,大模型就能「看」懂视觉世界?Meta揭秘LLM视觉先验的起源

Meta超级智能实验室与牛津团队新论文发现,只见过文本的大语言模型(LLM)能学到可迁移到视觉任务的先验能力。研究通过超100组受控实验、耗费50万GPU小时,揭开LLM视觉先验来源,还给出预训练数据配方。

机器之心
产品应用7

央企怎么做超级智能体?对谈中电信天翼AI:自研模型为底座,自主规划是必须,能适应千行百业才行

中国电信天翼AI发布星辰超级智能体,获2025企业级AI Agent榜单央企第一。它依托自研“星辰大模型”,具备全模态、复杂推理等能力。访谈专家指出智能体可直接产出应用,落地需嵌入主业系统,电信持续迭代模型优化它。

量子位
新闻资讯7

硅谷精英放弃生娃!MIT女记者揭秘:人类只是AI垫脚石,世界很快就毁灭

华人女记者Karen Hao出版《AI帝国》,揭露OpenAI背后隐秘真相。书中提到部AI行业技术高管因认为世界不久将不复存在而选择不育,还讲述了AI带来的诸多问题,如资源消耗、道德困境等,也指出AI公司拒绝承担现实成本。

新智元
算法论文7

3D-R1重塑三维视觉语言推理!让三维交互更智能

近年来,视觉 - 语言模型在2D图像理解有突破,但3D视觉语言模型面对复杂场景不足。为此上海大学团队提出3D - R1模型,它基于新数据集和策略构建,有强多任务三维理解能力,不过也存在进步空间。

带你学AI
新闻资讯8

英伟达再创历史纪录!Q1收入增长69%,数据中心贡献89%,游戏业务大涨42%

英伟达2026财年Q1财报亮眼,总收入441.1亿美元,环比增12%、同比涨69%。数据中心和游戏业务表现出色,别占比近89%、创新高。不过H20芯片受出口限制影响,预计二财季收入减80亿美元。

量子位
产品应用8

拆解 WorkBuddy、千问办公和豆包工作,它们其实不是同一种产品

本文作者用真实职场脏活测试腾讯WorkBuddy、阿里千问办公、字节豆包工作三款办公Agent,对比三者产品路线、执行结果和执行环境差异,揭示当前办公Agent的发展现状与局限。

AI科技评论
算法论文8

蚂蚁 | 提出代码检索/重排基准:CoREB,揭开高榜背后的三大幻觉,现已接入MTEB

蚂蚁研究人员提出代码检索与重排评测基准CoREB,解决现有基准相关性软、数据污染、任务方向单一问题。它已集成进MTEB,收录19个模型×6个任务评测结果,为代码检索模型评估提供新基线。

AINLPer
产品应用8

实测LibTV团队版:AI视频的工作室时代来了!

作者实测LibTV团队版,享用其制作皮克斯风格3D动画片段的过程,介绍团队版核心功能,如团队主体库、共享积池、权限管理等,还提及新功能,指出AI视频走向工业化,而该团队版是首个专注团队协作的工具。

花叔
新闻资讯7

当国产模型追上闭源旗舰,企业 AI 编程的真正障碍才浮出水面

过去企业AI Coding讨论多集中在模型能力等方面,DeepSeek V4出现缓解了模型问题,但更深层的代码库业务隐知识等问题浮现。合规限制使企业工具建设受阻,V4打破了模型供应瓶颈,可组织知识管理仍成难题。

InfoQ