「空间视频」共找到 1431 篇相关文章
苹果传统强项再发力,视觉领域三种模态终于统一
苹果在大模型领域常受挫,但计算机视觉研究是其强项。其研究团队提出 ATOKEN,这是首个能在主要视觉模态统一处理的分词器,兼顾重建质量与语义理解,成果朝通用视觉表征迈进一步。
人人都能炼专属Agent,上海交大开源端侧Agent全栈工具链,真实场景性能超GPT-5!
上海交大开源端侧Agent全栈工具链MobiAgent,将构建手机Agent全流程开放。它在真实场景性能超GPT - 5,还设计“潜记忆加速器”,通过三步养成Agent,评测表现出色,降低移动智能体开发门槛。
00后以1.1亿美金「掀桌」,硅谷AI将书写影视新传奇 终结制片旧时代
00后Cecilia Shen创立的Cybever转型为AI原生影视工作室Utopai Studios,首年获1.1亿美元收入。其技术经四个阶段进步,能生成高质量3D虚拟环境,还带来两部大剧,有望改变影视行业格局。
波士顿动力 | 人形机器人Atlas ,最新研究进展!
世界人形机器人运动会引发对自主机器人的讨论。波士顿动力与丰田研究院合作为 Atlas 开发大型行为模型(LBM),使其能自主完成复杂任务,研究团队展示成果并介绍模型构建流程、实践成果及研发原则。
美国知名风投 BVP 年度 AI 报告:Memory 和 Context 将是新的护城河
美国知名风投 BVP 发布《The State of AI 2025》报告,研究 20 家 AI 创业公司,梳理 2025 年 AI 创业现状,认为记忆和上下文是新护城河,还对未来趋势如浏览器竞争、视频生成等进行了预测。
Manus 对谈 YouTube 联创陈士骏:两代创业者聊 AI 创业和长期主义
本文是 Manus 联合创始人与 YouTube 联创陈士骏的对谈,涉及 AI 创业和长期主义。探讨了产品优先级确定、核心指标、竞争应对、用户留存等,还谈及硅谷创业生态及 YouTube 发展历程与收购故事。
百度搜索 10 年来最大改版,支持超千字长文本输入和 MCP 调用
7月2日,百度搜索宣布十年来最大改版,搜索框变“智能框”,支持超千字输入,集成AI写作等功能。“百看”功能、AI助手升级,接入视频生成模型MuseSteamer,还接入1.8万+MCP,提升搜索体验。
Altman 嘲讽 Meta 挖走的不是顶尖人才,OpenAI 高管首曝内幕:ChatGPT 如何让我们一夜“封神”
AI 领域人才抢夺激烈,Meta 招募 AI 人才触动 OpenAI。OpenAI CEO Altman 嘲讽 Meta 没挖到顶尖人才,还透露正评估薪酬。同时,OpenAI 播客揭秘 ChatGPT 幕后,包括名称由来、传播、内部辩论等,也谈到模型问题及应对。
ACL 2025|为什么你设计的 Prompt 会成功?新理论揭示大模型 Prompt 设计的奥秘与效能
英属哥伦比亚大学等团队剖析Prompt在LLM的CoT推理中调控模型内部信息流,构建量化Prompt搜索空间复杂度理论框架。研究解释提示有效的原因,提供设计高效提示词思路,实验验证理论框架。
AI 造谣,无人能幸免。
文章以现实中谣言传播现象为引,指出移动互联网加速谣言传播,而AI技术发展使真假更难分辨,如AI生成的图片、视频易以假乱真,还提到谷歌发布水印检测工具应对,呼吁大公司行动。