「相机位姿估计」共找到 363 篇相关文章
赛博义父Tibo爆料:谷歌早一年就做出了ChatGPT,硬是没敢发!
OpenAI的Codex负责人Tibo爆料,谷歌早一年做出类似ChatGPT的LMChat,但因怕冲击搜索业务没敢发。谷歌多位核心人才跳槽,这就像施乐错过图形界面,谷歌在AGI竞争中落后。
2026年,AI初创全球化的「变与不变」|沙龙招募
当OpenClaw掀起开源浪潮、Agent应用频现,AI团队面临全球化命题。量子位将发起出海沙龙,聚焦出海早中期决策与路径,招募全球化实践者、参与者和投资机构,设置多环节交流。
一等奖20万,大佬们出题,最硬核视频生成全球挑战赛开启!
首个AI视频生成全球挑战赛来袭,多位大佬发起,20万大奖待拿。大赛聚焦AI视频生成「一致性」挑战,设主赛道和创意赛道,分别面向技术派和创作者,旨在推动视频生成技术发展。
李飞飞发布:全球首个多模态世界模型
李飞飞团队的World Labs发布全球首个多模态世界模型Atlas,是多模态自回归扩散Transformer,能相机控制生成、3D重建等,已向部分伙伴开放早期访问,未来将成底层模型。
全网惊了!陶哲轩带AI下场,33分钟「盲证」数学
菲尔兹奖得主陶哲轩携手ChatGPT打造开源数学概念验证工具,数天迭代至2.0版,可全自动或半自动证明。还支持渐近估计,上手简单、可扩展性强。此外,他用AI 33分钟“盲做”一页数学证明,重塑研究范式。
SIGGRAPH Asia 2025|电影级运镜一键克隆!港中文&快手可灵团队发布CamCloneMaster
香港中文大学与快手可灵团队联合提出运镜可控视频生成框架CamCloneMaster,引入‘参考即用’范式,告别对相机参数依赖。其训练、测试代码和数据集均已开源,在各项指标上优于SOTA方法。
西湖大学张驰团队:从视觉合成到空间理解,视频 AI 正在「转向」丨CVPR 2026
过去两年视频生成发展近成熟,但多数模型缺乏空间结构稳定建模能力。西湖大学AGI Lab团队提出论文,将问题落回推理阶段,让相机轨迹成约束条件,推进视频生成到三维结构约束建模。
2026年中国AI应用全景图谱报告发布
量子位智库发布2026年中国AI应用全景图谱报告,记录变革时刻横截面。国内AI应用活跃,不同赛道表现有差异。报告还指出Agent化、模型普惠化等五大趋势重塑行业,揭示产业向产品及商业化转变趋势。
突发!xAI联创杨格过劳病离职,给马斯克干活压力山大
xAI联创杨格因长期高强度工作患莱姆病离职。此前已有多位核心成员离开。马斯克强调速度的管理风格使员工压力大,其公司高管更迭率高,不过也有人认为这能筛选出能力强的成员。
具身智能「全明星日」来袭!智源组局30+行业掌门人,激辩机器人终极命题
2025年是具身智能「爆发之年」。智源具身2025 OpenDay上,30多位行业大佬激辩,议题包括具身架构、数据获取、硬件瓶颈、应用落地等,智源还开源多项成果助力行业发展。