「3D空间理解」共找到 3058 篇相关文章
童年的滚球兽「走进」现实?华为天才少年创业,全球首个虚实融合的实时交互视频模型来了
Xmax AI 推出全球首个虚实融合实时交互视频模型 X1,通过手机摄像头实现虚拟与现实融合。它有四大玩法,操作简单。但面临多技术挑战,Xmax AI 团队实力强,给出硬核技术方案,愿景是让 AI 融入生活。
模力工场 027 周 AI 应用榜:从“一键生成”到“自动交付”,最会帮你干活的 AI 榜单来袭
模力工场第027周AI应用榜揭晓,上榜产品迈入新阶段,能接管关键环节。如Manus交付调研报告,秒哒将想法变应用,邀虾打通跨境电商流程。还介绍了上榜应用、趋势及上榜机制等。
被锁死的想象力:当AI成了科研本身,人类只能是观众
新智元报道,Steve Newman指出,我们对未来想象力或被锁死,AI一旦跨过「适应性阈值」,将进入「不可认知时代」。他提出「谷神星实验」,揭示AI超越人类节奏后,人类社会不再是必经之路等残酷真相。
谷歌AI逆袭背后的头号功臣
2025年谷歌AI打翻身仗,Nano Banana和Gemini 3 Pro两款模型抢了OpenAI大量用户。背后功臣Josh Woodward临危受命,让Gemini应用打败ChatGPT。他还孵化多款AI产品,重视细节与社会责任。
完爆ChatGPT!谷歌这招太狠:连你的「阴阳怪气」都能神还原
谷歌发布Gemini 2.5 Flash原生音频模型,可保留语调进行实时语音翻译,实现拟人化交互。还具持续监听、风格迁移等功能,提升开发者所需的函数调用、指令遵循等能力,另有实验产品Disco。
Runway深夜炸场:一口气发布5大更新,首个通用世界模型来了
主攻AI视频与多媒体生成技术的独角兽Runway发布5大更新,包括旗舰视频生成模型Gen - 4.5、首个通用世界模型GWM - 1等,展示了其在通用世界模型上的野心,刷新了视频生成指标。
打工15年,被大厂裁4次了
美国老李15年被微软、Meta、苹果等大厂裁4次。2025年众多科技公司裁员,AI推动岗位变革,企业用懂AI员工换不懂的。失业潮全球都有,有人转型成功,老李最终入职丰田子公司。
让AI评测AI:构建智能客服的自动化运营Agent体系
文章介绍智能客服发展,从传统机器人客服到基于AI原生的智能客服。重点探讨对话效果评测,搭建运营Agent平台,实现服务闭环。还提及评测落地方法、难题及解决措施,最后阐述AI在服务链路提效和分析转人工原因的作用。
当AI无所不能,你如何不可替代?
硅谷裁员潮,AI 普及让职场人焦虑被替代。《太稳不太稳》直播中,万维钢与霍太稳探讨人类核心竞争力,指出人类主动性等是 AI 无法复制的价值,还给出各职业应对建议及用 AI 提效方法。
让VLM学会「心中有世界」:VAGEN用多轮RL把视觉智能变成「世界模型」推理机器
当前VLM智能体面对复杂视觉任务表现不佳,美国西北大学等机构联合研究成果VAGEN,提出创新强化学习框架,奖励正确思考过程,让VLM在行动前构建内部世界模型,效果超多款闭源大模型。