「2D交互场景」共找到 3984 篇相关文章
Sora 2数手指翻车,奥特曼成第一批「受害者」,被AI玩成最惨打工人
Sora 2虽强大,但数手指测试翻车,模拟场景也有瑕疵。奥特曼成其首批“受害者”,AI生成视频将他玩坏。同时,OpenAI研究员对Sora应用发布存担忧,而奥特曼解释资金投入原因。
前百川智能联创焦可新创业公司曝光,新项目已上线 App Store
前百川智能联创焦可新创业公司曝光,其推出的AI语音产品“来福”已上线App Store。该产品定位AI语音电台应用,探索声音交互场景,目前仅邀测。国内大厂未推专注AI播客独立产品。
评论送书 | 想系统了解AI?先搞清楚这四件事
文章围绕系统了解AI需搞清楚的四件事展开,介绍了AI理论基础层的机器学习和深度学习,感知交互层的计算机视觉等,应用实践层的机器人学等,还提及伦理社会层的AI伦理和社会影响研究。
再封神!OpenAI掀翻AI图像生成,极度逼真,立刻商用
网传OpenAI的GPT-image-2正在灰度测试,韩国网友测试后称其生成图像可‘立刻商用’。它深度融合GPT大语言模型,生成照片更逼真,强化了提示遵循和场景理解能力,让AI图像生成进入‘实用时代’。
效率狂飙数倍后:Coding Agent已然成熟,但开放世界仍是“无人区”
2025 年被定义为 Agent 的‘工程落地元年’。MCP、A2A 协议及多智能体协同框架推动 Agent 应用爆发,但企业级落地仍面临多 Agent 协作低效等挑战。AI Coding 和自动化运维是落地较成熟领域,其终极形态观点不一。
劈柴哥和哈萨比斯亲自站台!谷歌世界模型Project Genie刷屏,幕后团队揭秘60秒不是极限,内存是巨大约束
谷歌发布世界模型原型 Project Genie,用一句话或图就能生成可玩交互的实时虚拟世界,由劈柴哥和哈萨比斯站台。它基于 Genie 3、Nano Banana Pro 和 Gemini 构建,解决了世界模型长期以来的短板,目前处于实验阶段。
百度 TURA 三阶段架构:让 AI 检索 “动” 起来
现有检索增强生成(RAG)系统只能读取已索引的静态网页,无法满足用户实时数据需求。百度 TURA 架构用工具调用将 RAG 升级为动态交互,分检索、规划、执行三阶段,已在百度亿级流量场景跑通。
阿里云 CIO 蒋林泉:AI 大模型时代,我们如何用 RIDE 实现 RaaS 的首次落地?
阿里云 CIO 蒋林泉分享大模型落地实践,指出 AI 是时代“大电梯”,企业需迅速搭乘。介绍阿里云数字人多场景应用成果,提出 RIDE 方法论助企业落地,还剖析翻译与 Agent 模式要点及 E2E 落地关键。
从 IROS 2025谈起,智能机器人何时迎来「GPT式爆发」? | GAIR Live 019
雷峰网邀请三位嘉宾解码IROS 2025背后具身智能前沿趋势。探讨了IROS现场变化、具身智能认知升级、Sim2Real实用边界、商业落地路径等,还预测具身智能“GPT时刻”或由“World Model+VLA”组合推动。
Zvec: 开箱即用、高性能的嵌入式向量数据库
Zvec是轻量级嵌入式向量数据库,为终端侧设计,有开箱即用等四大优势。它基于Apache 2.0协议开源,能满足向量检索在多场景需求,相比现有方案功能更全、资源管控强、性能出色,后续还将持续迭代。