「全场景」共找到 3538 篇相关文章
实测可灵3.0 - 属于每个人的导演时代。
可灵更新至3.0版本,将视频模型能力提升到新高度。它有分镜和语言两大升级方向,还升级了Omni模型。可灵3.0适合文生视频等,3.0 Omni擅改视频,二者结合能覆盖多数视频生成场景。
模型训练篇|多阶段ToolRL打造更可靠的AI导购助手
当前,AI导购成电商与服务平台新风口,但芝麻租赁场景挑战大,存在需求难匹配等痛点。为此打造AI导购智能体“租赁小不懂”,经架构升级和算法优化,性能提升,还探索了MoE训练和推理优化。
CES 2026趋势照进现实:算力引擎RK182X重塑千行百业,瑞芯微AI生态大会共建落地生态
CES2026推动AI走向现实应用,瑞芯微RK182X作为AIoT2.0算力引擎,在视觉语言和大语言模型表现卓越,支持Qwen3 - VL系列模型。它在音频体验、多领域赋能出色,瑞芯微还构建产业生态促场景落地。
500万次围观,1X把「世界模型」真正用在了机器人NEO身上
1X公司为机器人NEO引入1X World Model,使其学会‘想象’。该模型借助视频预训练,不依赖大规模机器人数据和遥操作演示,能泛化到新场景。实验显示其在多任务上表现不错,但精细操作有挑战。
李飞飞又被超越了?百万「普通视频」打造通用4D世界模型!
全行业为昂贵多视角数据发愁时,中科院和CreateAI推出NeoVerse,用百万单目视频打开4D世界模型大门。它抛弃多视角数据和离线预处理,解决扩展性瓶颈,在重建速度、生成质量等方面表现出色,有丰富下游应用。
下一代搜索:通过 MCP 实现 AI 与 OpenSearch 的融合
本文探讨 MCP 如何在 AI 代理和 OpenSearch 间建桥梁,创建智能搜索应用。介绍搜索从关键词到代理的演变,还通过电商、可观测性等场景演示代理搜索实践,显示 MCP 与 OpenSearch 结合能带来上下文感知的智能数据访问体验。
腾讯AI战略大升级:组织架构重组与混元世界模型1.5发布
2025年12月17日,腾讯宣布两项重大举措,一是重组AI组织架构,成立新部门并任命首席AI科学家;二是发布混元世界模型1.5,能实时生成可交互3D虚拟世界,应用场景广泛,或引领行业进入‘AI原生’新阶段。
12月首炸!可灵 O1 正式发布,全球首个统一多模态视频大模型,强得可怕!
12月快手旗下可灵发布全球首个统一多模态视频大模型Kling O1,标志AI视频进入“全流程语义控制时代”。它将多种视频创作能力统一,有全能引擎等五大亮点,性能对比优势明显,让AI视频生成更可控。
靠创始人亲自假扮AI起家,如今估值10亿美元!印度CEO公开反内卷:从不在10点前起床,也不开例会
AI笔记创业公司Fireflies估值达10亿美元,其创始人曾人工假扮AI参会。CEO Krish Ramineni反内卷,让员工全远程自由工作。此“创业血泪史”公开后引争议,有人批有伦理风险,也有人认为是早期创业常态。
游戏研发中的 AI 转型:网易多 Agent 系统与知识工程实践
本文整理自网易游戏高级技术经理林香鑫分享,其团队通过代码知识谱图构建、多 agent RAG 召回等技术打造超级助手,在多业务场景落地效果好。还介绍知识工程、多 Agent 赋能代码编写、AI 审查等实践及未来展望。