「逐场景方案」共找到 2657 篇相关文章
Uber&WisdomAI揭露95%AI Agent落地失败的真相 !
在‘Beyond the Prompt’技术论坛上,Uber、WisdomAI等企业揭开AI智能体落地难症结。指出90%失败源于‘喂错料’,信任是落地‘生死线’,记忆是架构设计,多模型编排与场景化交互决定用户体验上限。
景不动人动,MLLM如何面对「移步换景」的真实世界?OST-Bench揭示多模态大模型在线时空理解短板
上海多所高校研究者提出 OST - Bench,从智能体探索场景动态在线视角挑战大模型能力。它更贴近真实世界,揭示主流多模态大模型在线时空理解短板,为未来模型发展指明方向。
RL 将如何提高具身大模型 VLA 泛化性?清华大学团队NeurIPS 2025文章分析 RL 与 SFT 泛化性差异
清华大学团队在NeurIPS 2025发表文章,揭示强化学习(RL)提升具身大模型VLA泛化能力的优势,对比其与SFT差异,还提出评测基准和训练方法,为VLA训练提供新方向。
RAG新王:AccurateRAG屠榜SOTA
大模型记不住私有或实时信息,RAG 落地遇难题。AccurateRAG 是 Qualcomm 团队端到端工程方案,有 4 个模块化组件,在 6 个数据集上刷新 SOTA,解决 RAG 文档解析、检索和生成难题。
ChatGPT架构师,刚发布了最新研究成果
Thingking Machines发布第三篇研究博客,核心作者是OpenAI联创John Schulman。研究关于LoRA参数高效微调方法,探究其匹配全量微调效率的条件,给出简化调参方案,还提炼出三个核心发现。
Cursor定价又更新,直接变成" 买API ",Coding 产品包月模式走不下去了
Cursor一年三变价,9月15号后个人版按模型推理用量计费,有Pro、Pro Plus、Ultra方案,还对大学生免费计划二次验证。因模型成本涨、竞争大,包月模式难以为继,多家编程工具都调整定价。
李飞飞发布世界模型新成果:一个提示,生成无限3D世界
李飞飞创业团队World Labs宣布能生成持久、可导航且能自定义操控的3D世界。该模型专注构建3D环境,有更好几何形状、多样风格、更大规模,还支持无限畅游,已推出beta版。
2 亿美元 ARR,AI 语音赛道最会赚钱的公司,ElevenLabs 如何做到快速增长?
AI音频独角兽ElevenLabs估值66亿美元,从“小公司”成长为独角兽。其CEO回顾创业历程,分享心得,如结合研发与产品、融资绑定产品动态、靠三点优势不被OpenAI取代等,还谈及人才、融资、业务等方面策略。
视频理解新标杆,快手多模态推理模型开源:128k上下文+0.1秒级视频定位+跨模态推理
快手开源能看懂视频并跨模态推理的大模型Keye-VL 1.5,其有时序定位、描述和推理能力,跑分领先。采用三段式架构和Slow-Fast编码策略,经四阶段预训练和多阶段后处理,团队成果多,推动多模态技术落地。
AI 教父辛顿最新对话:超级智能诞生之后,我们唯一的生路是当“婴儿”
在大模型热潮下,“AI 教父”杰弗里·辛顿接受采访,剖析神经网络奥秘,分享对 AI 未来构想与忧虑,包括五年内超级智能诞生可能、人机共存方案,还谈及监管、就业影响等问题。