「场景预测」共找到 2317 篇相关文章
年终总结,通用Agent在企业落地,为什么这么难?到底要怎么做?
文章指出通用Agent在企业落地难,原因有模型本身问题、工程化落地难度被低估、安全合规要求高。还介绍金蝶苍穹Agent平台,它嵌入企业管理场景,有业务模板、开放标准和安全保障。
雇佣过目即忘的天才:为什么企业级AI总在浪费钱?| 甲子光年
当下企业级AI缺乏连续性、动态数据割裂,主流外挂RAG的解法无法解决‘认知’问题。红熊AI的‘记忆熊’开源,构建记忆系统结合Agent平台,解决多场景痛点,还将推动记忆科学‘芯片化’。
突破视觉-语言-动作模型的瓶颈:QDepth-VLA让机器人拥有更精准的3D空间感知
视觉 - 语言 - 动作模型(VLA)在机器人操控领域潜力大,但应对长时序或精细操作任务时性能下降,根源是缺乏三维空间感知与推理能力。中国科学院自动化研究所与灵宝 CASBOT 提出 QDepth - VLA 模型,提升了机器人空间推理与操控精度。
谢赛宁盛赞字节Seed新研究!单Transformer搞定任意视图3D重建
字节Seed康炳易团队的最新研究成果Depth Anything 3(DA3),获谢赛宁盛赞。它架构简单,能从多种输入中精准算出物体深度、还原相机位置,在新视觉几何基准上表现出色,核心秘诀是极简设计。
32倍加速,58秒搞定720p视频!字节发布离散自回归框架,统一视觉生成和长视频生成
字节发布InfinityStar框架,将5秒720p视频生成时间从30多分钟缩至58秒,还支持多样任务。它基于对视频本质思考设计时空金字塔模型,将时空分离,通过多项技术优化,性能表现出色,不过也存在一些技术局限。
地球级AI智能体爆诞!谷歌地球开外挂,一夜为20亿人洪水预警
谷歌结合世界建模经验与Gemini推理能力,升级Earth AI。它是地理空间AI模型和数据集,可自动连接不同地球AI模型。谷歌还推出新成果,如新一代影像与人口基础模型、空间推理智能体,可用于灾害预警等。
这一年做 Agent 的公司,Coding 赚了钱,客服融了钱,你呢?
全球数据研究机构 CB Insights《AI Agent Bible》报告梳理 Agent 行业概况。指出未来趋势,如语音成主流交互等;分析发展受限问题、有潜力机会;还介绍不同类型 Agent 商业情况及应对推理成本策略等。
大模型优秀大脑齐聚硬核开源聚会,SGLang社区举办国内首次Meetup
10月25日,SGLang联合美团、亚马逊云科技在北京举办国内首场Meetup。SGLang是开源高性能推理引擎,特性丰富。活动中大咖和开发者分享见解、进展、应用场景,展现其社区活力与发展潜能。
2025甲子Cool Vendor人形机器人大模型领域报告 | 甲子光年智库
甲子光年智库发布《2025甲子cool vendor人形机器人大模型领域报告》。当前人形机器人产业迎来关键转折点,产业链层级完整,大模型解决落地难题,应用场景升级。报告还呈现了产业链现状与趋势。
斯坦福与Adobe新研究,模仿蒸馏技术轻松让200亿参数图像生成高质量大模型
斯坦福大学和Adobe研究院联手,用pi - Flow技术让200亿参数文本到图像大模型4步内生成高质量、高多样性图片。此前少步生成有质量和多样性问题,他们推出GMFlow和pi - Flow解决难题,LakonLab是其背后工程支撑。