全场景」共找到 3495 篇相关文章

算法论文8

NeurIPS 2025 Spotlight | FSDrive统一VLA和世界模型,推动自动驾驶迈向视觉推理

面向自动驾驶的多模态大模型存在问题,FSDrive提出“时空视觉CoT”,让模型“以图思考”,联合未来场景与感知结果进行可视化推理。该方法在不改动原有MLLM架构前提下激活图像生成能力,实验表现出色。

机器之心
产品应用8

又一款国产高性能GPU问世,实力对标海外巨头

2025年9月22日,芯动科技发布“风华3号”功能GPU,它架构面,功能覆盖广,在大模型等领域有多个突破,还适配多生态与系统。该产品能为多行业定制服务,标志国产GPU进入规模化应用阶段。

芯师爷
新闻资讯7

马斯克机器人出街卖爆米花,还会捉弄顾客

马斯克的特斯拉Optimus机器人出街卖爆米花,还会捉弄顾客、给小朋友递爆米花、拍照比剪刀手。它是黑款,此前还曝出金色款,且开通中国区微博。此外,小鹏首款机器人‘Iron’亮相慕尼黑车展。

量子位
开源动态8

Gödel Rescheduler:适用于云原生系统的局最优重调度框架

本文介绍字节跳动研发的Gödel Rescheduler重调度框架,它能解决传统调度资源分配和任务摆放问题。阐述传统重调度弊端,介绍新方案组件,列举应用场景及成果,还提及未来规划,目前已开源。

InfoQ
开源动态8

球首个!10万小时人类数据开源,Hugging Face罕见站台

上周Dyna Robotics公司用超100万小时人类第一视角视频训练DYNA - 2模型,发现物理AI有Scaling Law。8月20日光轮智能宣布10万小时模态人类行为数据EgoSuite - Open100K开源,与Hugging Face联合发布。

新智元
新闻资讯7

GPT-5.6 Sol暴涨3倍,OpenAI最强视觉AI登顶!

第三方评测机构Roboflow测试显示,GPT-5.6 Sol在目标检测、计数等视觉任务上表现出色,尤其在文档版面识别和密集场景处理上进步明显,但认字能力有退步,且大尺寸图片检测框易飘移。

新智元
推荐文章8

Qoder Skills 完指南:从零开始,让 AI 按你的标准执行

文章介绍Qoder Skills,它是强大AI定制方式,像菜谱让AI按标准执行。阐述本质、结构、原理,对比与其他工具差异,说明适用场景、安装方法,还有实战演示、编写规范、测试迭代及团队协作等内容。

阿里云开发者
产品应用7

天下苦SaaS已久,企业级AI得靠「结果」说话

SaaS在AI时代问题凸显,推理成本高、交付质量不稳定。在此背景下,百融云创推出结果云Results Cloud,以RaaS模式提供栈解决方案,解决AI落地难题,还呼吁共建智能体生态。

量子位
产品应用8

Eino ADK:一文搞定 AI Agent 核心设计模式,从 0 到 1 搭建智能体系统

大语言模型发展下,Agent成AI落地主流,但传统开发有痛点。Eino ADK为Go开发者提供智能体开发框架,解决核心难题,还介绍了Agent功能、ADK模式、构建方法及多Agent协作场景等。

InfoQ
开源动态7

实测最新开源的DeepSeek-OCR后,我有些不一样的看法,有些话可能只有我敢说

实测最新开源的DeepSeek - OCR,它并非传统OCR,不适用于传统场景。其最大意义是解决大模型上下文长度问题,通过文字图片压缩解压提高处理速度。模型功能多样,是让AI看图思考的新思路。

开源AI项目落地