「垂直场景」共找到 2001 篇相关文章
3D-R1重塑三维视觉语言推理!让三维交互更智能
近年来,视觉 - 语言模型在2D图像理解有突破,但3D视觉语言模型面对复杂场景不足。为此上海大学团队提出3D - R1模型,它基于新数据集和策略构建,有强多任务三维理解能力,不过也存在进步空间。
分割一切并不够,还要3D重建一切,SAM 3D来了
深夜 Meta 重大更新,上线 SAM 3D、SAM 3。SAM 3D 含物体与场景重建、人体形状与姿态估计两模型,能将 2D 图转 3D 重建结果。SAM 3 可检测、分割与跟踪图像视频物体。Meta 开放模型权重与代码,推体验平台。
8 个月营收提高 4 倍,n8n 为什么是 AI Agent 最受欢迎的搭建平台?
n8n 从工作流自动化工具升级为 AI 应用编排层,8 个月营收提 4 倍,正进行超 1 亿美元融资。它能与 AI 无缝集成、社区活跃,使用场景广,有云服务和企业级服务,在竞争中有优有劣,采用独特开源许可。
谷歌最强大模型付费上线,在DeepSeek开源后被吐槽太贵
谷歌最强模型Gemini 3 Deep Think上线,推理能力强,能将草图变3D场景、搭建游戏。它在多评测基准表现出色,准确率超GPT - 5 Pro等。但仅向Ultra会员开放,月费约1800元,被吐槽贵,开源的DeepSeek-V3.2成冲击因素。
年入6亿、日本细分赛道第一,国产AI 硬件如何拿下日本智能家居市场?
国产 AI 硬件 SwitchBot 拿下日本智能家居市场市占第一。它单价低、安装灵活,以“非入侵式后装”理念,从智能开关拓展到多品类。2023 年扫地机器人 K10+ 大获成功,后又用 S10 试水美国市场,还推出 K20+ Pro 拓展场景。
用超图撕开知识边界:16万节点无师自通搞Agentic科研
传统知识图谱只能用三元组描述世界,难以应对真实科学场景里的多体交互。作者提出将文献里n元关系存成超图超边,让LLM在多智能体框架里‘沿着超边走路’,并构建了超图进行实验,实现可验证的科学发现。
150%训练效率提升:感知检测小模型训练优化方法
文章基于业务实践,总结感知检测小模型在不同算力卡上的训练方法,为智能驾驶场景提供借鉴。介绍测试环境、技术架构,分析环境依赖冲突、源代码适配等问题并给出解决方法,还提及性能优化及测试结果。此外还介绍用 RAGFlow 构建私有知识问答应用。
社区供稿 | Hugging Face x 北京中关村学院等机构联合发布生成式基因组大模型Carbon:一场关于“生命语言”的范式革命
北京中关村学院等联合发布生成式基因组大模型Carbon并开源。Carbon家族有三个版本,旗舰模型Carbon - 3B在多任务匹敌70亿参数的Evo2 - 7B,运行速度快275倍。它在数据、分词、训练上有创新,还实现技术普惠,有多种应用场景。
击败PI ,清华系具身公司包揽「具身奥林匹克」三项全球第一,刷新世界纪录!
在Benjie's Olympics赛事中,星动纪元凭借自研具身智能模型获三项全球第一,击败具身领域老牌公司PI。该赛事规则严苛,星动纪元在剥橘子、开锁、翻袜子任务中表现出色,此前其在技术研发和场景落地也成果颇丰。
你觉得 Kimi K3 又慢又贵是吧,我来告诉你为什么
作者用 Kimi K3 为墨问的 CatReader 增加发现页,实操中它多数时候快且抗用,不过周五晚变慢,收尾工作交给了 GLM 5.2。对用户觉得 K3 又慢又贵的问题进行分析,还区分了 Kimi App 和 Kimi Code 使用场景。