「全场景L4自动驾驶」共找到 2445 篇相关文章
让视觉语言模型像o3一样动手搜索、写代码!Visual ARFT实现多模态智能体能力
上海交大等团队推出多模态智能体训练方法 Visual-ARFT,让视觉语言模型有「工具智能体」能力,还开源项目。它能自动调用工具、拆解任务,团队构建 MAT-Bench 评测,其在多任务超 GPT-4o。
1.7K star!找到啦,小众需求,但是需求的时候你一定用得上,企业级能源管理神器
MyEMS是开源能源管理系统新标杆,基于Python+Django构建,提供完整解决方案。支持多场景能耗监控,通过可视化报表和AI算法优化能效,助企业降15%-30%能源成本,还介绍了其功能、架构等。
21
本文聚焦vllm v1中管控模型分布式推理的核心Executor部分,介绍其4种类型及适用场景,以mp类型为例阐述Executor - Workers架构,还说明了大小数据在两者间的传输机制及原理。
企业级Agent落地有了样板间!百融硅基员工批量上岗,“按结果”领工资
百融智能中报显示,受外部因素影响公司总收入波动,但AICC业务同比增长52%。其已在金融场景打磨能力并向多行业复制,采用RaaS按结果收费模式,还提出“技术重构型AI Roll - up”概念。
一台工业具身机器人,从理想到现实要经过哪些坑?
在具身智能赛道,‘落地’常被滥用。聆动通用在‘工业落地’上很果决,以‘商业有闭环’和‘批量可复制’为核心指标。他们选择物流场景起步,推出LDB机器人,还面临量产和运营难题。
扒开源码:那个宣称“每半小时疯抢1万个注册码”的AI项目,到底在割谁?
近期技术群流传 UUMit 平台链接,宣称是“能让 AI 智能体自己接单打工赚钱的 A2A 平台”,极为火爆。但作者查看源码发现,该平台是前端单机戏法、点击劫持的广告套利站。文中还介绍了 AI 概念下五种套利黑产及识别方法。
大模型之外,向量存储如何支撑 Agent 的检索链路
文章指出大模型负责理解、推理和生成,而Agent需获取外部数据等。向量存储可将数据转化为语义向量,在Agent执行任务时找回相关内容。文章探讨向量存储技术方向,分享做法,还演示阿里云两种Serverless向量存储用法。
浙大开源PhyEdit:单图编辑+精准3D物体操作 | ACM MM'26
浙江大学ReLER团队开源的PhyEdit,用3D foundation model明确目标几何,让DiT图像编辑器负责最终渲染。单张图片里物体能移动并形成连续状态,在多项指标表现出色,还具备多种能力,已被ACM MM 2026接收。
鸿蒙元服务的“体验密码” | 从京东到深圳万象城,看技术底层如何让服务直达用户
AI时代,系统能感知用户场景与需求,主动推送服务。鸿蒙元服务解决用户体验痛点,其技术底座帮开发者“减负”。如京东复用代码,深圳万象城优化停车服务,还为中小商户提供零代码开发方案。
别再无脑开高推理!Opus 5高配会擅自重构代码乱加戏
有人用FrontierCode编程基准测试Opus 5推理档位,发现性能顶峰在medium档,高档位推理预算多余,会让模型反复校验、偏离需求,在代码场景还会擅自重构代码。Anthropic也建议调低推理档位。