「空间智能大模型」共找到 9769 篇相关文章
21
本文聚焦vllm v1中管控模型分布式推理的核心Executor部分,介绍其4种类型及适用场景,以mp类型为例阐述Executor - Workers架构,还说明了大小数据在两者间的传输机制及原理。
机器人伸手时,杯子被挪走了:LIBERO-MAX用22.4万次仿真检验动态可靠性
本文介绍了斯坦福等多校研究者提出的机器人评测基准LIBERO-MAX,针对机器人执行任务中途环境变化的痛点,设计配对测试方案,经大规模仿真评测现有模型性能,为机器人动态鲁棒性改进提供标准化测试平台。
Action Map Policy:从高维动作回归到像素分类,一种新的机器人操作学习范式
本文介绍美国东北大学博士生黄浩杰提出的全新机器人操作学习范式Action Map Policy(AMP),将高维三维机器人动作转化为二维图像空间的像素分类问题,性能和推理速度均显著优于现有主流基线方法。
吴恩达新作:87%推理token用不着,丢掉反而快3倍
吴恩达新作Prefix Sliding指出,模型推理时丢弃中间已贬值token,只保留前缀+滑动窗口,无需训练可提速3倍,配合RL训练能将推理轨迹扩展到10万token以上。该方法为Agent场景提供新思路。
让 AI Scientist 真正“做出材料”, 鼎犀智创完成数亿元 Pre-A 轮融资
AI新材料研发公司鼎犀智创完成数亿元Pre - A轮融资,资金用于模型及技术研发等。该公司技术路线独特,案例显示能大幅缩短研发周期,还将中试放大纳入体系,推动材料研发走向平台化。
1w颗星!本地化视频翻译配音工具!
KrillinAI是多功能音视频本地化与增强方案,面向人类用户和AI Agent。它功能全,覆盖视频处理完整链路;特点多,支持CLI调用等;还兼容多种语音识别、大语言模型和TTS服务,可Docker部署。
13.3K Star!终于有人把文档转 Markdown 这件事做好了!
AI 应用普及,企业常将不同格式文档喂给大模型,但转换工具存在诸多问题。Firecrawl 团队的开源项目 anydoc 支持 14 种格式统一转 Markdown,速度快、输出一致,还有浏览器版本保障隐私,提供多种编程接口。
阿里 Qwen3.8 正式发布:2.4T 规模,自主编程 16 天搓出一个 Hermes Agent
8月3日,阿里巴巴发布新一代基座大模型Qwen3.8,总参数量2.4万亿,性能居全球第一梯队。其API已上线千问AI平台,还接入“千问办公”。Qwen3.8编程和办公能力强,还将开源,性价比高。
浪费20亿Token之后,我做了一个帮自己定义目标的Skill。
作者在浪费20亿Token后,开源了帮定义目标的Leader.skill。它能将模糊需求转为清晰目标,适用于多模型组合。还阐述人类与Agent交互范式转变及目标定义要点,给出目标七问方法论。
AI 能力越来越强,那么它生成的代码,人类还需要去理解吗?
《代码整洁之道》作者罗伯特·C·马丁不逐行看 Agent 代码,设好测试框架通过就行。Notion 工程师 Geoffrey Litt 在会议探讨人类是否需理解代码,多数人认为需要,Litt 分享理解代码方法。