执行器」共找到 732 篇相关文章

推荐文章7

理解Ray Data分布式数据处理原理-源码分析

Ray Data是构建于Ray之上的分布式数据处理库,提供高性能且可扩展的API,可用于AI场景。文章从源码入手,分析其流式执行原理,包括读取数据源、构建数据处理、输出数据等环节,还介绍了LogicalPlan转PhysicalPlan及流式执行过程。

阿里云开发者
开源动态8

Hugging Face 推出 GOLD:让不同模型家族也能做知识蒸馏

Hugging Face研究团队提出GOLD方法,解决了知识蒸馏中老师和学生模型需用同一套分词的痛点,让不同模型家族间也能做知识蒸馏。它通过三步解决跨分词蒸馏,实验效果良好,已集成到TRL库。

AI工程化
开源动态8

HAMi 2.7.0 重磅发布 | 异构芯片全面拓展,调度更稳、生态更强

Dynamia密瓜智能宣布发布HAMi 2.7.0版,在硬件生态、调度、应用层生态等方面有显著进展。硬件上支持昆仑芯、燧原、AWS等芯片;调度优化了资源计算和可观测性;应用层与vLLM、Xinference等整合。

InfoQ
新闻资讯8

具身智能落地物流行业的最大难题,被京东物流撕开一道裂缝

在科技领域,物流行业常被视为最不“性感”的赛道之一。随着具身智能火爆,智慧物流又迎来新的想象空间。9月25日,在JDD 2025京东全球科技探索者大会上,京东物流正式发布“超脑2.0”与“异狼”系列新品,旨在填补物流智能化“认知”与“执行”高度统一的关键空白。

AI前线
算法论文7

英伟达新研究:小模型才是智能体的未来

英伟达最新论文指出,大模型在Agent任务中消耗大量计算资源,成本高、效率低、灵活性差,而小模型能在性能够用前提下让任务执行更经济灵活。小模型通过优化硬件资源和任务设计高效执行任务,但落地面临挑战。

量子位
8

刚刚,中国AI闯入全球编程前二!前面只剩Claude

Code Arena最新榜单出炉,Qwen3.7 - Max以1541分冲进全球第四,是前五中唯一非Claude模型。它在多项测试中表现出色,是为长时间自主执行任务设计的Agent基座模型,编程跃升或与环境扩展、长程自主执行训练方法升级有关。

新智元
开源动态8

阿里搞了个全能解析,文档、图片、音频、视频一锅端

阿里巴巴开源 Logics-Parsing-Omni,用一个模型统一处理文档、图片、音频、视频四种模态,输出结构化 JSON 数据。它采用三级渐进解析框架,两阶段训练策略,在自建基准上多项指标超越 Gemini - 3 - Pro。

CourseAI
新闻资讯7

吴恩达发布论文自动审阅,ICLR上达到接近人类水平

目前学术会议论文评审无统一规范,投稿量膨胀致审稿周期冗长。吴恩达发布‘Agentic Reviewer’,在ICLR 2025数据测试中接近人类水平,现阶段在arXiv研究领域表现佳,但仍处实验阶段。

机器之心
算法论文8

告别「解码饥饿」!中国科学院NeurIPS推SpaceServe,高并发克星

中国科学院计算技术研究所入选NeurIPS 2025的论文提出SpaceServe架构,将LLM推理P/D分离扩展至多模态场景,通过EPD三阶解耦与「空分复用」,解决MLLM推理行头阻塞难题,在Qwen2 - VL系列模型实测中表现出色。

新智元
算法论文8

答对了却没看图?EASE给多模态RLVR装上「视线校正

强化学习与可验证奖励提升视觉语言模型推理能力,但存在答案奖励只知对错、不知证据区域问题。哈工大等团队提出EASE,把标注证据区转为目标分布,监督空间注意力,推理无额外标注,实验成绩优异。

机器之心