多模型推理」共找到 10054 篇相关文章

产品应用7

RoboScience机器科学发布轮式仿人形机器人REX G1,打造新一代具身生产力伙伴

8月17日,RoboScience机器科学发布轮式仿人形通用操作机器人REX G1。它搭载自研VLOA架构通用具身大模型Visics,面向场景,能在真实世界完成任务闭环,具备方面优势。

机器之心
开源动态7

美团开源Agentic新王,速度拉满,工具调用打爆Kimi?

周末美团开源LongCat - Flash大模型,参数量560B,推理速度达100 token/s,成本低,在Agent工具调用表现超Kimi - K2。它有Zero - Computation Experts和ScMoE创新,不过市场表现未获太认可。

探索AGI
开源动态7

JManus - 面向 Java 开发者的开源通用智能体

在Manus火热背景下,Spring AI Alibaba JManus诞生,它是用Java实现的开源OpenManus。可集成个大模型,功能完善,能让Java开发者低门槛搭建智能体系统,还给出了运行方法及共建思路。

阿里云开发者
开源动态7

开启Benchmark的Harness时代:15家学术机构联合发布HarnessEval

8月13日,DeepSeek开源Agent Harness dsh引发行业对“Harness”的关注。近日,MirroS联合机构发布HarnessEval,将其概念引入评测系统。它使评测从Metric到Harness,形成可执行评测系统,已落地于交互式世界模型

机器之心
算法论文8

14.7M参数,小目标AP达到13.9%!FSDETR用频空融合重新定义目标检测

传统小目标检测问题,2026年4月FSDETR论文提出频空融合法,用14.7M参数获13.9% APS成绩。它有SHAB、DA - AIFI、FSFPN三个核心模块,还给出训练、推理及导出ONNX部署代码。

机器学习AI算法工程
算法论文8

钉钉DeepResearch, 0.008元/1k Token击穿地板价

阿里为7.5亿钉钉用户推出Dingtalk - DeepResearch,解决企业办公AI化痛点。系统采用“三横一纵”架构,有阶段强化学习等三种解法及DingAutoEvaluator纵向飞轮,实现模型自进化、自纠错。

CourseAI
开源动态8

开源音视频同步SOTA基座:极简的单流架构,2秒出片

AI视频生成迈入音视频同步新纪元,闭源巨头已展实力,而上海创智学院与Sand.ai联合发布的开源音视频生成基础模型daVinci - MagiHuman,以极简单流架构,2秒就能在1张H100显卡上生成精准音视频同步画面。

AIGC开放社区
开源动态7

号称视频编辑领域的开源nano banana来了,用文字就能改视频

DecartAI开源Lucy Edit模型,号称视频领域开源Nano Banana,能理解自然语言指令改视频。如输入指令可精准换服装等,渲染快,有身份保持和动态适配亮点,有个版本,应用场景广。

AI工程化
开源动态7

8秒极速生成!复杂场景图像定制低成本轻松驾驭,已开源丨字节北大联合发布

字节跳动与北大联合推出支持条件组合的统一图像定制化生成框架DreamO,能实现主体、身份等样化定制。与商业大模型比,它开源、成本低、速度快,8 - 10秒可完成图片定制。

量子位
新闻资讯8

Google推出 AI 科学家:自动编写专家级代码,40个新方法碾压人类 SOTA

Google新发布的AI系统能编写科学软件、发明新方法,结合大语言模型与树搜索技术。在生物信息学、流行病学等领域超人类最优水平,引发网友对科研影响的讨论。

AGI Hunt