多语言模型」共找到 9806 篇相关文章

产品应用8

英伟达拿出推理版VLA:Alpamayo-R1让自动驾驶AI更会动脑子

当今自动驾驶模型虽强大,但在‘长尾场景’易翻车。英伟达推出的Alpamayo - R1是带推理能力的视觉 - 语言 - 行动模型,有核心创新,实验中性能显著提升,训练分三阶段,让自动驾驶迈向可解释。

机器之心
算法论文7

AI越会思考,越容易被骗?「思维链劫持」攻击成功率超过90%

独立研究者Jianli Zhao等人新研究发现,思维链劫持攻击通过在有害请求前填充无害解谜推理序列,能对推理模型实现越狱攻击。在HarmBench基准上,对模型攻击成功率超90%,揭示思维链推理存在新安全漏洞。

机器之心
新闻资讯8

OpenAI还在讨论“异星心智”,乐享科技已经造出来了|甲子光年

本文对比OpenAI对异星机器心智的风险预警,介绍中国乐享科技基于仿生神经科学思路,研发出面向机器人的以太大模型,已完成场景验证,将举办户外开放直播测试,探索具身智能新路线

甲子光年
新闻资讯8

击败PI!星动纪元登顶具身奥林匹克,狂揽三项全球冠军

在具身灵巧操作奥林匹克赛事Benjie’s Olympics中,中国具身智能公司星动纪元斩获三项全球第一,超越美国明星公司PI。其自研VLA具身模型优势显著,且已在领域落地应用。

量子位
算法论文8

VLM剪枝新SOTA:无需重训练,注意力去偏置超越6大主流方案

常用的attention机制存在位置偏置和padding异常,影响剪枝效果。上海大学曾丹团队提出无需重新训练的attention去偏方法,在模型、剪枝策略及基准上验证有效,为模态模型部署提供新思路。

新智元
产品应用7

千元手机也能离线爽跑谷歌Gemma 4,太酷了!

谷歌推出开源APP `Google AI Edge Gallery`,可在手机离线运行开源大模型,如Gemma 4。它数据不出本地,玩法,支持中文交互。虽有局限,但已超模型演示范畴,展示AI本地智能趋势。

开源先锋
开源动态8

Meta刚刚开源DINOv3,横扫60+任务,无标注封神!

今天凌晨,Meta开源视觉大模型DINOv3,采用自我监督学习,无需标注数据。它在60个视觉任务测试中表现出色,超越同类模型。还引入后处理优化策略,扩展应用场景,能适应种部署环境。

AIGC开放社区
开源动态8

OpenAI未公开的o3「用图思考」技术,被小红书、西安交大尝试实现了

OpenAI推出的o3推理模型打破传统文字思维链边界,实现图像融入推理过程。小红书与西安交大联合构建模态深度思考模型DeepEyes,尝试实现类似能力,还开源技术细节,在任务中表现出色。

机器之心
算法论文8

PixelRefer :让AI从“看大图”走向“看懂每个对象”

模态大模型停留在整体场景级理解,现实任务需细粒度、对象级理解。浙江大学等联合提出PixelRefer框架,可实现精细视觉指代与推理,在项任务表现领先,轻量版性能优,还开源两类数据集。

机器之心
开源动态8

跨芯片统一优化,DLCompiler与DLBlas驱动算子极致表现

9月10日,上海AI实验室DeepLink团队开源DLCompiler和DLBlas。前者是扩展Triton的深度学习编译器,后者是面向大模型的高性能算子库。它们有跨架构DSL扩展等亮点,在芯片上实现性能优化,还解决了DSA芯片优化难题。

OpenMMLab