多模型调度」共找到 9740 篇相关文章

开源动态8

真狠!4 万 Star CodeWhale,AI 写代码最怕的是什么????

文章介绍开源的CodeWhale,它是terminal coding agent harness,GitHub超4万Star。它给代码Agent定规则,涵盖身份、证据等原则。支持模型,有任务流程和Agent协作功能,还分析适用人群并给出启动方法。

小华同学ai
新闻资讯8

8.99万的人形机器人来了!中国版Figure发力,价格打穿地板

星尘智能发布T1新品,价格8.99万元起,6月发货。它强调商业化能力,能「一机用」,打穿场景。星尘自研「AI模型 - 具身OS - 绳驱本体」架构,已量产,订单,领先同行。

新智元
算法论文8

ICML 2026 | 拒绝盲目猜token,阿里x浙大将投机解码带入弹性预算时代

随着大模型参数规模扩大,推理成本成核心瓶颈。投机解码在高并发下有问题,阿里与浙大学者提出 ECHO,将投机树构造建模为预算调度问题,通过稀疏门控和弹性预算调度提升系统收益。

机器之心
产品应用8

国产AI首次「长出」原生记忆,非Transformer架构成新王!机器狗当场引爆WAIC

WAIC世界人工智能大会上,国产黑马RockAI的大模型Yan 2.0 Preview亮相,可终端无损部署。它基于非Transformer架构,训练效率高,有原生记忆,实现端侧AI,展现出自主学习和模态能力,引发关注。

新智元
新闻资讯7

AI月产十亿行代码,暴增76%!程序员论坛炸锅:代码行数≠生产力!

Greptile基于每月用AI审核的十亿行代码发布AI编程年度报告,显示AI助力下代码生产量飞涨,但论坛对此存怀疑,还分析了不同大模型SDK下载量、模型适配场景等,也给出2025年关键论文。

新智元
算法论文8

CVPR 2026|清华联合美团推出3DThinker,首个用3D意象思考的工作

当前模态大模型在空间理解任务表现弱,缺乏对几何信息提取能力。清华联合美团推出3DThinker,无需3D标注和外部工具,让模型内蕴‘想象’三维场景,在基准上提升效果,且具备一定可解释性。

机器之心
算法论文7

AI越会思考,越容易被骗?「思维链劫持」攻击成功率超过90%

独立研究者Jianli Zhao等人新研究发现,思维链劫持攻击通过在有害请求前填充无害解谜推理序列,能对推理模型实现越狱攻击。在HarmBench基准上,对模型攻击成功率超90%,揭示思维链推理存在新安全漏洞。

机器之心
新闻资讯8

击败PI!星动纪元登顶具身奥林匹克,狂揽三项全球冠军

在具身灵巧操作奥林匹克赛事Benjie’s Olympics中,中国具身智能公司星动纪元斩获三项全球第一,超越美国明星公司PI。其自研VLA具身模型优势显著,且已在领域落地应用。

量子位
算法论文8

VLM剪枝新SOTA:无需重训练,注意力去偏置超越6大主流方案

常用的attention机制存在位置偏置和padding异常,影响剪枝效果。上海大学曾丹团队提出无需重新训练的attention去偏方法,在模型、剪枝策略及基准上验证有效,为模态模型部署提供新思路。

新智元
产品应用7

千元手机也能离线爽跑谷歌Gemma 4,太酷了!

谷歌推出开源APP `Google AI Edge Gallery`,可在手机离线运行开源大模型,如Gemma 4。它数据不出本地,玩法,支持中文交互。虽有局限,但已超模型演示范畴,展示AI本地智能趋势。

开源先锋