多语言检索」共找到 4967 篇相关文章

新闻资讯7

Claude 最歧视的,是印度阿三

AI研究员Aran Komatsuzaki实验发现,Claude的tokenizer对非英语用户不友好,印地语用户消耗token是英语的3.24倍,带来高成本、高延迟等问题。不同模型对不同语言token处理有差异,市场份额影响token效率。

AGI Hunt
算法论文8

刚刚,Anthropic 宣布:Claude 自己长出了意识

Anthropic新研究《语言模型中的全局工作空间》,在Claude神经网络里找到特殊区域J - space,它有独特性质,对应全局工作空间理论。还介绍了发现方法及个实验,探讨其与意识关系,研究已开源。

AGI Hunt
算法论文8

NeurIPS 2025|CAKE:大模型驱动的贝叶斯优化新配方,让黑箱优化更智能、更高效

香港中文大学(深圳)等高校研究人员提出 CAKE 方法,被 NeurIPS 2025 接收。它利用大语言模型动态设计高斯过程核函数,构建自适应贝叶斯优化框架,在领域实验中效果优,还具备可解释性。

机器之心
新闻资讯8

「AI助手」真来了?谷歌牵头推进Agent支付协议AP2

近日谷歌宣布推出 Agent 支付协议 AP2,这是开放共享协议,为 Agent 和商家交易提供通用语言,解决授权、真实性、问责问题,还支持种支付类型,已和 60 个企业合作且在 GitHub 公开项目。

AINLPer
产品应用7

SQL玩转模态AI,轻松搞定图片+文本混合搜索

在AI驱动智能商业时代,传统搜索系统难满足需求,AI检索系统又面临数据搬运和工具链割裂难题。本文提出用原生SQL实现模态智能检索,基于PolarDB融合AI引擎,通过SQL调用服务,无需迁移数据与搭建独立服务。

阿里云开发者
算法论文7

UniSteer用机械臂「拼豆」:让人类指导进入VLA噪声空间强化学习

视觉 - 语言 - 动作模型(VLA)是机器人操作重要基础模型,但复杂任务成功率低,真机强化学习成本高。微软等机构研究者提出 UniSteer,将人类纠正转换成噪声监督,在任务测试中提升了成功率。

机器之心
算法论文8

0.016%参数撬动18%性能:关键表征微调破解LLM推理瓶颈

语言模型在推理任务依赖思维链技术,传统PEFT方法需修改大量参数,新兴ReFT虽只需调整少量参数,但存在不足。本文提出CRFT,仅用0.016%参数量就提升性能,为轻量化推理增强开辟新路径。

深度学习自然语言处理
算法论文8

半量工具,双倍效能:ARPO革新大模型强化学习

语言模型在轮工具调用场景有挑战,传统强化学习算法有探索效率低和资源消耗大问题。本文提出ARPO,通过量化token熵分布变化设计自适应探索机制,降低工具调用成本且提升轮推理性能。

深度学习自然语言处理
新闻资讯8

Altman 亲自坐镇发布 ChatGPT Image 2,小编实测:风格、画质、叙事感全都夯爆了

OpenAI CEO Sam Altman 亲自发布 ChatGPT Images 2.0,这是该公司迄今功能最强的图像生成模型。它有思考能力,可直出 8 张连贯图片,支持语言种画幅与分辨率,能精准执行复杂指令,直接商用也没问题。

InfoQ
算法论文8

腾讯与中科院联合提出R-4B,一个能自动决定是否思考的模态大模型

模态大语言模型“始终思考”模式有缺陷,腾讯混元团队与中科院自动化所联合提出R - 4B,通过双模式退火训练和双模式策略优化实现自动思考,在评测中达SoTA,省资源且效果好。

深度学习自然语言处理