跨语言能力」共找到 4239 篇相关文章

算法论文8

LLM-based Reranker效果到底如何?一项关于SoTA模型的全面分析

在信息爆炸时代,重排序是信息检索系统核心。论文对22种重排序方法实证研究,构建无污染数据集FutureQueryEval。结果显示LLM重排序器泛化能力被高估,轻量级模型有优势,为研究和应用提供指南。

深度学习自然语言处理
开源动态8

最新智能体自动操作手机电脑,10个榜单开源SOTA全拿下|通义实验室

通义实验室推出Mobile - Agent - v3智能体框架,在多核心榜单获开源最佳。它能完成复杂任务,在多智能体框架中灵活切换角色。团队搭建云环境基建,从多维度构建数据,用强化学习和多智能体协作提升其性能。

量子位
新闻资讯7

喜当爹后,奥特曼自曝神经化学骤变!养娃能为人类做出更优AI决策

OpenAI CEO奥特曼喜当爹后称优先事项改变,神经化学有骤变。其决策能力曾受争议,现恰逢OpenAI推进“星际之门”计划,他还将AI发展比作看孩子成长,也提及行业或有泡沫。

新智元
算法论文8

LLM的快速、慢速与工具增强思维模式综述

大型语言模型在不同任务中对推理策略需求差异大,策略选择不当会影响效率与可靠性。本文提出双重知识边界框架,梳理LLMs推理模式,将策略选择形式化,还分析了决策因素及策略选择机制。

深度学习自然语言处理
新闻资讯7

The Batch: 866|GPT-5 起飞遇乱流

OpenAI推出GPT - 5及其系列模型,涵盖多种类型,有新功能与性能提升。但发布中路由器故障等问题让用户失望。它在部分基准测试表现佳,不过抽象推理能力有不足,还回顾了发布历程。

DeeplearningAI
开源动态7

狂涨12.6K star!Shell命令即搞定可视化监控,超级6~~

开源君分享简单轻量的开源项目Sampler,它能通过YAML配置文件实现系统指标监控与可视化,支持多平台,收获12.6K star。其有简单易用、平台等特色,安装后创建配置文件即可使用。

开源先锋
新闻资讯7

刚刚,Claude 可以主动终止对话了……

Anthropic宣布给Claude Opus 4和4.1赋予主动终止对话能力,这是潜在AI福利探索工作一部分。因用户辱骂或提有害要求时Claude有类似“痛苦”反应,此功能极端情况才用,社区对此看法不一。

AGI Hunt
开源动态7

GPT-5认为这个模型是开源界的Claude 3.5——陈天桥朋友圈里的 MiroMind ODR 让我眼前一亮

陈天桥用GPT - 5评测自家开源模型MiroMind ODR,让其应对复杂问题。GPT - 5评价该模型是“开源界的Claude 3.5”,其能力让GPT - 5“点赞”,有闭源模型稳定性和可用性,还具全开放架构。

AI科技评论
开源动态7

实测Perplexity Pro平替模型,免费开源仅4B

一款仅4B大小的开源模型Jan-v1,声称能平替Perplexity Pro,且完全免费、支持本地部署。实测发现,它在检索增强生成、上下文深度分析等能力上表现不错,入门级显卡即可带动本地部署。

量子位
开源动态8

谷歌开源Gemma 3 270M,性能超越Qwen 2.5同级模型

本周四,谷歌发布 Gemma 3 270M 模型,它参数小、功能强,具备指令跟踪等能力。在 IFEval 测试中表现出色,节能且适合多场景,谷歌还提供使用指南和试用途径,Gemma 系列下载量已破两亿。

机器之心