多词元预测」共找到 4702 篇相关文章

算法论文8

ACL 2025杰出论文!用能力显著向量让大模型下游任务性能预测更精准

上海人工智能实验室与复旦大学联合研究成果《Capability Salience Vector》获ACL 2025杰出论文奖。提出能力显著向量(CSV)解决验证损失与下游任务能力脱节问题,实验验证其提升了下游任务表现可预测性。

OpenMMLab
算法论文7

ICML 2025 Spotlight | 谁导致了智能体系统的失败?首个「自动化失败归因」研究出炉

ICML 2025 Spotlight 论文提出「自动化失败归因」新方向,应对智能体系统失败难诊断问题。构建「Who&When」基准数据集,设计三种初步方法并评估,虽现有方法表现有限,但此研究意义重大,有望助力打造更可靠系统。

机器之心
开源动态7

AI驱动的实时全球情报情报系统,绝大信息免费!覆盖全球实时情报的个维度!

实时全球情报仪表盘是AI驱动的态势感知界面,集成新闻聚合、地缘政治监测与基础设施追踪。数据源为免费公开API,低延迟更新。有种功能,技术栈丰富,聚合领域65+外部数据源。

GitHubStore
7

这个开源工具让AI理解你正在操作的任何界面,俩学生辍学开发的产品,功能超

Everywhere是两个学生辍学开发的开源交互式AI助手,能感知屏幕内容,在任意界面使用。它功能、细节优,支持场景,集成种AI模型,使用简单,还提供个性化体验。

开源AI项目落地
产品应用7

眼馋苹果刚发布的液态玻璃效果?藏师傅教你提示一键实现

苹果 WWDC2025 发布的液态玻璃效果引关注,虽卡片中心可读性差,但预计会被广泛使用。藏师傅探索出将其融入网页生成的提示,介绍了在不同模型上的效果及提示内容和使用注意事项。

歸藏的AI工具箱
算法论文8

给你一群顶尖AI,如何组队才能发挥最大战力?UIUC用一个新的智能体协作基准寻找答案

现有的评测基准无法衡量智能体系统内部的协作效率、沟通质量和竞争策略。为此,伊利诺伊大学厄巴纳 - 香槟分校的研究者推出 MultiAgentBench,能全面评估 LLM 智能体系统协作与竞争能力。

机器之心
算法论文8

大模型如何泛化出智能体推理能力?清华提出策略游戏自博弈方案MARSHAL

近日,清华大学等机构研究团队提出 MARSHAL 框架,利用强化学习让大模型在策略游戏自博弈。实验表明,轮、智能体训练提升了模型博弈决策水平,将推理能力泛化到通用智能体系统,在一般推理任务表现显著提升。

机器之心
开源动态8

DeepDiver-V2来了,华为最新开源原生智能体系统,“团战”深度研究效果惊人

华为发布DeepDiver-V2原生智能体系统,采用“团队作战”模式,在复杂知识问答和长文报告生成上表现出色。它以Planner为中心协调个Executor,有智能任务分解等优势,训练也有新机制,昇腾NPU集群加速。

量子位
新闻资讯8

2025世界人工智能大会特别推荐!10国20位艺术家邀你开启与AI的深度对话

2025世界人工智能大会特别推荐的‘提视造境:国际人工智能艺术文献展’,由上海民生现代美术馆主办,汇集10国20位艺术家31件/组作品。分五大板块,探讨AI艺术议题,是人机共演的艺术实验。

MANA新媒体艺术站
开源动态8

狂涨 36.9K star!!看看人家的开源微信机器人优雅,微信、飞书、钉钉支持,效率飙升!

开源君介绍超火的开源项目`chatgpt-on-wechat`(CoW),它结合大模型与社交、办公平台,可定制优化。能接入平台,支持模型,处理模态消息,有丰富插件,还能记忆会话、定制知识库。给出安装步骤。

开源先锋