多选题评测」共找到 4547 篇相关文章

产品应用8

开箱即用、本地安全、 Agent 协同解决方案!

过去一年,Agent热度高,但企业应用面临算力、安全和部署门槛。5月22日浪潮信息推出元脑智能体工作站Z3,整合大模型本地推理等功能,解决本地Agent运行问题,降低使用门槛,保障安全。

GitHubStore
推荐文章7

评论送书 | 一文读懂Agent系统演进趋势

文章指出Agent系统成大模型应用重要方向。分析大模型交互的上下文瓶颈,如语义膨胀、信息密度不均等;阐述Agent间协同结构演化,包括松耦合编排、语义协同等;还说明传统Prompt工程局限及通信与上下文协议的作用。

AIGC开放社区
开源动态8

Agent 并行,手机也能用,已经 4 万星!

GitHub上项目Orca是专为「并行Agent」做的开发环境,开源4个月揽4万+ Star。它让个Agent在独立git worktree里并行干活,互不干扰,还支持近30款主流Agent,另有种实用功能,安装也简单。

开源先锋
新闻资讯7

Show me《指环王》!卡帕西强推大模型评测新基准

大神卡帕西宣称Anthropic用《指环王》给大模型评测上强度,这一‘指环王基准’正接替‘鹈鹕骑自行车’SVG测试。虽Opus 5生成的画面粗糙,但网友测试展现出丰富创意,不过新测试也引发争议。

量子位
算法论文7

智能体大语言模型中的人类自适应协作

尽管大语言模型有进展,但纯自治智能体系统有局限。为此提出 HILA 框架及双环策略优化机制,结合 DLPO 的 HILA 在基准测试中表现出色,为构建 Agentic 系统提供指导。

深度学习自然语言处理
算法论文7

谷歌研究院探索智能体协调的扩展原则

谷歌研究院对180种智能体配置对照评估,得出‘AI智能体系统首批定量扩展原则’。发现智能体协同效果因任务而异,还指出工具使用瓶颈等问题,且开发预测模型辅助架构选择。

InfoQ
推荐文章8

尺度特征融合:原理、结构与实用算法案例

文章介绍尺度特征融合技术,它结合网络不同层次特征以捕获丰富上下文信息,在目标检测等任务广泛应用。阐述原理、常用方法,介绍FPN、U - Net等结构,并给出基于这些结构的实用算法案例与Python代码。

机器学习AI算法工程
开源动态8

Gaia2 与 ARE:赋能社区的智能体评测

文章介绍 Gaia2 与 ARE,Gaia2 是智能体基准 GAIA 升级版,能分析复杂行为,与 ARE 框架一同发布。ARE 可模拟复杂真实条件,支持定制。文中对比款模型,指出当前模型挑战,并说明评测步骤和 ARE 使用场景。

Hugging Face
产品应用8

Kimi新出的Agent集群,到底有恐怖?

Kimi发布K2.5模型及Agent集群功能,将国产AI推向“组织智能”新高度。K2.5全能且开源,评测优于GPT - 5.2 - xhigh且成本低。Agent集群可按需协调子Agent,实现“角色涌现”与“3D编排”。

newtype AI
推荐文章7

一文探析分类指标Accuracy/Precision/Recall/F1-score

文章探讨机器学习分类模型评价指标,指出Accuracy在不平衡数据集有缺陷,需引入Precision、Recall和F1 - score。分开解析二分类和分类模型指标,还给出不同场景下指标侧重建议。

海边的拾遗者