多语义性」共找到 4563 篇相关文章

推荐文章8

企业级 Agent 智能体架构与选型指南 -- 来自1000+行业应用实践积累

本文基于超1000+智能体应用实践经验,介绍企业级Agent智能体架构。强调单智能体优先,介绍AgentScope支持的智能体模式,对比工作流与对话模式,给出架构选型指南,还提及Spring AI Alibaba Graph为智能体提供的能力。

阿里云开发者
算法论文8

别再用单选评测骗自己了!Amazon新论文揭示了大模型在选题中的3种系统偏差

Amazon新论文揭示大模型做选题有3种系统偏差,如选择、数量、猜测偏差。还推出SATA - Bench评测,给出10个测量指标,提出Choice Funnel解码策略,能提升小模型选题正确率。

深度学习自然语言处理
算法论文8

LeCun团队揭示LLM语义压缩本质:极致统计压缩牺牲细节

图灵奖得主LeCun团队提出全新信息论框架,对比人类与LLM语义压缩策略。通过构建人类概念分类基准、选30+LLMs,发现LLM虽有语义组织能力,但难处理细粒度差异,侧重统计压缩,人类更重细节语境。

量子位
产品应用8

AI 代码审查再进化:AutoDev 智能体协作架构深度解析

现代软件开发中,代码审查存在信息割裂、人工效率低等痛点。AutoDev 借助智能体协作与信息聚合,实现从分析到修复的闭环智能流程,还构建 Agent 协作体系,未来将集成更能力。

phodal
算法论文8

都在卷「让大模型循环几遍」,这个7B模型LoopCoder v2说:循环 1 次就够了

当下推理模型流行在测试时循环,以打磨答案。但新研究发现,7B模型LoopCoder v2只循环1次(共2次),就能大幅提升能,继续增加循环次数,能反而下降。研究还分析了收益与成本,给出选择循环次数的诊断方法。

机器之心
产品应用7

Harness Monitor:当个 Agent 同时写代码时,如何看住质量

作者在有了 OpenAI 赞助的 Codex Pro 后,让个 Agent 同时在一个代码库工作。他开发的 Harness Monitor 从 Git 视角出发,解决 Agent 写代码时的质量问题,涉及观察、治理等方面能力。

phodal
推荐文章7

智能体自主规划模式能提升:五大精准策略详解

本文基于智能体React模式实践,剖析自主规划架构挑战,如工具调用延迟等。提出五大优化策略,像用流式XML替代FunctionCall、合理压缩上下文等,还介绍创意加速器AI绘画创作功能,为智能体规划模式提供借鉴。

阿里云开发者
开源动态8

18.2K Star!macOS 丝滑跑Linux,一键容器、架构支持,开发效率直接起飞!

介绍轻量级虚拟机管理器 `Lima`,它能在 macOS 上提供类似 WSL2 的体验,专注容器化工作流。支持架构与驱动,有开箱即用的容器化支持等特,安装和使用简单。

开源先锋
推荐文章7

Data Agent 落地挑战:忽略技术框架、语义能力和运营体系,投入可能打水漂

Data Agent 落地挑战大,90% 难点源于软件工程,统一语义层建设是关键。企业若忽略场景聚焦、技术框架迭代能力、语义模型和运营体系,投入可能打水漂。掌握相关要素,才能让 AI 代理落地应用,提升企业数据智能化效率。

AI前线
算法论文8

工行x上交大发布智能体研究成果,通过群体智能刷新翻译新高度!

2025年智能体系统成大模型研发新高地。工行大数据和人工智能实验室与上海交大人工智能学院推出智能体翻译系统TACTIC,以认知翻译学为指导,在相同模型配置下提升翻译效果,在小模型下提升更明显。

深度学习自然语言处理