多语言翻译」共找到 4836 篇相关文章

算法论文8

都在卷「让大模型循环几遍」,这个7B模型LoopCoder v2说:循环 1 次就够了

当下推理模型流行在测试时循环,以打磨答案。但新研究发现,7B模型LoopCoder v2只循环1次(共2次),就能大幅提升性能,继续增加循环次数,性能反而下降。研究还分析了收益与成本,给出选择循环次数的诊断方法。

机器之心
产品应用7

Harness Monitor:当个 Agent 同时写代码时,如何看住质量

作者在有了 OpenAI 赞助的 Codex Pro 后,让个 Agent 同时在一个代码库工作。他开发的 Harness Monitor 从 Git 视角出发,解决 Agent 写代码时的质量问题,涉及观察、治理等方面能力。

phodal
推荐文章7

智能体自主规划模式性能提升:五大精准策略详解

本文基于智能体React模式实践,剖析自主规划架构挑战,如工具调用延迟等。提出五大优化策略,像用流式XML替代FunctionCall、合理压缩上下文等,还介绍创意加速器AI绘画创作功能,为智能体规划模式提供借鉴。

阿里云开发者
算法论文8

Meta联合Google新作:语言模型到底“记”了少东西?

Meta和Google合作的论文探讨现代语言模型对训练数据的“记忆”情况。研究发明新方法精确测量“记忆”量,发现模型记忆有上限且与参数线性相关,还揭示学习转折、隐私规律等重要结论。

深度学习自然语言处理
算法论文8

不让“猪队友”拖后腿!哈深新作 AgentDropoutV2,专治智能体“传话游戏”翻车现场

智能体系统中,常有agent出错带偏整体。哈工大联合阿里提出AgentDropoutV2,测试时介入,设‘质检员’审核输出,结合失败案例构建‘避坑指南’,在测试中显著提效,泛化性强。

深度学习自然语言处理
开源动态8

18.2K Star!macOS 丝滑跑Linux,一键容器、架构支持,开发效率直接起飞!

介绍轻量级虚拟机管理器 `Lima`,它能在 macOS 上提供类似 WSL2 的体验,专注容器化工作流。支持架构与驱动,有开箱即用的容器化支持等特性,安装和使用简单。

开源先锋
算法论文8

不再止步于自然语言!PhiZero让世界模型学会「物理语言

PhiZero由中科院自动化所团队研发,探索让AI读懂真实世界运动、交互与变化的“物理语言”。它构建Reason - then - Render框架,经大量数据训练,在基准测试中表现领先,为AI理解物理世界开辟新通道。

机器之心
算法论文7

CodeClash 通过轮编程竞赛对大型语言模型进行基准测试

为评估大型语言模型(LLM)编码能力,斯坦福、普林斯顿和康奈尔研究人员开发 CodeClash 基准测试,让个 LLM 在轮比赛中较量,涉及种代码竞技场,还评估模型分析代码库能力,未来将处理更大代码库。

InfoQ
产品应用8

证明也有「选择困难症」?腾讯AI Lab与大模型研究部联手打造 MPS-Prover ,视角破解形式化推理瓶颈!

本文聚焦逐步式自动化定理证明器困境,腾讯AI Lab等提出MPS - Prover。它有数据筛选和视角树搜索两项创新,提升搜索效率和证明质量,在基准表现佳,还解决六道IMO难题。

AI科技评论
开源动态7

推出 AnyLanguageModel:在 Apple 平台统一本地与远程大语言模型的 API

语言模型是构建现代软件的重要工具,但 Apple 平台开发者集成模型困难。Hugging Face 发布 AnyLanguageModel,是 Swift 包,可替代 Apple Foundation Models 框架,支持模型服务商,降低使用 LLM 难度。

Hugging Face