麦琪的花园」共找到 10518 篇相关文章

产品应用7

AI出码率70%+背后:高德团队如何实现AI研发效率量化与优化

文章围绕建立统一数据采集和指标体系,搭建AI统一数据采集能力,定义AI出码率等核心指标,构建AI效率研发指标体系,还介绍了数据采集方案、指标计算等,实现数据驱动闭环。

阿里云开发者
新闻资讯8

29个月增长100倍:一个AI 2.0公司应该怎么建?HeyGen取胜秘密

AI视频生成公司HeyGen在29个月内ARR从100万美元增长到超1亿美元。创始人Joshua Xu公开取胜秘密,即独特运营模式‘The HeyGen Way’,包括拥抱变化、匹配节奏、最小化快速验证迭代等理念。

AI工程化
算法论文8

LLM越狱攻击威胁被系统性高估? 基于分解式评分「越狱评估新范式」出炉

目前LLM越狱攻击评估常依赖间接指标或LLM宏观判断,易有偏差。德国、中国等研究团队提出JADES框架,用分解式评分机制,揭示过去高估越狱攻击威胁,为评估建新标准。

机器之心
算法论文8

挑战Claude48B Agent!NUS提出AgenTracer:面向多智能体系统失败归因

随着大语言模型发展,多智能体系统潜力大但失败率高。新加坡国立大学等机构研究者提出AgenTracer框架,构建标注管线、设计轻量级追踪器,在失败归因任务上超大型闭源模型,还能助力系统自我提升。

深度学习自然语言处理
算法论文8

挑战Claude48B Agent!NUS提出AgenTracer:面向多智能体系统失败归因

随着大语言模型发展,多智能体系统潜力大但有系统脆弱性问题。NUS研究者在论文中提出AgenTracer框架,构建标注管线,设计AgenTracer - 8B模型,在失败归因任务上超大型闭源模型,还能助力系统自我提升。

PaperAgent
推荐文章7

“老程序员”为啥不迷信 AI 带来效率提升?聊聊 AI 编码局限与现实

开发经验丰富人对AI编码提升效率更保守,因现有开发模式下,AI编程效率提升有限。特定场景AI给力,但项目复杂时提升迅速下降,还分析了原因,最后提到微服务架构或在AI编程时代重新火起来。

宝玉AI
算法论文8

想知道你LLM API被过度收费了吗?隐藏Tokens终于可以被审计了

马里兰大学CASE Lab团队研究商业不透明大模型服务(COLS),定义其风险,提出三层审计蓝图。还推出验证框架CoIn,能高效识别token数量膨胀,有可定制性且审计开销低,为构建信任提供技术支撑。

机器之心
开源动态7

一周1.2k星!兼具质量与效率OCR模型MonkeyOCR,支持多样化中英文PDF

MonkeyOCR采用SRR三元组范式,简化多工具流程、避免整页文档处理低效问题。与MinerU、端到端模型相比性能更优,处理速度也更快。暂不支持拍摄文档解析,文章还给出安装、推理等操作步骤。

GitHubStore
推荐文章7

MCP很好,但它不是万灵药!真正技术进步,往往始于祛魅之后清醒认知

当下AI领域,MCP热度高涨,但它并非万能。文章剖析MCP本质,指出它是统一工具调用协议,与Function Call合作。同时分析其开发难题与市场乱局,强调要理性看待,明确其定位和边界,发挥潜力。

腾讯技术工程
推荐文章7

The Batch: 894 | 面向生物医学多模态模型

过去几年联合推理模型进展快,但生物医学领域能力碎片化、脆弱或难解释。2026 年,学术界应推进多模态模型建设,关注深度整合、可解释性、数据效率和适应性及模型在工作流中整合。

DeeplearningAI