大模型Agent」共找到 10509 篇相关文章

新闻资讯7

AI Infra 工程师们如何应对模型流水线里的“暗涌”?

InfoQ《极客有约》X AICon 直播邀请华为、蚂蚁集团等专家探讨模型 Infra 工程师实战日常。涉及模型工程高频问题、版本迭代冲突处理、推理部署成本优化、开源项目挑战及 GPU 虚拟化趋势等内容。

AI前线
算法论文7

5维度、4类模态:LLM/Agent数据分析技术全景图

文章分享《LLM/Agent-as-Data-Analyst: A Survey》,上交、清华、微软等将「LLM/Agent 当数据分析师」技术拆成 5 设计维度与 4 类数据模态,给出 100+ 代表性方法等,还介绍不同数据类型的分析技术。

PaperAgent
推荐文章7

AI Infra 工程师们如何应对模型流水线里的“暗涌”?

InfoQ《极客有约》X AICon 直播,邀请华为昇腾专家 ZOMI 酱、蚂蚁集团马介悦和 SGLang 尹良升探讨模型 Infra 工程师实战日常。涉及模型工程高频问题、版本迭代策略、推理部署优化、开源项目挑战等内容。

InfoQ
开源动态8

用 1/1000 的参数打穿模型:我为什么强烈推荐 PaddleOCR

PaddleOCR是百度开源的OCR工具,模型参数仅0.07B,却能在复杂场景媲美模型精度。其新一代PP - OCRv5全面升级,在文本检测等方面表现出色,还稳定增长且在海外受关注。

MacTalk
产品应用7

规模化人工判断:Dropbox 如何借助语言模型优化 RAG 系统标注

为提升 Dropbox Dash 生成回复的相关性,工程师采用语言模型辅助人工标注。该方案解决了纯人工标注的局限,通过人工校准语言模型标注的方法,为 RAG 系统提供了有价值参考。

InfoQ
推荐文章8

斯坦福模型推理课免费了,谷歌推理团队创始人主讲

谷歌DeepMind推理负责人Denny Zhou在斯坦福学CS25讲“LLM推理”课。模型推理是给出答案前的中间思考步骤,能让复杂问题可解、提升答案准确性。还介绍了让模型输出推理答案的方法及提升推理能力要点。

量子位
推荐文章7

OCR-Reasoning:揭秘多模态模型在复杂图文推理中的真实能力

主流OCR评测基准聚焦信息抽取任务,而图文推理任务缺乏系统性评估标准。OCR - Reasoning可系统性评估多模态模型深度推理能力,还给出多种推理示例,并展示了测评Qwen2.5 - VL - 7B模型的代码。

PaperAgent
开源动态8

腾讯混元开源 4 个小尺寸模型,主打 Agent 和长文

8月4日,腾讯混元开源四款小尺寸模型,参数为0.5B、1.8B、4B、7B,消费级显卡可运行,适用于低功耗场景。模型具备推理快、性价比高特点,亮点是Agent和长文能力,已在腾讯多业务应用。

InfoQ
算法论文8

文言文秒杀所有模型!100%攻击成功,轻松突破安全防线

南洋理工等机构团队提出基于文言文语境的自动化黑盒测试框架CC - BOS,利用果蝇算法和8维策略空间,暴露主流语言模型安全盲区,实验显示对6款主流模型攻击成功率达100%。

AIGC开放社区
推荐文章7

OCR-Reasoning:揭秘多模态模型在复杂图文推理中的真实能力

主流OCR评测基准聚焦信息抽取,复杂图文推理任务中多模态模型深度推理能力缺乏评估标准。OCR - Reasoning可系统性评估,还列举多种推理示例,并测评了Qwen2.5 - VL - 7B模型

CourseAI