大模型预训练」共找到 9479 篇相关文章

开源动态8

103K「硬核」题,让模型突破数学推理瓶颈

现有语言模型在数学推理训练时面临数据瓶颈,腾讯AI Lab与上海交团队推出DeepMath - 103K数据集。它规模、难度高、数据新颖、严格去污染,让DeepMath系列模型达SOTA,还能实现推理泛化。

机器之心
算法论文8

模型智能体如何突破规模化应用瓶颈,核心在于Agentic ROI

上海交通学联合中科研究指出,模型智能体规模化应用有瓶颈,核心在于Agentic ROI 未达实用门槛。研究提出其发展呈「之字形」,先规模提升信息质量,再轻量化降成本。

机器之心
开源动态8

用 1/1000 的参数打穿模型:我为什么强烈推荐 PaddleOCR

PaddleOCR是百度开源的OCR工具,模型参数仅0.07B,却能在复杂场景媲美模型精度。其新一代PP - OCRv5全面升级,在文本检测等方面表现出色,还稳定增长且在海外受关注。

MacTalk
产品应用7

规模化人工判断:Dropbox 如何借助语言模型优化 RAG 系统标注

为提升 Dropbox Dash 生成回复的相关性,工程师采用语言模型辅助人工标注。该方案解决了纯人工标注的局限,通过人工校准语言模型标注的方法,为 RAG 系统提供了有价值参考。

InfoQ
推荐文章8

斯坦福模型推理课免费了,谷歌推理团队创始人主讲

谷歌DeepMind推理负责人Denny Zhou在斯坦福学CS25讲“LLM推理”课。模型推理是给出答案前的中间思考步骤,能让复杂问题可解、提升答案准确性。还介绍了让模型输出推理答案的方法及提升推理能力要点。

量子位
算法论文7

直播预约 | 强化学习训练能否不依赖外部知识优化模型的弱点?

论文提出 SwS 框架,针对强化学习场景,利用模型自我感知弱点驱动自动化问题生成,合成针对性训练数据。还对其进行多项扩展,在多个基准测试集和模型上验证有效,性能提升显著。

深度学习自然语言处理
推荐文章7

OCR-Reasoning:揭秘多模态模型在复杂图文推理中的真实能力

主流OCR评测基准聚焦信息抽取任务,而图文推理任务缺乏系统性评估标准。OCR - Reasoning可系统性评估多模态模型深度推理能力,还给出多种推理示例,并展示了测评Qwen2.5 - VL - 7B模型的代码。

PaperAgent
算法论文8

文言文秒杀所有模型!100%攻击成功,轻松突破安全防线

南洋理工等机构团队提出基于文言文语境的自动化黑盒测试框架CC - BOS,利用果蝇算法和8维策略空间,暴露主流语言模型安全盲区,实验显示对6款主流模型攻击成功率达100%。

AIGC开放社区
推荐文章7

OCR-Reasoning:揭秘多模态模型在复杂图文推理中的真实能力

主流OCR评测基准聚焦信息抽取,复杂图文推理任务中多模态模型深度推理能力缺乏评估标准。OCR - Reasoning可系统性评估,还列举多种推理示例,并测评了Qwen2.5 - VL - 7B模型

CourseAI
新闻资讯7

从辅助工具到智能决策,模型如何改变人才选拔方式?

随着模型应用拓展,企业人力资源管理成落地热点。阿里巴巴技术专家程鹏认为,模型在人才选拔与培养中有效率、个性化、客观决策等颠覆性价值,也面临落地挑战,还分享应对策略等内容。

InfoQ