复杂文档处理」共找到 1961 篇相关文章

算法论文8

推理即排序:ReasonRank反常识的2.7倍效率跃迁,新SOTA比快更快

论文提出新型排序模型ReasonRank,将深度推理能力融入排序流程,突破数据瓶颈,采用创新训练框架,效率比主流点对点排序模型快2.7倍,还介绍方法论、技术突破、实验验证等内容,指出局限与未来方向。

深度学习自然语言处理
产品应用8

央企出手,让选大模型更容易了!中国移动发布MoMA聚合服务引擎

7月26日,中国移动在世界人工智能大会发布MoMA多模型与智能体聚合及服务引擎。它汇聚优质模型与智能体,为复杂任务提供方案,解决调度、意图理解、成本收益平衡等难题,还应用于灵犀智能体2.0。

量子位
算法论文8

首次结合RL与SFT各自优势,动态引导模型实现推理⾼效训练

新一代大型推理模型在复杂推理有进展,核心是ZERO - RL训练法。华为香港研究所小艺团队等合作推出GHPO算法框架,融合在线强化学习与模仿学习,解决了RLVR方法局限,提升模型训练效果,代码数据开源。

机器之心
算法论文7

苹果港大终结自回归时代?7B扩散模型发布,AI写代码逻辑彻底颠覆!

苹果联合港大开源扩散大语言模型DiffuCoder,用扩散模型+强化学习策略,性能提升4.4%。研究还提出耦合梯度奖励策略优化方法,建立原生RL训练框架,探究了dLLM的生成机制等问题。

新智元
算法论文8

Meta-Think ≠ 记套路,多智能体强化学习解锁大模型元思考泛化

上海交通大学等团队提出ReMA框架,将复杂推理解耦为元思维和推理智能体,通过迭代强化学习协作。在单轮实验中,ReMA在多基准测试表现优;多轮实验虽有提升但不稳定,需进一步探索。

机器之心
开源动态8

AI秒懂短视频,快手大模型Keye-VL理解力爆表!技术细节全开源

快手全新多模态大语言模型Kwai Keye-VL上线且开源,能深度融合多模态信息,在视频理解、复杂视觉感知和逻辑推理上表现优异。介绍了其技术架构、预训练和后训练策略及训练架构优化等内容。

新智元
新闻资讯8

继AlphaFold之后,DeepMind再放“大招”:AlphaGenome直击疾病根源

谷歌DeepMind推出AI模型AlphaGenome,可预测DNA序列微小变化对基因调控的影响,已向非商业研究领域开放。它能处理长序列、输出高分辨率结果,有四大优势,在多领域有研究潜力,但也存在局限。

AI寒武纪
开源动态8

“甲方快乐模型”诞生,拿下平面设计新SOTA!多条件一键生成,还能独立调整元素 | 复旦&字节

复旦大学和字节跳动团队联合提出CreatiDesign新模型,可实现高精度、多模态、可编辑的AI图形设计生成。它解决了以往方法在处理图形设计时的难题,在多维度评估基准上表现出色,还支持多轮编辑。

量子位
产品应用8

Karpathy教你值回ChatGPT 200刀「票价」,初创工程师揭秘ChatGPT最核心能力

AI大神Andrej Karpathy用一张图教你选ChatGPT模型,给出使用指南,如简单问题用4o,困难问题用o3等。初创工程师Eric Hayes揭秘其背后复杂记忆系统,含保存记忆、聊天历史等,提升了用户体验。

新智元
产品应用7

Web 开发 AI 就选它?V0复合架构无错误率 93.87% 远超 Claude 4 Opus 单体!

Vercel推出新AI模型v0系列,采用复合模型架构,将RAG专业知识、SOTA大模型推理能力和定制流式后处理模型结合,能提升代码生成质量,且基础模型升级时可快速替换,还训练了定制AutoFix模型。

AI进修生