大模型测试」共找到 9626 篇相关文章

算法论文8

模型思考装上“猎鹰重装引擎” :腾讯混元 SEAT 重塑深度思考

本文深度解析腾讯混元最新发布的 SEAT 自适应并行扩展推理框架。它让模型 CoT 升级,应对复杂推理任务。该框架通过多轮并行推理和语义熵导航,解决模型深度思考的局限,且适配多种模型,性价比高。

AI科技大本营
新闻资讯8

模型第一股”打响上市前哨战!智谱GLM-4.7 刷新开源编程SOTA,修复代码、终端操作表现超Claude 4.5

冲刺模型第一股的智谱推出开源模型GLM - 4.7,主打编程与代理式任务提升。它在多项基准测试中表现出色,UI质量飞跃,还采用新推理机制。智谱上市在即,但亏损扩张快,研发投入

AI前线
产品应用8

模型虽好,但恕我直言:在OCR面前,开源小模型更香

作者所在公司项目需处理量纸质文档,起初考虑云端模型API调用和开源模型本地化部署,却因成本高、硬件要求高受阻。后经推荐调研PaddleOCR,其功能全、成本低、易用性强,最终被选为项目核心方案。

PaperAgent
开源动态8

模型结构化推理优势难复制到垂直领域!最新法律AI评估标准来了,抱抱脸评测集趋势第一

多个机构研究人员联合发布全新多语言法律推理基准数据集LEXam,它含4886道题,每道长篇题有答案和推理路径。研究显示现有模型应对法律推理难,LEXam引入评估新模式,还对不同模型做了测试

量子位
产品应用8

数学奥赛高分摘金,位列模型榜首,『书生』科学多模态模型Intern-S1能力再升级 | 通专融合新进展

2025年CMO决赛首设AI测试,书生科学多模态模型Intern-S1以102分位列模型得分榜首,远超金牌线和国家集训队入选线。其推理能力提升得益于多项创新,未来将拓展至多领域科研。

OpenMMLab
算法论文8

CVPR 2026|突破3D空间推理瓶颈:北联合南科提出QuatRoPE,让模型精准理解三维物体关系

联合南科团队提出全新 3D 位置嵌入方法 QuatRoPE,改善语言模型 3D 空间推理痛点。还提出 IGRE 降低干扰,构建 ASR 基准评估能力。研究被 CVPR 2026 接收,代码与模型已开源。

机器之心
新闻资讯8

硬核「吵」了30分钟:这场模型圆桌,把AI行业的分歧说透了

在WAIC 2025模型论坛的“模型之问”圆桌中,多位行业佬围绕模型展开辩论,话题涉及训练范式、模型架构、数据、开闭源等核心问题,不同观点碰撞,深入探讨模型技术演进与发展之路。

机器之心
新闻资讯8

微软分享三王炸算法:突破模型推理瓶颈,性能

今天凌晨微软官网分享三创新算法,即rStar - Math、LIPS、CPL,可助模型突破推理瓶颈,增强数学推理和思考链能力,还介绍了各算法原理、优势及对应论文地址。

AIGC开放社区
新闻资讯7

国产开源模型越多,模型路由的机会越

中国模型市场模型增多,能力相近、价格降低且部分开源。开发者选择多但企业选模型难,价值向调度层转移。开源改变产业结构,Routing业务有价值且至少含四层,中国Provider Routing易落地。

newtype AI
新闻资讯7

《AI模型与异构算力融合技术白皮书》正式发布

10月10日,中科算网等联合发布《AI模型与异构算力融合技术白皮书》,聚焦模型开发痛点,为开发者提供技术参考。白皮书介绍全球模型发展概况、应用场景拓展、算力需求与挑战,指出异构算力成主流趋势。

AIGC开放社区