多模型协同」共找到 9785 篇相关文章

产品应用8

开发者狂喜:Thinking Machines发布首款产品Tinker,后训练麻烦全给包了

OpenAI前CTO创办的Thinking Machines推出首款产品Tinker,这是用于微调语言模型的API,能简化LLM后训练过程,支持前沿模型,使用LoRA技术降低成本,还发布开源库,高校团队已试用。

机器之心
开源动态8

谷歌开源高效文本提取 Python 库LangExtract

谷歌开源 Python 库 LangExtract,能用大语言模型从非结构化文本提取结构化信息。它定位精确、输出可靠,支持模型,适应领域,还能处理长文档,通过示例介绍了使用方法。

GitHubStore
新闻资讯8

宇树智元共用一个大脑!神秘模型Demo炸场,10分钟一镜到底

一条10分钟一镜到底的Demo视频引发关注,视频中宇树和智元的机器人同用一个“大脑”,完成种任务,如擦窗、收纳等,还展现出跨本体协作等能力。该模型跳出主流具身模型固有框架,或改写具身智能行业认知。

量子位
产品应用7

调高一档推理强度,成本可能翻几倍:大模型思考原理讲清楚

文章详细讲解推理强度原理,指出其不改模型,只改草稿长度。还说明模型思考能提高答题准确率的原因,剖析贵和慢的原因,介绍三种控制形态,并给出判断推理强度档位的框架。

AI Reading Hub
算法论文8

北大王选所彭宇新团队:让模态大模型学会「看懂物种关系」丨CVPR 2026

北大王选所彭宇新团队在论文中提出TARA方法,引入生物分类学知识与模态模型中间表征对齐。实验显示,TARA能提升模型层级识别和未知类别识别能力,还可加速训练收敛,计算开销小。

AI科技评论
算法论文8

ACL 2025 | GALLa:给代码大模型装上“透视眼”,看懂程序的“骨架”!

蚂蚁集团与上海交大合作的 GALLa 研究被 ACL 2025 主会录用。它利用图神经网络将代码图结构信息注入大模型,在 7 个模型和 5 个任务上提升性能,推理与普通 LLM 一致,不增成本。

PaperAgent
开源动态8

可能是目前效果最好的开源生图模型,混元生图3.0来了

腾讯混元发布并开源原生模态生图模型混元图像3.0,参数规模80B,是参数量最大的开源生图模型,也是首个开源工业级原生模态生图模型,效果对标业界头部闭源模型。文中介绍其技术方案、测评效果等。

量子位
算法论文8

模型“拼好题”,45K数据撬动18%提升,数学问题拒绝死记硬背 | MathFusion

上海AI Lab等团队提出MathFusion,通过三种“融合策略”生成新的融合数据集MathFusionQA,仅用45K合成指令,在基准测试中平均准确率提升18.0个百分点,增强模型解决数学问题的能力。

量子位
产品应用7

昇腾910B大模型实测:开源框架能不能打?真相全放这了

文章对昇腾 910B 大模型进行实测,对比 vLLM Ascend 与 MindIE 在实际推理场景中的性能差异。通过 GPUStack 平台测试模型,结果显示两者在不同部署场景各有优势,vLLM 适合单卡小模型,MindIE 适合大模型卡部署。

探索AGI
开源动态7

一周1.2k星!兼具质量与效率的OCR模型MonkeyOCR,支持样化的中英文PDF

MonkeyOCR采用SRR三元组范式,简化工具流程、避免整页文档处理低效问题。与MinerU、端到端模型相比性能更优,处理速度也更快。暂不支持拍摄文档解析,文章还给出安装、推理等操作步骤。

GitHubStore