大模型架构」共找到 9813 篇相关文章

算法论文8

联手通义实验室发布ZeroSearch:成本暴降88%,无需搜索即可激活语言模型的检索能力!

与通义实验室发布ZeroSearch框架,可无需真实搜索激活语言模型检索能力。它引入语言模型模拟搜索、采用结构化模板等策略,成本降88%,多项实验显示其性能超越基线与真实搜索方法。

深度学习自然语言处理
算法论文8

模型如何泛化出多智能体推理能力?清华提出策略游戏自博弈方案MARSHAL

近日,清华学等机构研究团队提出 MARSHAL 框架,利用强化学习让模型在策略游戏自博弈。实验表明,多轮、多智能体训练提升了模型博弈决策水平,将推理能力泛化到通用多智能体系统,在一般推理任务表现显著提升。

机器之心
产品应用8

揭秘夸克首个高考志愿模型!蒸馏数百名人类专家经验、Agent 可完整生成志愿报告

6月12日,夸克发布国内首个高考志愿模型,上线‘高考深度搜索’等三核心功能。其‘志愿报告’以Agent运行,能输出完整报告;模型经多阶段训练,搭载最高考知识库,为考生提供精准志愿填报服务。

AI科技大本营
开源动态8

模型开发者必读!拆解世界级AI模型的诞生,Hugging Face把4年模型训练经验写成了一本开源指南

Hugging Face发布《The Smol Training Playbook》,分享约4年构建SOTA模型和数据集的经验。手册涵盖是否训练、训练何种模型、如何训练等内容,强调数据质量重要性,还介绍了模型设计、训练中的实践与教训。

AIGC开放社区
新闻资讯7

刚刚,OpenAI Astra核心架构爆出:模型第三条Scaling法则诞生

The Information记者爆料OpenAI即将推出的Astra模型采用“recurrent depth”新推理方法,该技术能降本提效,但引发AI安全与可观测性担忧。清华与字节论文解决了循环模型“算力不公平”问题,并给出Scaling Law。

AI寒武纪
开源动态8

浙江学联合华为发布国内首个基于昇腾千卡算力平台的DeepSeek-R1-Safe基础模型

2025年9月18日,浙江学任奎教授团队联合华为在“华为全联接会2025”发布国内首个基于昇腾千卡算力平台的DeepSeek-R1-Safe基础模型,提升了我国AI系统自主安全防控水平,该模型已全面开源。

AIGC开放社区
开源动态8

NeurIPS 2025 | 中科、港中深、通义千问联合发布CoRT:仅30个样本教会模型高效推理,token消耗降低50%

型推理模型在精确数学计算上存在问题,如认知冲突、行为低效、数据稀缺。中科、港中深、通义千问联合推出CoRT框架,用创新数据合成与多阶段训练,提升模型推理能力和效率,成果已开源。

机器之心
新闻资讯8

哈佛《Science》研究:模型已碾压人类医生!

哈佛医学院等团队让OpenAI o1系列模型与数百位医生在多项测试中较量,模型在各项诊断和管理推理任务上全面超越人类专家,不过当下模型处理非文本信号有局限。

AIGC开放社区
新闻资讯8

全球顶尖模型一夜惨遭血洗!最难测试人类拿满分,AI第一名得0.2%分

全球最难AGI测试ARC - AGI - 3上线,人类满分通关,最强模型Opus 4.6仅得0.2%。测试从静态题变为互动游戏,评分看效率。前沿模型得分低,非LLM方案表现更好,AI缺乏元认知能力。

新智元
产品应用8

腾讯模型动作慢了吗?姚顺雨带着Hy3 preview杀进第一梯队

国内模型发展迅速,腾讯此前动作较慢。姚顺雨加入后推动变革,混元团队重建推出Hy3 preview,有295B总参数和快慢思考融合架构,开源且性能优,在多方面表现出色,成本下降。

AIGC开放社区