大模型架构图」共找到 9807 篇相关文章

产品应用7

模型成为公共基础设施,特赞如何架构企业级 Agentic AI?

模型成公共基础设施,企业需构建围绕业务结构的智能系统架构。特赞提出的 GEA 企业级智能体架构体系,围绕企业业务运行结构设计,能让智能体参与企业经营判断。

AI科技评论
开源动态8

开源即爆火!英伟达重磅推出OmniVinci全模态模型

英伟达在华盛顿GTC会开源OmniVinci全模态语言模型,实现视觉、音频、语言统一理解。它性能超竞品,架构有创新,数据引擎庞。实验有重要洞察,在多场景表现佳,代表全新AI范式。

机器之心
新闻资讯7

刚刚,智谱正式成“全球模型第一股”,开盘涨超3%!10位董事7个清华背景,专家:国内IPO抢收“确定性”,OpenAI们豪赌“无限性”

今天,智谱在港交所正式挂牌上市,成“全球模型第一股”。其有技术、产品、商业化等竞争力,但未盈利,研发投入。专家认为国内模型厂商上市是抢收确定性,而OpenAI等是扩展无限性。

InfoQ
新闻资讯7

Meta发最强模型打响价格战,小扎对谷歌贴脸开!北校友立

九月刚过3天就有五个前沿模型发布,Meta发布Muse Spark 1.3踢馆谷歌Gemini 3.8 Flash。它跑分提升、成本低,性价比高,但也遭质疑,模型下半场或比拼系统架构和智能体工程能力。

新智元
开源动态7

开源DeepSeek R1增强版:推理效率快200%,创新AoE架构

德国TNG公司开源DeepSeek R1增强版DeepSeek - TNG - R1T2 - Chimera,基于三模型混合开发,采用创新AoE架构,推理效率比R1 - 0528快200%,成本减,在主流测试中性能更好。还介绍了AoE架构构建子模型方法。

AIGC开放社区
新闻资讯7

LeCun离职后不止创一份业!押注与模型不同的路线,加入硅谷初创董事会

离开Meta后,Yann LeCun创立AMI,还加入Logical Intelligence任技术研究委员会主席。该公司推能量 - 推理模型,与主流模型路线不同,其Kona模型在数独测试上表现远超模型

量子位
算法论文7

多模态模型不会画辅助线?最新评估得分:o3仅25.8%,远低于人类82.3% | 清华腾讯斯坦福联合

清华、腾讯、斯坦福等团队发布RBench - V基准测试,评估模型视觉推理能力。结果显示,主流模型如o3、Gemini2.5等准确率远低于人类,开源模型表现更差,暴露出模型在复杂多模态推理任务中能力不足。

量子位
新闻资讯8

模型竞赛转向:决胜关键为何是“后训练”?

模型价值主战场正向后训练转移。xAI发布的Grok 4通过后训练取得强性能,在多项测试中领先。后训练可解决通用模型产业落地难题,不同公司探索新方法,且后训练有五关键要素,阿里云提供一体化支撑。

InfoQ
新闻资讯7

250份文档就能给模型植入后门:不分参数规模

Claude母公司Anthropic联合英国AISI和图灵研究所研究发现,仅250份恶意文档就能给不同规模模型植入“后门”漏洞,打破了以往对模型数据中毒的认知,给厂商提了个醒。

量子位
算法论文8

AAAI 2026|视频语言模型到底可不可信?23款主流模型全面测评来了

合肥工业学与清华学团队推出视频语言模型综合可信度评测基准 Trust-videoLLMs,对 23 款模型从五维度 30 项任务评测,揭示性能格局,指出模型现存问题,还开源评测框架等。

机器之心