大模型V4」共找到 9263 篇相关文章

开源动态7

DeepSeek开源新基础模型,但不是V4,而是V3.1-Base

昨晚深度求索宣布DeepSeek线上模型版本升级至V3.1,在Hugging Face发布新模型DeepSeek - V3.1 - Base。该模型V3系列最新基础模型,发布后冲上Hugging Face热门榜第4位,社交网络看法不一。

机器之心
算法论文8

DeepSeek发布最新论文,5杀手锏让模型训练、推理暴涨

全球著名开源模型平台DeepSeek在huggingface发布超强开源模型V3的论文,从硬件架构和模型设计双视角探讨高效训练和推理,提出DeepSeek - MoE、多头潜在注意力等创新技术,解决内存、计算效率等难题。

AIGC开放社区
算法论文8

瘦身不降智!模型训推效率提升30%,京东模型开发计算研究登Nature旗下期刊

京东探索研究院模型研究登Nature旗下期刊。其提出系统与方法,经四创新使模型推理提效30%、训练成本降70%。成果支撑JoyBuild平台,可帮企业将通用模型转化为专业模型,加速商业化落地。

量子位
算法论文8

都在卷「让模型多循环几遍」,这个7B模型LoopCoder v2说:多循环 1 次就够了

当下推理模型流行在测试时多循环,以打磨答案。但新研究发现,7B模型LoopCoder v2只多循环1次(共2次),就能幅提升性能,继续增加循环次数,性能反而下降。研究还分析了收益与成本,给出选择循环次数的诊断方法。

机器之心
新闻资讯8

中国中文信息学会模型与生成专委会2025模型战略研讨会成功举办

2025年6月27日,中国中文信息学会模型与生成专委会2025模型战略研讨会在哈尔滨举办。会议探讨技术革命、交流成果、发布基金,多位专家作报告、参与思辨讨论,聚焦模型多方面话题。

深度学习自然语言处理
算法论文7

多模态模型不会画辅助线?最新评估得分:o3仅25.8%,远低于人类82.3% | 清华腾讯斯坦福联合

清华、腾讯、斯坦福等团队发布RBench - V基准测试,评估模型视觉推理能力。结果显示,主流模型如o3、Gemini2.5等准确率远低于人类,开源模型表现更差,暴露出模型在复杂多模态推理任务中能力不足。

量子位
推荐文章8

硬核拆解模型,从 DeepSeek-V3 到 Kimi K2 ,一文看懂 LLM 主流架构

本文详细列举 8 个主流语言模型,硬核拆解架构设计与革新思路,介绍架构演进趋势。如 DeepSeek-V3 的 MLA 与 MoE 技术,OLMo 2 的归一化策略,Gemma 3 的滑动窗口注意力机制等。

机器之心
算法论文8

AI 会笑吗?BIGAI & 上交团队:多模态模型是否真的能 get 到视频笑点|ACL 2026

上海交通学等团队构建v-HUB评测基准,分析多模态模型视频幽默理解能力。评测7个前沿模型发现,模型依赖文字、主动发现笑点能力弱,声音作用有限,还需考虑隐形线索。

AI科技评论
开源动态8

百度开源文心4.5系列10款模型,多项评测结果超DeepSeek-V3

今日百度正式开源文心模型4.5系列10款模型,涵盖不同参数规模。该系列模型在多文本和多模态基准测试达SOTA,多项评测超Qwen3、DeepSeek - V3,还具备三关键创新,获开发者关注。

Founder Park
新闻资讯8

年复出,入局模型

国产模型领域黑马StartLux-V1.0-27B-Preview,参数量仅27B,在信通院MCP测试中排综合第二,仅次于1.6万亿参数量的DeepSeek-V4-Pro。其创始人陈年押注本地模型,公司专注该领域商业化。

量子位