模型结构创新」共找到 8382 篇相关文章

推荐文章8

OpenAI 工程师最新演讲:代码只占程序员核心价值的 10%,未来属于“结构化沟通”

OpenAI工程师Sean Grove演讲指出,代码只占程序员核心价值10%-20%,80%-90%在于结构化沟通。他认为规约比代码更优,还以GPT - 4o“马屁精”问题为例说明规约作用,最后畅想万物皆规约的未来。

AI科技大本营
算法论文8

智能体如何学会「想象」?深度解析世界模型嵌入具身系统的三大技术范式

长期以来具身智能系统缺预测力,世界模型让智能体有了‘想象’未来的能力。中科大等机构团队综述将现有研究划分为模块化、顺序、统一三大架构集成范式,并指出未来研究方向。

机器之心
新闻资讯8

一场文心大模型的「AI马拉松」

2025 年模型能力至关重要,百度在基础模型研发持续投入。百度 AI Day 上,吴甜解读文心新模型技术,文心 X1 Turbo 推理强、成本低。百度技术体系完备,未来看好多模态与智能体,降成本促应用生态发展。

机器之心
开源动态8

LLaVA-OneVision-1.5全流程开源,8B模型预训练只需4天、1.6万美元

灵感实验室团队联合 LMMs - Lab 推出 LLaVA - OneVision - 1.5,全流程开源。其 8B 模型预训练 4 天、成本 1.6 万美元,在多模态基准上性能优,还公开数据构建与训练策略等细节,复现简单。

机器之心
开源动态8

Qwen3-Next:迈向更极致的训练推理性价比

文章发布Qwen3-Next架构及Qwen3-Next-80B-A3B系列模型,通过混合注意力等改进提升训练推理效率。介绍模型结构、性能优势,还说明使用方法,包括在多平台部署及处理超长上下文,展望持续优化架构。

通义千问Qwen
开源动态8

迈向AI4S 2.0,上海AI实验室开源书生万亿科学大模型Intern-S1-Pro

2月4日上海人工智能实验室开源万亿参数科学多模态大模型Intern - S1 - Pro,为AI4S迈向2.0提供开源基座。其核心科学能力跃升,底层架构创新,科学与通用能力协同发展,还构建了‘算力 - 算法’一体化基座,推动科研范式革命。

OpenMMLab
开源动态8

小米模型实现声音理解新SOTA!数据吞吐效率暴增20倍,推理速度快4倍 | 全量开源

小米全量开源MiDashengLM - 7B模型,它基于Xiaomi Dasheng和Qwen2.5 - Omni - 7B Thinker,实现声音理解新SOTA。性能领先,推理效率高,革新训练范式,全栈开源,将赋能多场景。

量子位
算法论文8

EMNLP 2025 Oral|检索增强 + 两阶段微调:剑桥提出有害内容检测大模型RA-HMD,性能SOTA

多模态有害信息检测是网络内容安全治理的重难点,多模态模型在有害内容检测上有瓶颈。剑桥大学团队提出RA - HMD框架,通过两阶段微调与结构增强,结合检索增强,提升检测性能,被EMNLP 2025接收。

深度学习自然语言处理
新闻资讯7

世界模型混战,Momenta率先冲刺IPO

当下世界模型是AI领域热门且混乱的概念,主流路线有四类。Momenta的R7世界模型已量产,其CEO定位公司为物理AI基座模型构建者。Momenta率先冲刺IPO,商业模式正转型,为后续玩家提供价值评估体系。

量子位
新闻资讯8

沈向洋解读AI演进五大维度!IDEA研究院发布“万物可抓取”模型,GPU渲染器打破国外垄断

沈向洋分享梳理智能演进的五个维度,包括算法范式、智能载体等,指出机会不仅来自技术本身。此外,IDEA研究院还发布“万物可抓取”DINO - X Grasp模型、MoonBit编程语言、GPU渲染器Smart等创新成果。

量子位