AI 模型构建」共找到 13941 篇相关文章

新闻资讯7

AI圈水太深:OpenAI保密、Meta作弊!国产MoE却异军突起

文章梳理大语言模型发展,从传统稠密架构到稀疏MoE架构,参数从百亿到万亿。介绍OpenAI、Meta等厂商模型,如GPT系列、Llama系列,还提及Mixtral、DeepSeek V3等。指出Meta作弊丑闻,国产MoE模型异军突起。

新智元
算法论文8

DeepSeek发布最新论文,5大杀手锏让大模型训练、推理暴涨

全球著名开源大模型平台DeepSeek在huggingface发布超强开源模型V3的论文,从硬件架构和模型设计双视角探讨高效训练和推理,提出DeepSeek - MoE、多头潜在注意力等创新技术,解决内存、计算效率等难题。

AIGC开放社区
开源动态8

代码、多模态检索全面登顶SOTA!智源BGE向量模型三连击,并全面开放

检索增强技术在代码及多模态场景作用大,向量模型是关键。智源研究院联合高校研发三款向量模型BGE - Code - v1、BGE - VL - v1.5、BGE - VL - Screenshot,登顶多领域测试基准,已全面开放助力研究与应用。

机器之心
推荐文章8

别再用提示词去 AI 味了,方向就是错的

当下“去AI味”需求大,但用提示词去AI味是错的。原因有产出内容同质化、提示词一次性、未告知AI具体风格。作者提出写作风格Skill方案,介绍了制作步骤、模板及与其他技能的组合。

宝玉AI
新闻资讯8

刚刚,AMD、OpenAI联合发布超强AI芯片,推理提升35倍

今天凌晨,AMD举办2025全球AI发展大会,与OpenAI联合发布Instinct MI400、Instinct MI350系列超强AI芯片。MI350推理性能提升35倍,MI400内存配置大幅提升。AMD还开源ROCm7平台,7大AI平台与其合作。

AIGC开放社区
新闻资讯8

内容娱乐新风向:这群创业者靠多模态 AI 玩出了新花样

12月23日,「MASHANG DEMO TO DAILY」第二期活动在杭州开启,展示多模态AI探索成果。6位创业者分享精华内容,涉及游戏开发、虚拟社区、视频创作等领域,探讨多模态AI产品价值与发展方向。

特工宇宙
开源动态8

WAIC抢先爆料:金融“黑马”大模型超DeepSeek刷新SOTA,论文已上线

WAIC期间,蚂蚁数科金融推理大模型发布会未开,论文已上线。其新模型Agentar - Fin - R1有8B和32B版,在金融测评集超DeepSeek等,还兼顾专业与通用,蚂蚁数科还提出评测基准Finova。

量子位
新闻资讯7

15岁少年养AI龙虾,月入3万美元!智能体黄金时代真来了

OpenClaw发布2026.3.13更新,实现无需插件关联用户实时会话的技术突破。15岁少年用其赚超3万美元合同收入,还有多人借AI创业。AI正从工具向员工、创业者转变,未来或现AI经理人。

新智元
新闻资讯8

2026夏季崇礼论坛五大看点,AI如何走进生活|甲子光年

2026年9月12 - 13日,2026夏季崇礼论坛将在崇礼·太舞小镇举行,主题为“未来此刻”。有五大看点,包括俞敏洪等探讨AI能力与入口,揭晓“AI NEXT 20”榜单,多场硬件、内容等相关圆桌及产品展示。

甲子光年
新闻资讯7

AI,写代码只会更慢!但一定更「快乐」

METR研究实测发现,GPT等AI编程工具让顶尖程序员写代码平均慢19%,效率不升反降。开发者本预计提效24%,体验后仍觉快20%。研究还分析变慢原因,提醒勿高估AI编程能力。

新智元