参数量」共找到 1240 篇相关文章

开源动态8

小红书hi lab首次开源文本大模型,训练资源不到Qwen2.5 72B 的四分之一

6月6日,小红书hi lab团队首次开源文本大模型dots.llm1,采用MIT许可证。该模型激活参数量140亿,总参数量1420亿,上下文长度32K。训练资源不到Qwen2.5 72B的四分之一,在多个测评中表现出色。

AI前线
算法论文8

极简RL新范式:一半算力刷新1.5B模型推理SOTA

过去为提升中小参数量模型推理能力,开发者构建复杂RL流水线。JustRL论文提出极简、单阶段、固定超参训练方案,在两主流1.5B模型上刷新SOTA,节省2倍算力,消融实验还揭示部分技巧会致性能退化。

深度学习自然语言处理
开源动态8

Suno最强开源对手来了!ACE Studio和阶跃星辰联合开源了一款音乐模型,20秒即可生成4分钟神曲!

ACE Studio和阶跃星辰联合开源音乐模型ACE - Step,参数量3.5B,结合多种技术,支持多语言多风格音乐生成。20秒可生成4分钟歌曲,比传统模型快15倍,有多种功能亮点,还介绍了上手步骤和应用场景。

开源星探
产品应用8

Qwen3.8-Max首发上线阿里千问AI平台,API服务与Token Plan同步开放

今日,阿里巴巴发布新一代基座大模型Qwen3.8,千问AI平台首发其Max版API服务与Token Plan。Qwen3.8参数量2.4万亿,性能居前列,推理快且能自主编程。API性价比高,平台还为Token Plan用户提供优惠。

阿里云开发者
推荐文章7

AI Agent时代的「AWS」:Manus 背后的重要功臣 E2B 是何来头?

文章介绍 E2B 这一开源基础设施,它为 Manus agent 提供虚拟电脑支持,允许在云端安全沙盒运行 AI 生成代码。其沙盒月创建一年增 375 倍,CEO 目标是成 AI Agent 时代的 AWS,还探讨了 AI Agent 相关问题。

Founder Park
新闻资讯7

马斯克甩出两张王牌,Grok Build杀入AI编程

5月14日,xAI上线Grok Build编程智能体,这是马斯克补齐xAI编程短板的第一步。此外,马斯克亮出下一代基础模型Grok V9,它在参数规模、硬件平台、数据质三方面做了重建。V9公开版上线后,Grok Build将与Claude Code、Codex正面竞争。

新智元
新闻资讯7

飞轮“倒转”,灵巧手厂商困在夹缝里

2024年具身智能焦点转向灵巧手,初创公司遭上下游夹击。技术远未成熟价格战却已升级,投资者押注最AI、最像人手、最早产。但智能不足、应用场景不明确,降本成唯一共识,行业陷入“降本缺规模”死循环。

AI科技评论
开源动态8

老黄杀入OpenClaw战场!最强开源「龙虾」模型直逼Opus 4.6

英伟达推出新一代开源模型Nemotron 3 Super,专为大规模AI智能体打造,有1200亿参数,推理快、吞吐高,性能直逼Claude Opus 4.6等。它解决了Agent应用的难题,还开源了相关数据和训练方法。此外,英伟达还在打造NemoClaw开源AI智能体平台。

新智元
产品应用8

AI Code要变天了,Meta首个代码世界模型登场!

Meta FAIR推出32B参数的代码世界模型(CWM),旨在探索世界模型如何改变代码生成和推理,code和mode已开源。在SWE - bench验证中表现优,能与更大规模或闭权重的LLM竞争,还介绍了训练、数据集等情况。

PaperAgent
新闻资讯7

ChatGPT正式上线广告主平台,AI产品从今天开始走向分裂。

今日凌晨,OpenAI更新ChatGPT,上线非推理模型GPT - 5.5 Instant,还官宣向企业主全上线广告平台。此前广告已在部分地区测试,付费和未成年用户无广告,免费用户可选择关闭但功能受限。投放端向美企开放,出价高,这或成AI产品宿命。

数字生命卡兹克