大模型V4」共找到 9362 篇相关文章

产品应用8

单机狂飙4万亿参数,国产AI「四天王」首次合体!这台超节点鲨疯了

国产「四开源天王」可在单机运行,背后是「元脑SD200」超节点。它有超显存、高速互联域和超强算力,支持64路本土GPU且可商用。浪潮信息以开源为战略加速模型商业化落地。

新智元
产品应用8

5000万用户、5000万美金ARR,全球第一AI创作消费平台要做AI时代Roblox

在AI模型军备竞赛中,用户侧出现‘智能过剩’。SeaArt成立两年半成全球访问量第一的AI内容创作社区,其2.0版本SeaVerse实现全流程自动化。该公司不陷‘卖模型’陷阱,商业模式独特,有望成AI时代全民级内容平台。

机器之心
开源动态7

原力灵机发布Realtime-VLA V2:从遥操作到真实部署,VLA提速的系统解法

原力灵机发布《Realtime - VLA V2》技术报告,在VLA控制下让机器人快速运动。实现数倍于遥操作采集训练数据的速度执行VLA,解决了遥操作数据采集、时序延迟等问题,还通过“油门式采集”提升速度,但离人类性能仍有差距。

AI科技大本营
新闻资讯8

DeepSeek V4 借实习生获奖论文“起飞”?梁文峰剑指上下文:处理速度提 10 倍、要“完美”准确率

ACL公布2025年获奖论文,中国作者比例超51%。DeepSeek梁文锋通讯、实习生袁境阳一作的论文获Best Paper奖。其提出NSA机制,实验显示性能优、准确率高、速度提升显著,成果或用于DeepSeek V4。

InfoQ
产品应用8

3B激活参数!商汤绝影Sage登顶PinchBench,端侧第一

商汤绝影Sage端侧模型在PinchBench评测中,以94%任务完成率超越Claude、GPT - 5.4等主流模型。它激活参数仅3B,算力需求低,还具备多项实用场景能力,靠SCOUT和ERL两项自研技术提升性能。

新智元
开源动态8

Transformers来到了v5时代:从工具包到真理之源,AI时代的操作系统内核的极简进化论

Transformers v5发布,通过极简定义和极致互通成AI生态核心。它做减法重构代码、拓展训练流程、成推理引擎弹药库、提升量化为核心功能,连接训练、推理与部署,是AI生态通用语言。

AIGC开放社区
开源动态7

卷疯了!这个清华系Agent框架开源后迅速斩获1.9k stars,还要“消灭”Prompt?

随着模型能力突破,Agent 从概念走向应用,各类框架不断涌现。清华系团队发布开源框架 Cooragent,获 1.9k stars。创始人王政分享 Agent 发展洞察,指出模型能力提升推动 Agent 商业化,还探讨 MCP、框架等多方面问题。

AI前线
开源动态7

小米在AI方向有了动作,但AI不该是资本掩盖信息的手段。

今年下半年小米MiMo团队陆续开源多个模型,或因年初挖来技术天才罗福莉。新开源MiMo - V2 - Flash模型,总参数量309B。但小米AI对外服务网站搜自家产品舆论无果,引发对AI应坦诚审慎的思考。

开源AI项目落地
产品应用8

全球首个「导航脑」上线!一句话让机器人自己找路回家

银河通用联合多所学发布全球首个跨本体全域环视导航基座模型NavFoM,让机器人能自主导航。它全场景、多任务、跨本体,重新定义导航逻辑,有技术创新和庞训练数据,还衍生应用模型推动具身智能商业落地。

新智元
产品应用8

RL后训练步入超节点时代!华为黑科技榨干算力,一张卡干俩活

模型竞赛白热化当下,强化学习后训练成突破LLM性能天花板核心路径,但算力浪费和集群效率低是难题。华为团队祭出两黑科技破局,在超节点实现训推共卡,资源利用率翻倍,还提升训练速度。

新智元