通用具身大模型AWE3.0」共找到 3338 篇相关文章

开源动态8

国产LLM又迎来一波开源潮:Qwen、华为盘古、腾讯混元、小米~

本周国产开源LLM集中爆发,Qwen、华为盘古、腾讯混元、小米等接连发布模型。如Qwen3 - 4B性能提升,Qwen - Image文生图能力强;华为开源盘古模型并宣布CANN开源;腾讯混元小尺寸模型特点多且已落地业务。

PaperAgent
新闻资讯7

GPT-5内测抢先公布:日常推理首次击败人类,编程数学科学问题能力都很强

疑似GPT - 5发布预告刚出,内测体验抢先释出。网友实测其推理能力首超人类,编程、数学等能力也出色,虽提升或没GPT - 3到GPT - 4明显,但市场竞争激烈,8月8日凌晨OpenAI发布或为GPT - 5。

量子位
新闻资讯7

DeepSeek-R2为什么还没发?

全网期待的DeepSeek - R2再次被曝推迟。The Information称因CEO不满其表现,且可能因缺英伟达H20芯片致研发慢。回顾其“难产”过程,网友看法不一,有人认为延迟值得,有人推测要等V4。

量子位
算法论文7

「Next-Token」范式改变!刚刚,强化学习预训练来了

微软新研究提出「强化预训练(RPT)」新范式,将下一个 token 预测任务重新定义为推理任务,可利用海量文本数据进行通用强化学习。该方法有可扩展性、低风险等优点,实验显示其提升了语言建模能力。

机器之心
开源动态8

小红书hi lab首次开源文本大模型,训练资源不到Qwen2.5 72B 的四分之一

6月6日,小红书hi lab团队首次开源文本大模型dots.llm1,采用MIT许可证。该模型激活参数量140亿,总参数量1420亿,上下文长度32K。训练资源不到Qwen2.5 72B的四分之一,在多个测评中表现出色。

AI前线
算法论文7

OpenAI久违发了篇「正经」论文:线性布局实现高效张量计算

OpenAI 近日发布研究论文,提出用于高效张量映射的统一代数框架 Linear Layouts,解决了 Triton 等深度学习编译器中长期存在的难题。该框架是使用二元线性代数的张量布局通用代数形式,评估显示其优化版 Triton 性能有提升。

机器之心
推荐文章7

如何通俗的读懂算力?

文章以拼图比赛作比,介绍了通用、科学、智能、AI专用这四种算力类型及其作用,指出摩尔定律失效下工程师探索创新提升算力。还阐述算力生态各环节,最后点明未来AI成算力市场核心引擎,中国算力发展亮眼。

芯师爷
推荐文章8

OpenAI帝国的真相与幻象——496页「Empire of AI」中文版电子书分享!

资深科技记者Karen Hao新书《Empire of AI》出版,496页巨著撕开OpenAI真实面貌。书中把其比作殖民帝国,揭露生成式AI繁荣背后隐形成本,还记录其从理想到现实转变、GPT - 3背后故事及2023年董事会政变等。

AGI Hunt
产品应用7

深度剖析 MCP SDK 最新版: Streamable HTTP 模式正式发布,为你实测揭秘

MCP SDK 新版本 v1.9.0 发布,新增 streamable HTTP 传输模式。本文对该模式全面剖析与实测,涵盖快速上手、核心参数、session - id 等内容,还介绍开发服务端及多应用实例模式,指出新模灵活性提升但有不足。

AI大模型应用实践
开源动态7

本文关注vllm V1中管控模型分布式推理的Executor部分,介绍其类型、Executor-Workers架构及数据传输机制,对比V0架构优势,以单机多卡的MultiprocExecutor为例展开讲解,还提及不同数据量的传输方式及相关代码。

猛猿