「架构技术」共找到 4214 篇相关文章
腾讯3D生成模型上新!线稿可变“艺术级”3D模型,鹅厂内部设计师也在用
腾讯上新艺术级3D生成模型Hunyuan3D - PolyGen,支持生成复杂几何模型,鹅厂游戏工作室用后美术师建模效率提升超70%。该模型在拓扑功能实测表现佳,还介绍了其核心原理和技术。
国内外AI大厂重押,初创梭哈,谁能凭「记忆」成为下一个「DeepSeek」?
文章指出‘记忆’或成引爆新一轮AI浪潮的关键。当前,国内外AI大厂和初创企业纷纷入局,围绕‘记忆’研究是大模型新方向。‘记忆’是技术和应用的双重诉求,研究路线多样且各有优劣,未来竞争激烈,谁能突围尚未可知。
全球首个英伟达含量为0的万亿模型,成了海外开发者的抢手货
美团推出LongCat-2.0,是首个在国产算力上实现全链路训推闭环的万亿参数模型。它多项性能强,适配主流编程工具,架构设计原创,还证明了国产算力有支撑大模型迭代的能力,训推成本更低。
万字硬核解读SAM 3:不止分割一切,它开始理解世界了
Meta的SAM 3能理解语义,实现可提示概念分割。它支持开放词汇、全实例分割等,架构有创新,数据引擎高效。评估显示其性能优异,与MLLM结合成SAM 3 Agent后推理分割能力强,但在专业领域和复杂场景有局限。
重磅!OpenAI时隔五年再发布开源模型gpt-oss:开源SOTA,可在16g笔记本运行
谷歌推出Genie 3后,OpenAI宣布发布开源推理模型gpt-oss,有gpt-oss-120b和gpt-oss-20b两个型号,采用混合专家架构和4位量化方案,能快速推理,原生支持128k上下文长度。文章还介绍了模型表现、训练等情况。
大模型之外,向量存储如何支撑 Agent 的检索链路
文章指出大模型负责理解、推理和生成,而Agent需获取外部数据等。向量存储可将数据转化为语义向量,在Agent执行任务时找回相关内容。文章探讨向量存储技术方向,分享做法,还演示阿里云两种Serverless向量存储用法。
对话微分智飞高飞:看具身智能如何引发飞行认知革命 | GAIR 2025
雷峰网第八届GAIR大会邀请微分智飞高飞,探讨具身智能在飞行机器人领域应用。高飞指出其与传统无人机本质区别,介绍应用场景、分布式集群技术,还谈世界模型价值、挑战及创业契机,认为具身智能是历史拐点。
「上下文工程」 已经30岁了,而你可能刚知道它
上海创智学院刘鹏飞老师团队提出上下文工程2.0,剖析其本质、历史与未来。上下文工程已发展30年,是熵减少过程,旨在弥合人机认知鸿沟。其历史呈收敛曲线,每次技术突破引发三重连锁反应,当前人类正处通向3.0转折点。
当AI从云端“下沉”,Arm如何赋能端侧
端侧AI发展近十年,已进入应用快速拓展期,成为推动消费电子革新重要力量,但面临视觉处理、内存平衡和应用迭代等挑战。Arm推出相关平台与技术,如SME2,提升AI性能与能效,还与厂商合作,持续创新赋能端侧。
《麦肯锡2025 AI报告》|附下载
麦肯锡发布2025年AI报告,调查近2000家组织。虽88%企业用AI,但仅39%获实质财务回报。Agent热度高却远未量产,AI多在后端降本,红利多被高绩效企业获得,还改写企业组织架构。