「全栈架构」共找到 3528 篇相关文章
MemOS:一种用于 AI 应用的记忆操作系统
大型语言模型缺乏记忆管理系统,限制其发展。MemTensor与高校联合开源MemOS,它将记忆视为可管理资源,有三层架构,系统化三种记忆类型。评估显示其在推理、检索、加速等方面表现优异。
Fable 5夺冠!全球18大顶尖AI自主科研大赛,逼近人类极限
Prime Intellect公开大规模AI自主科研实验,18大顶尖模型断网8天挑战nanoGPT优化器速通,Fable 5追平人类82%的水平,AI开始独立完成科研闭环,但目前尚无模型有全新方法。
你的AI Agent越用越蠢?港中大、浙大戳破「记忆」的谎言
香港中文大学联合浙江大学发布论文指出,当前主流的Agent记忆方案只是「备忘录」,而非真正的记忆。论文归纳出三大结构性缺陷,提出双系统共存架构,引发学术界广泛讨论。
硬件成本直降60%!原生分布式VS传统分库分表数据库
服务器硬件价格上涨,传统分库分表架构资源利用效率低。OceanBase 作为原生分布式数据库,通过多种技术优化资源,降低硬件依赖,多个案例显示其能大幅降低成本、提升性能,获 Forrester 认证。
范式跃迁:LLM + EC重构算法设计范式,华为&港城大夺冠CVRP国际顶级赛事
近日,华为与港城大联合团队‘OptVerse - CityU’在CVRPLib BKS全球挑战赛夺冠。他们用‘大模型(LLM)+进化计算(EC)’架构,刷新98个历史最优解,51个设新纪录,验证AI在算法设计潜能。
国产GPU又杀出一匹黑马!成立不到一年,两款芯片量产落地
在国产算力从‘技术可用’向‘场景好用’转型时,成立不到一年的芯桥半导体携Sinexus X200、S200系列国产高性能GPGPU产品杀入战场,构建全栈式解决方案,适配多行业场景。
Lumina-DiMOO:多模态扩散语言模型重塑图像生成与理解
上海人工智能实验室推出多模态扩散语言模型 Lumina - DiMOO,它基于离散扩散建模,打破多模态任务壁垒。相比传统自回归架构模型,它解决了生成慢、质量受限等问题,在多项评测中夺魁。
这个百万月活的 AI 社区,做成了「二次元版 Sora」
文章介绍了百万月活的AI社区「捏Ta」,它类似「二次元版Sora」。其独特之处在于受年轻人喜爱、规避真人肖像问题、玩法多样。产品功能降低创作门槛,覆盖全流程,形成活跃社区生态。
解读Qwen3文本嵌入与重排序技术版图
文本嵌入和重排序是NLP和信息检索关键组件。Qwen3 Embedding、Qwen3 Rerank模型基于Qwen3基础模型构建,有三种参数尺寸。文章介绍其架构、训练方案,还给出实战代码。
超越OpenAI、拿下全球双料第一,“AI吴彦祖”背后大模型SOTA了!
国产大模型MiniMax发布Speech - 02,拿下两项全球权威语音基准测评第一,是榜单前十唯一国产玩家。它超拟人、个性化、多样,技术创新,且在多行业落地,全模态布局领先。