「多模态记忆系统」共找到 2896 篇相关文章
破局大模型训练黑盒,MegatronApp开源实现万亿参数「可视可控」训练
在2025上海QCon大会上,算秩未来赵伯罕博士指出万亿级大模型训练困境。上海期智研究院和算秩未来联合研发MegatronApp,以低入侵方式补齐链路,其四个模块形成闭环,让训练从黑盒变白盒,项目已开源。
AI赛博活佛Andrej Karpathy最新访谈:我学到了他最核心的思维方式
10月17日的Dwarkesh播客访谈里,AI科学家Andrej Karpathy分享思维方式、对AI发展的思考及做AI教育的思路。他用“一阶项”思维抓核心,教学先让学生经历问题,还提出知识可能拖累模型等观点。
24个月,从写第一行代码到破产:一位架构师在47个“死亡”项目里,看到的共同陷阱
架构顾问审阅47家初创公司代码库,发现它们因产品无法扩展、技术债积累走向停滞。提出花两周做架构可避免问题,还指出AI虽降低开发门槛,却加速技术债积累。
刚刚,全球AI生图新王诞生!腾讯混元图像3.0登顶了
LMArena竞技场发布文生图榜单,腾讯混元图像3.0夺冠,超越谷歌、字节和OpenAI等模型。它是原生多模态模型,语义理解强,核心技术独特,经多阶段训练,效果能与顶尖模型媲美。
700 美金买“真情”?AI情感类产品爆火背后:卖的不止是陪伴,而是年轻人的孤独
本文讲述林悦依赖AI情感陪伴应用的故事,指出当下AI情感陪伴类产品受欢迎,如字节‘显眼包’、卡西欧Moflin。分析市场大的原因,探讨核心价值、产品设计、商业模式等,也提及行业挑战。
全新合成框架SOTA:强化学习当引擎,任务合成当燃料,蚂蚁港大联合出品
蚂蚁通用人工智能中心自然语言组联合香港大学自然语言组推出PromptCoT 2.0,押注任务合成。它让30B - A3B模型在数学代码推理任务达SOTA,全面升级效果、数据和方法,还将考虑多方向发展。
vLLM PIECEWISE CUDA Graph 技术学习笔记
文章围绕vLLM PIECEWISE CUDA Graph技术展开,介绍了vLLM Compilation架构、分片编译技术、算子融合、集合通信融合、编译缓存、装饰器系统等内容,PIECEWISE技术让vLLM在prefill阶段性能提升。
6.1k星星!这个开源 AI 知识库火了。附教程,简单且实用。
知识管理是刚需,因数据安全问题,本地部署的开源知识库受关注。本文推荐PandaWiki,它是AI驱动的开源知识库搭建系统,安装部署简单,功能丰富,适用于企业和个人。
Nano Banana核心团队:图像生成质量几乎到顶了,下一步是让模型读懂用户的intention
这是对Nano Banana核心团队的专访。团队认为图像生成质量提升空间有限,未来关键在模型可表达性和读懂用户意图。还探讨了图像模型发展趋势、应用场景、产品设计、评估方式等,提及与传统工具将长期共存。
GUI 精准定位新 SoTA:LASER 让模型从“看全图”走向“锁重点”
多模态大模型在高分辨率、元素密集的 GUI 场景易误判。苏州大学 OpenNLG 团队提出 LASER 方法,让模型学会主动推理,通过关键区域聚焦等提升定位精度,在基准测试中表现出色。