「无状态架构」共找到 2535 篇相关文章
深度拆解 Muse Glimmer,24GB 显存跑 30B Agent,Meta 到底做了什么?
昨天,Meta发布约30B参数的多模态Agent模型Muse Glimmer,支持128K级上下文。它采用Apache 2.0许可证开放,有量化版本等。其技术设计围绕显存、上下文管理等问题展开,在多方面做了取舍。
搜索智能体也需要「操作系统」:SearchOS 开源多智能体协作框架
人大和蚂蚁的 SearchOS 研究,给出搜索智能体在长程任务中问题的答案。它借鉴数据库理念,做了多项核心设计,在开放信息检索基准评测领先,已提供多种使用方式,值得长程调研尝试。
逛完WAIC,我们发现这家芯企已经把端侧AI“场景落地”做实
7月17 - 20日,世界人工智能大会召开,端侧AI成热点。瑞芯微展台展示大模型、Agent、AI+应用,多方案已量产落地,其双轨架构优势突出,还规划了产品路线图。
记忆奇点来临!人类三十万年遗忘被哈佛神经科学家终结
哈佛医学院神经科学家 Gabriel Kreiman 推出 Engramme,旨在赋予人类完美且无限的记忆。它能在特定场景下主动推送相关记忆,构建了大记忆模型,有深厚研究积累,已开放 beta 版申请。
中国AI芯片如何破局?这家公司重注推理芯片
2月3日,云天励飞董事长陈宁在战略前瞻会表示要All in AI大算力推理芯片,打造“中国版TPU”。他认为2025 - 2035年是推理芯片高光时刻,还介绍了公司技术壁垒、差异、战略及生态等内容。
Yann LeCun炮轰通用智能完全是BS!Demis Hassabis回怼:大错特错
Yann LeCun在采访中称世上无“通用智能”,认为该概念是胡扯。Demis Hassabis回怼,指出LeCun混淆概念,并从大脑特性、理论可行性及人类文明跨越三方面反驳。
智源悟界 · Emu3.5 重塑世界模型格局:首提多模态 Scaling 范式,AI 理解世界再进化
北京智源研究院发布大规模多模态世界模型“悟界·Emu3.5”,它能模拟复杂动态物理世界,揭示“多模态Scaling范式”。该模型继承深化Emu3技术哲学,在多方面有提升,为世界模型领域提供进化路线。
Meta CTO打脸扎克伯格:首秀翻车全因致命bug,AI智商捉急、语音交互全面崩盘
Meta Connect开发者大会上,Meta发布三款智能眼镜,现场演示却屡屡翻车。扎克伯格将问题归咎于Wi-Fi,CTO Bosworth否认,称是资源管理和软件错误。网友对Meta解释不满,质疑团队能力。
Yann LeCun最新纪录片首曝!传奇AI教父的双面人生,深度学习幕后40年
Yann LeCun新纪录片上线,回顾其深度学习四十年历程。他是深度学习开创者、Meta首席AI科学家,坚信机器应学会学习,认为AI竞争是开放与封闭之争,还对AI威胁论持务实乐观态度。
ACL 2025预定爆款!HyperGraphRAG横扫5大领域,检索效率提升7倍
文章聚焦HyperGraphRAG模型,介绍其架构由知识超图构建、超图检索策略、超图引导的生成机制组成,阐述构建步骤,该模型能提升检索效率,或成ACL 2025爆款。