「智能体架构」共找到 4809 篇相关文章
AI 也有长久记忆了!谷歌Nested Learning让AI拥有持续学习的生命力
Google Research科学家研究直指AI领域难题,其论文《Nested Learning: The Illusion of Deep Learning Architectures》已提交NeurIPS 2025。Nested Learning打破认知框架,提出三大核心贡献,构建HOPE架构,性能优越,将改变终身学习应用领域。
刚刚,DeepSeek首曝V3降成本秘诀!软硬协同突破Scaling天花板
DeepSeek最新论文从硬件架构和模型设计双重视角,探讨如何相互配合实现低成本大规模训练和推理,分析硬件特性对架构选择的影响,研究两者相互依赖关系,还为未来协同设计提出建议。
不装了!LeCun哈萨比斯神仙吵架,马斯克也站队了
图灵奖得主Yann LeCun与诺贝尔奖得主、谷歌DeepMind CEO哈萨比斯就“智能的本质”展开激辩,马斯克站队哈萨比斯。二人观点分歧大,后LeCun称主要是用词分歧,双方都关注世界模型,但理解和实践有别。
KTransformers入选计算机系统顶会、与主流框架合作,趋境&清华让「异构」成为推理新范式
KTransformers由趋境科技与清华团队联合研发,是高性能异构推理框架。其论文入选SOSP 2025,还与SGLang合作。它有算子优化等创新,能让CPU与GPU协同,推动推理架构融合,已成广泛复用的底层框架。
没等VC下场,机器人厂商们先投了一家数据公司
2026年具身智能市场火热,智域基石获灵初智能等四家企业数千万元天使轮融资。其定位第三方数据公司,核心团队背景互补,明确不做本体、模型等四件事,还构建自动化编译管线处理数据。
统治AI十年的Transformer,要被亲爹亲手砸碎?
5月5日旧金山的辩论赛上,Transformer联合发明人Łukasz Kaiser为其作品辩护,三位挑战者指出Transformer五大死穴。Kaiser称除非新架构证明有更好的scaling曲线,否则Transformer仍是主流,还给出具体辩护。
从“小卡拉米” 杀入 CNCF,创始人却说:HAMi火了,我们每天仍如履薄冰
本文讲述 HAMi 项目从“小卡拉米”到进入 CNCF 孵化阶段的历程。该项目解决 GPU 利用率问题,建立跨厂商生态。密瓜智能围绕其成立,补社区短板。虽 HAMi 成功,但密瓜智能仍需证明商业价值。
Agent 的 Token 账单怎么省?
AI 行业从生成式能力向 Agent 行动力跃迁,核心矛盾转向推理成本可控性。随着企业将 Agent 编入自动化流水线,Token 消耗受关注,业界开始聚焦以「降本」为核心的技术路线。
明年让AI可靠地抢走你的活儿?Anthropic 首席产品官曝新年目标:大模型不拼 “更聪明”,终结“公司上AI,员工更累”尴尬
2025 年智能主体全面爆发,编码领域智能体成突破点,Anthropic 的 Claude Code 表现突出,份额超 OpenAI。其首席产品官 Mike Krieger 梳理发展方向,指出明年重点解决企业部署 AI 但员工未变高效问题。
欧洲版DeepSeek发布Mistral 3系列模型,多模态端云生态,无差别商用交付给全球开发者
欧洲最强AI公司Mistral AI发布全系开源模型Mistral 3,从675B到3B参数打通智能链路,采用先进架构,与业界合作优化,以Apache 2.0协议交付全球开发者,推动开源智能发展。