高效注意力机制」共找到 1489 篇相关文章

开源动态8

全流程国产GPU,上下文提速100倍!中国科学院发布「线性复杂度」类脑大模型

中国科学院自动化所李国齐、徐波团队发布国产自主可控类脑脉冲大模型SpikingBrain-1.0,训练推理全用国产GPU。它具线性复杂度,超长序列处理速度快,还开源7B模型,为类脑智能发展提供新思路。

新智元
新闻资讯7

OpenAI:我们正朝着什么方向优化 ChatGPT?

OpenAI 官网文章称,ChatGPT 发展方向是成‘对你有用’的工具,不追逐 DAU 或让用户沉迷。它介绍了有用的使用场景,还提及健康使用方面的改进及与专家合作提升响应能力等内容。

特工宇宙
产品应用8

别用语言描述,直接点!Lovart 正式版把 AI 交互卷到新变态级别

作者分享 Lovart 正式版体验。其设计 Agent 成完全体,新增评论系统 ChatCanvas,可直接在无限画布上给 Agent 提修改要求,还吸收 Cursor 代码补全交互。支持单张和多张图片调整,奠定 AX 交互基石。

歸藏的AI工具箱
算法论文8

数百个虚拟人在线逃生!天大等发布:首个实时在线多智能体模拟方法

天津大学联合清华和卡迪夫大学推出RESCUE系统,把「大脑感知 - 决策 - 行动」循环搬进电脑,让数百虚拟人在线逃生。该系统能实时呈现地形等信息,还能标记身体碰撞力,可用于公共安全场景演练。

新智元
推荐文章8

AI智能体的上下文工程:Manus的构建心得

季逸超在文章中分享了 Manus 构建 AI 智能代理的心得,包括围绕 KV 缓存设计、使用掩码管理工具、将文件系统作上下文等内容,还指出要保留错误信息、避免小样本带偏等。

AI工程化
新闻资讯8

semianalysis 长文 | 关于Meta 砸钱、抢人、领导力、建帐篷、计算、数据和超级智能

Meta在基础模型性能落后,扎克伯格亲自挂帅开启AI军备竞赛。他砸钱收购、挖人、堆算力,建GPU集群,还面临Llama 4失败问题,试图通过一系列举措追赶超级智能。

AGI Hunt
推荐文章8

模型压缩与量化:让大模型走向轻量化落地

文章介绍模型压缩与量化技术,其能在保持性能时降低大模型计算和存储需求,实现边缘设备高效部署。还阐述基础知识、关键技术路径、应用场景,并探讨未来发展方向。

机器学习AI算法工程
推荐文章8

OpenAI: 构建 AI 智能体实用指南

OpenAI发布的《构建AI智能体实用指南》,阐述智能体定义、适用场景,介绍构建的核心组件、架构编排,强调安全保障,指出构建需多方要素配合,未来聚焦智能体生态系统。

宝玉AI
开源动态8

0.5B以小搏大拿下端侧模型新SOTA:4090可跑,长文本处理5倍常规加速丨清华&面壁开源

清华大学和面壁智能团队开源MiniCPM 4,有8B、0.5B两种参数规模,以22%训练开销达同级别最优。它在架构、推理、数据、训练多方面创新,性能领先,适用于综述生成、工具调用等场景。

量子位
算法论文8

首次解释LLM如何推理反思!西北大学谷歌新框架:引入贝叶斯自适应强化学习,数学推理全面提升

西北大学与Google、谷歌DeepMind团队质疑传统强化学习与反思的关系,提出贝叶斯自适应强化学习方法,首次解释为何、如何及何时反思探索新策略,还给出决策数学形式,实验显示其性能更优。

量子位