「计算架构」共找到 2375 篇相关文章
东方理工团队提出HiDrop:重构MLLM计算路径,压缩90%视觉Token实现2.2倍加速
东方理工大学沈晓宇团队提出HiDrop,基于MLLM不同层功能差异,设计出延迟注入、凹金字塔式剪枝和提前退出的视觉Token压缩策略。实验显示,它能压缩约90%视觉Token,保持98.3%性能,实现训练和预填充加速。
谷歌诺奖大神哈萨比斯:五年内一半几率实现AGI,游戏、物理和生命的本质都是计算
谷歌DeepMind掌门人Demis Hassabis与Lex Fridman深度对话,预测未来五年有50%几率实现AGI,还从新颖角度阐述自然界模式可被建模,畅谈AI对游戏、科学研究等多领域的影响及应用。
GPT-6 真要来了!OpenAI全新推理架构“循环深度”首次曝光:可榨出14倍参数潜能
OpenAI将推旗舰模型GPT - 6(内部代号Astra),采用“循环深度”新技术,能榨出14倍参数潜能,降低成本,但会使AI推理过程不可读,加重安全担忧。OpenAI已因该模型“能力过强”踩刹车。
华为升级行业Agent算法架构!MindScale自己写prompt和工作流,KV Cache减少5.7倍token
华为诺亚方舟实验室更新面向行业应用的算法包MindScale,融合算法创新与业务实践经验。它梳理了Agent时代技术挑战,给出技术论文与昇腾代码,应对工作流维护等难题,还提升训推效率、适配国产硬件。
谷歌量子计算重磅突破登上Nature:首次实现可验证量子优势,比最快超算快13000倍
谷歌量子AI团队宣布里程碑式算法突破,其Willow芯片运行“量子回声”算法,首次在硬件上实现可验证量子优势,执行特定任务比最快超算快13000倍,为多领域应用铺平道路。
瘦身不降智!大模型训推效率提升30%,京东大模型开发计算研究登Nature旗下期刊
京东探索研究院大模型研究登Nature旗下期刊。其提出系统与方法,经四大创新使大模型推理提效30%、训练成本降70%。成果支撑JoyBuild平台,可帮企业将通用模型转化为专业模型,加速商业化落地。
奥特曼小号泄密:OpenAI代码工作100%交给Codex!工程师才揭底Codex“大脑”运行逻辑,碾压Claude架构?
近日,OpenAI工程师揭秘Codex“大脑”运行逻辑,介绍其智能体循环及构建提示词等过程。还提及用1个PostgreSQL主库和50个只读副本顶住8亿用户,同时持续探索数据库性能极限。
一句话画出整张架构图?这款 2k star 开源 AI 画板,真能帮你告别熬夜改流程图吗?
Smart Excalidraw是基于Excalidraw的智能绘图工具,用自然语言就能绘制专业图表。它能解决传统绘图语法难记、排版耗时等痛点,具备AI驱动、独创连接算法等功能,适合多类人群使用。
黄仁勋 GTC 2026 演讲实录:所有SaaS公司都将消失;Token成本全球最低;“龙虾”创造了历史;Feynman 架构已在路上
北京时间2026年3月17日,英伟达CEO黄仁勋在GTC演讲,展示AI“全家桶”。他回溯CUDA 20年,介绍数据处理新软件库,还提及AI原生企业爆发、Token成本优势、Vera Rubin平台等,强调英伟达在AI领域的全面布局。
黄仁勋 GTC 2026 演讲实录:所有SaaS公司都将消失;Token成本全球最低;“龙虾”创造了历史;Feynman 架构已在路上
北京时间 2026 年 3 月 17 日,英伟达 CEO 黄仁勋在 GTC 演讲,介绍一整套 AI“全家桶”。回顾 CUDA 20 年,提及数据处理新软件库,还展示 Vera Rubin 平台等,预测 SaaS 公司将消失,英伟达 2027 年营收或达万亿美元。