加速框架」共找到 2179 篇相关文章

算法论文8

突破一亿Token极限:EverMind提出MSA架构,实现大模型高效端到端长时记忆

机器之心发布文章介绍,大模型长期记忆能力受限于上下文长度。《MSA: Memory Sparse Attention for Efficient End-to-End Memory Model Scaling to 100M Tokens》提出MSA架构,突破扩展性、精度和效率的不可能三角,实现100M长度的大模型长时记忆框架

机器之心
新闻资讯7

因为AI编程,Tailwind CSS差点死了

2026年,备受AI智能体欢迎的Tailwind CSS框架团队却陷入困境,创始人Adam Wathan透露已裁掉75%成员。因AI写代码,人类不访问文档,付费产品无人买单,流量降40%、收入损失80%。虽有公司赞助,但仍需探索新商业模式。

机器之心
新闻资讯8

黄仁勋手撕「AI泡沫」论!英伟达570亿铁拳暴击,显卡全断货

英伟达Q3 2026财报显示单季度营收达570亿美元,数据中心业务同比狂涨66%。黄仁勋称AI不是泡沫,而是计算范式从通用CPU转向加速式GPU计算的必然。当前多数AI公司估值高、收入低,英伟达作为‘卖铲人’大获全胜。

新智元
算法论文8

Code2Video:代码驱动、智能体协同、精准可控的教学视频生成

新加坡国立大学 ShowLab 团队提出 Code2Video,一种基于代码驱动的视频生成新范式。它以可执行代码为媒介,结合三智能体协同框架,解决了现有文生视频方法在教育场景的不足,在美学和教学效果指标上有明显提升。

机器之心
新闻资讯8

芯片团队规模近3000人!小米扩张自研芯片版图

8月24日小米举行玄戒芯片技术沟通会,公布三颗自研芯片:AI旗舰SoC玄戒O3、端侧AI加速芯片玄戒O100、智驾高算力AI芯片玄戒D100。小米重启大芯片研发五年多,投入超210亿,芯片团队近3000人。

芯师爷
推荐文章8

AI Agent 记忆系统:从短期到长期的技术架构与实践

随着 AI Agent 应用发展,记忆系统成为构建实用 AI Agent 系统的关键技术。文章介绍了记忆基础概念、Agent 框架集成记忆系统的架构,阐述了短期记忆的上下文工程策略和长期记忆技术架构及集成,还分析了行业趋势与产品对比。

阿里云开发者
算法论文8

FlashAttention 完全进化史:FA-4 发布之际的技术全景回顾

文章围绕FlashAttention展开,从Attention性能瓶颈引出问题,阐述其各版本演进。FA-1实现算法突破,避免O(N²)内存;FA-2适配架构,提升性能;FA-3深度协同,实现异步;FA-4探索更深异步和角色分工。还探讨跨芯片迁移及未来优化方向。

GiantPandaLLM
新闻资讯7

长上下文窗口、Agent崛起,RAG已死?

技术迭代下“RAG已死”论调出现,向量数据库Chroma创始人主张用上下文工程框架取代对“RAG”的狭义依赖。文章梳理业界不同观点,有人认为RAG在进化,有人称其成工程学科,也有人觉得会被Agent和长上下文取代。

机器之心
开源动态8

登顶Hugging Face GAIA全球榜首!中兴超级智能体终结「AI黑盒」时代

中兴通讯研发的超级智能体Co - Sight 2.0登顶Hugging Face GAIA全球权威榜单。它解决传统智能体痛点,有全链路可信计算框架等创新架构,其智能体工厂和开放标准助力构建生态,展现了智能体产业落地潜力。

新智元
开源动态7

LM Studio宣布支持在Mac上跑Qwen3-Next 80B模型

LM Studio宣布支持基于MLX框架在Mac上运行阿里Qwen3-Next 80B模型。该模型虽总参数量达800亿,但每次推理仅激活30亿。第三方评测显示其4bit量化运行效果好,不过实现GGUF格式支持尚需时间。

AI工程化