演进式架构」共找到 2555 篇相关文章

新闻资讯7

13人干翻Transformer!新架构SSA算力暴减千倍,成本仅Opus 5%

一款基于SSA架构的AI模型SubQ横空出世,其上下文高达1200万Token,计算量比Transformer暴减1000倍,成本不到Claude Opus的5%。打造它的Subquadratic公司仅13人,产品发布后引发AI社区不同反应。

新智元
新闻资讯7

「国产GPU第一股」首秀!新架构下周揭秘,全栈底座不藏了

2025年12月19 - 20日,摩尔线程首届MUSA开发者大会将在北京举行。届时会揭晓新一代GPU架构与路线图,设20+技术专场,还有1000㎡科技嘉年华,展示全栈能力与生态进展。

新智元
推荐文章7

架构师困境:选择已被验证的道路,还是自行开辟一条新路?

开发软件时,团队要做产品功能和架构决策,面临选已验证路径还是自辟新路的困境。使用平台和框架虽能加快开发,但有副作用。团队需通过实验判断何时扩展或替换平台。

InfoQ
开源动态8

Agent的自演进,被刚刚开源的AReaL 2.0按下了加速键

Agent 正从「会使用工具并完成任务」向「在使用中学习并改进方法」转变,但面临自演进难题。AReaL 2.0 上线,解决 Agent 服务侧问题,给出在线学习闭环方案,其价值已在实践中得到验证。

机器之心
产品应用8

网易游戏 Tmax 平台实践:基于 Fluid 的云原生 AI 大模型推理加速架构

网易游戏打造 Tmax AI 机器学习平台,但大模型推理业务规模爆发带来资源弹性等挑战。经评估,选用 Fluid + AlluxioRuntime 构建三层架构,有自动预热等配置,带来性能、成本等多方面收益。

AI前线
新闻资讯7

一封来自Transformer之父的分手信:8年了!世界需要新的AI架构

Transformer之父Llion Jones在TED AI大会上称要把对Transformer的爱好调成「低电量模」。他认为大量资金与人才涌入使研究被「收窄」,大家只顾卷参数、抢发论文,没人探索新架构,他呼吁找回好奇心。

新智元
开源动态8

英伟达韩松团队新作:具有后神经架构搜索的高效语言模型

英伟达韩松团队推出基于后神经架构搜索的高效语言模型Jet - Nemotron,在基准测试中表现出色,准确率与Qwen3等相当甚至更优,生成吞吐量大幅加速。模型构建经多步骤优化,代码和预训练模型将开源。

量子位
算法论文8

生成视角重塑监督学习!标签不只是答案,更是学习指南 | ICML 2025

上海交大等机构团队在ICML 2025提出预测一致性学习(PCL),通过扩散过程消减标签信息,引入噪声标签,将标签学习分解为渐进任务,实现标签信息复用。在多模态任务实验中,PCL表现优于传统监督学习。

量子位
产品应用8

AI 时代,实时入湖正在告别 ETL:从 Kafka 到 Iceberg 的架构减法

在AI驱动的数据应用场景中,Kafka、Iceberg开放表格与对象存储组合成流数据入湖重要方向。传统ETL方有链路长等问题,文章围绕“零ETL”讨论架构减法,介绍Kafka × Table Bucket方案及优势、适用场景。

阿里云开发者
算法论文8

56倍加速生成策略:西交大提出EfficientFlow,迈向高效具身智能

生成模型在机器人和具身智能领域面临训练依赖大量数据、推理慢的问题。西安交通大学团队提出EfficientFlow,融合等变建模与高效流匹配,提升数据效率,压缩推理迭代步数,在多基准实现SOTA,推理提效显著。

机器之心