「下一代架构」共找到 1996 篇相关文章
拥抱大模型:深入剖析ReAct的核心原理、技术架构及其对AI领域的深远影响
文章深入剖析ReAct,它是普林斯顿大学和谷歌团队提出的智能体架构范式,将推理与行动协同,构建TAO闭环。介绍其原理、架构,指出解决传统AI难题,也存在局限,未来可与强化学习等融合。
非Transformer架构落地之王,带着离线智能和原生记忆能力在上海WAIC浮出水面
在上海WAIC现场,RockAI展台的机器狗和灵巧手在离线状态表现出色,背后是其非Transformer架构的大模型Yan 2.0 Preview,有原生记忆和离线智能能力。该公司成立两年,押注此架构,产品已商业落地,还构想群体智能未来。
统治AI十年的Transformer,要被亲爹亲手砸碎?
5月5日旧金山的辩论赛上,Transformer联合发明人Łukasz Kaiser为其作品辩护,三位挑战者指出Transformer五大死穴。Kaiser称除非新架构证明有更好的scaling曲线,否则Transformer仍是主流,还给出具体辩护。
Vibe Coding 何必只在桌面 IDE,多端智能体协同的思考与设计
依托下一代开源 AutoDev 架构,在 AutoDev 多平台预览版中实现了 Server 与 Android 的架构一体化与协同。Vibe Coding 可按自然语言提示生成代码,现阶段能完成 80% 功能,但跨越剩下 20% 挑战需团队工程化落地。
中兴发了一篇论文,洞察AI更前沿的探索方向
当大模型参数量冲向万亿级,AI 行业面临瓶颈。中兴通讯发布论文剖析困境,勾勒前沿方向。文中分析了 LLM 现状、架构瓶颈、AGI 争议等,还阐述了改进优化措施及下一代计算范式发展趋势,介绍了中兴的探索实践。
高效Agents的尽头是,Harness
文章指出玩Agent久了会出现问题,很多人简单将其视为“模型+工具”组合远远不够。以OpenDev为例,介绍了Harness架构,包括核心理念、扩展ReAct循环、上下文工程等,还提及安全架构、多模型路由等内容。
Grab 订阅平台从 SQS 和 Redis 切换到 Temporal
Grab基于Temporal构建新的GrabUnlimited架构,增强用户体验,将订阅平台生产事件减少80%。原架构用SQS和Redis,随订阅者增多问题频出,新架构利用Temporal特性解决诸多难题。
虚拟智库:运用大语言模型获取多元视角
本文探讨如何用大语言模型(LLM)构建虚拟智库。以电商系统架构决策为例,通过让 LLM 扮演不同角色,如 Martin Fowler、David Heinemeier Hansson 等,从多元视角讨论微服务架构利弊,为架构决策提供参考。
20人团队提前实现DeepSeek构想,AI算力变天?直击大模型算力成本痛点
国内20人玉盘AI团队推出SRDA全新计算架构方案,试图从硬件源头解决当前AI算力核心瓶颈。该架构有诸多创新设计,能应对大模型训推痛点,与DeepSeek构想契合,或成大模型专用架构分水岭。
蚂蚁武威:下一代「推理」模型范式大猜想
文章围绕下一代「推理」模型范式展开,蚂蚁技术研究院武威提出不同观点,认为长思维链推理未必最优,未来推理模型或更低维稳定,还探讨推理定义、重要性及解法猜想,如结合快慢思考等。