「神经架构搜索」共找到 2283 篇相关文章
当EDA(消息驱动架构)遇到AI Agent:消息驱动在智能体时代的重生
文章探讨消息队列与AI Agent的融合。回顾消息队列发展历程,阐述多智能体协作系统成为AI落地核心架构的原因,分析消息队列与AI Agent的融合点,介绍Apache Pulsar对AI Agent的赋能,还展望了AI与中间件的双向进化。
Zed 为什么不用自己造 Agent?OpenAI 架构师给出答案:Codex 重划 IDE × Coding Agent 的分工边界
文章围绕Coding Agent展开,介绍其构成、构建Harness的挑战,还阐述Codex作为集成系统优势、使用方式及未来发展。强调将模型与Harness共同开发,能更好理解模型行为,Codex可助力构建差异化产品。
网络顶会获奖!华为提出端网协同RDMA传输架构,解决大规模AI集群网络可扩展性问题
全球网络通信顶会 ACM SIGCOMM 2025 落幕,华为与港科大合作的 DCP 研究成果获奖。该论文提出数控分离传输架构 DCP,解决大规模 AI 集群网络可扩展性难题,实验显示其性能优于现有 RDMA 方案。
真实联网搜索Agent,7B媲美满血R1,华为盘古DeepDiver给出开域信息获取新解法
华为诺亚方舟实验室提出 Pangu DeepDiver 模型,实现 LLM 搜索引擎自主交互新范式。它用真实互联网数据训练,在 WebPuzzle 等基准测试中,7B 的 DeepDiver 媲美 671B DeepSeek - R1,展现强大信息获取与泛化能力。
三重Reward驱动的运维智能体进化:多智能体、上下文工程与强化学习的融合实践
文章阐述了AI原生时代下,面向技术风险领域的智能体系统(DeRisk)的架构设计、核心理念等。介绍运维智能体发展现状,提出其技术演进需找三类Reward,还介绍相关概念、DeRisk架构,给出实践案例并将开源技术产品。
智谱新模型也用DeepSeek的MLA,苹果M5就能跑
智谱AI上市后发布新成果,开源轻量级大语言模型GLM-4.7-Flash,API免费开放调用。该模型是30B总参数、3B激活参数的MoE架构,定位为“本地编程与智能体助手”,评测表现佳,采用MLA架构,多平台支持。
万亿思考模型新速度!蚂蚁开源Ring-2.5-1T:IMO金牌水平,强;混合线性架构,快!
蚂蚁集团发布全球首个开源混合线性架构万亿参数模型Ring - 2.5 - 1T,打破深度思考牺牲推理速度和显存的‘不可能三角’。还同期发布扩散语言模型LLaDA2.1和全模态大模型Ming - flash - omni - 2.0,想做成可复用底座。
喜当爹后,奥特曼自曝神经化学骤变!养娃能为人类做出更优AI决策
OpenAI CEO奥特曼喜当爹后称优先事项改变,神经化学有骤变。其决策能力曾受争议,现恰逢OpenAI推进“星际之门”计划,他还将AI发展比作看孩子成长,也提及行业或有泡沫。
腾讯混元 x MBZUAI 港中文新研究:将纠错纳入策略空间,Search-R2 重构搜索增强推理学习方式
过去大语言模型能力提升靠参数和数据扩张,但在真实任务中此路径有局限。腾讯混元、MBZUAI、港中文联合团队提出Search - R2,将纠错纳入策略空间,抑制错误传播,在多跳推理任务中优势显著。
我用了13年,与SEO前辈们出现在一起。白杨SEO从网站优化到AI搜索优化经历分享,百度SEO不放弃!
白杨SEO分享从网站优化到AI搜索优化经历,讲述入行缘由、职场项目,介绍自由职业业务,分析百度SEO阶段与变化,建议别放弃,还给出对SEO未来看法,如回归国外、做新媒体SEO等。