「AI架构优化」共找到 11221 篇相关文章

算法论文8

斯坦福7B智能体全面超越GPT-4o,推理流登顶HF

传统智能体系统难兼顾稳定性和学习能力,斯坦福等团队提出AgentFlow框架,通过模块化和实时强化学习优化策略,使7B参数模型在多任务上超越GPT - 4o等大模型,为AI发展提供新思路。

新智元
产品应用7

AutoGLM 2.0 深度解析:云端智能体的技术跃进与现实挑战

2025 年 GUI Agent 赛道升温,多数产品依赖本地执行。智谱 AI 在 8 月 AutoGLM 2.0 闭门交流会上展示新路径,其由国产模型驱动,具多能力,在 Agent 云端执行架构、训练方式等方面有突破,也面临一些挑战。

特工宇宙
新闻资讯8

刚刚,GPT-5首次通过「哥德尔测试」!破解三大数学猜想

GPT - 5首次通过「哥德尔测试」,破解三大组合优化猜想。研究由海法大学和思科主导,团队设计五项测试任务,GPT - 5在三个简单问题上近乎完美,还推导出不同解法,标志AI从「学习数学」迈向「做数学」。

新智元
开源动态8

罗福莉执掌小米大模型首秀!定调下一代模型,全新MiMo-V2开源还横扫Agent第一梯队

在2025小米人车家全生态合作伙伴大会上,罗福莉首秀解读全新大模型MiMo - V2 - Flash,该模型已开源,采用MoE架构和MTP技术,在多方面表现出色,罗福莉还阐述其设计逻辑与对下一代智能体的看法。

AI前线
新闻资讯7

小米小爱同学:资源受限下,实现端侧大模型的高性能推理

InfoQ对话小米小爱同学端侧AI负责人杨永杰,了解其团队在资源受限的端侧设备实现大模型高性能推理的策略。目前端侧大模型商业化落地慢,团队提前布局,自研框架,实现超180 tokens/s推理速度,还分享未来突破方向。

InfoQ
开源动态8

开源大模型SOTA又刷新!中国MiniMax M2全球排名第五,开源榜一

中国AI独角兽MiniMax发布模型M2,刷新开源SOTA。它采用混合专家架构,平衡了智能、速度和成本。在多个权威测试中表现优异,价格仅为Claude 3.5 Sonnet的8%,还提供多种部署方式和限时免费服务。

AIGC开放社区
推荐文章7

逆势降本:云上数据平台年复削减30%的治理实践

本文是朴朴科技对云上大数据平台成本治理的阶段性总结。其开展成本治理已三年,分“降本增效”三部曲:成本发现与分析、成本优化与控制、体系化治理构建,分享经验,助力同行开展相关工作。

InfoQ
推荐文章8

从《塞尔达传说》理解 Agent 的上下文工程:Claude Skills 还是被低估了

Claude Skills 是为 AI 设计的「技能包」,能把复杂任务指令打包。作者认为其信息分层设计哲学是关键突破,以《塞尔达传说》为例,介绍了信息分层和按需加载理念,还阐述了三层架构及应用案例、挑战和通用原则。

Founder Park
开源动态8

7B模型“情商”比肩GPT-4o,腾讯突破开放域RL难题,得分直翻5倍

腾讯混元AI数字人团队提出RLVER框架,解决开放域RL在真实交互中的‘情商’优化困境。经其训练的Qwen2.5 - 7B模型在情感对话基准得分跃升,比肩顶级商用模型,团队还有诸多启发性发现。

量子位
开源动态8

读完这篇,你就搞懂 DeepSeek v4 了

2026年4月24日,DeepSeek全新系列模型DeepSeek - V4预览版上线并开源,评分接近‘闭源三巨头’。该模型强在1.6T参数+1M上下文,还有从attention到kernel的系统级重构与优化,在架构和工程层面均有创新。

腾讯技术工程