「大模型Agent」共找到 10483 篇相关文章
Agent 护城河:揭秘Harness的三大支柱
上海交大等机构研究者梳理LLM Agent设计逻辑,指出能力正从模型内部流向外部,外部化有记忆、技能、协议三大支柱,Harness负责协调,Agent竞争转向外部化基础设施。
Kubernetes环境中作业帮大模型服务流量调度优化实践
随着大语言模型应用渐广,Kubernetes 现有 Ingress 组件在大模型服务流量管理上有局限。作业帮提出创新调度方案,整合成模型网关,具备五项核心功能,提升了资源效率、稳定性和易用性。
阿里刚投的AI明星,3D大模型那种
通用人工智能公司VAST宣布完成5000万美元A轮融资,由阿里、恒旭资本联合领投。其自研3D基础大模型领先,发布全新AI 3D大模型家族。2025年重点研发世界模型,2026年将加速建设UGC互动内容平台。
斯坦福教授直播训练535B大模型,模型训练背后的「黑箱」正在被打开?
斯坦福教授Percy Liang宣布由Marin开放实验室启动训练Marin 535B - A23B模型,全程公开。过去大模型训练像“黑箱”,此次尝试让训练可观察、可讨论、可协作,引发网友关注。
Qwen3-LiveTranslate:视、听、说全模态同传大模型!
Qwen3-LiveTranslate-Flash 是基于大语言模型的多语言实时音视频同传模型,依托 Qwen3-Omni 能力与海量数据,有多语言和方言支持、视觉增强等亮点,性能超主流大模型。
像开发软件一样造世界,Agent2World来了,把世界模型做成可运行的符号环境
为让模型真正“能行动”,需可执行、可验证的符号世界模型,但现有自动生成路线有困局。研究团队提出 Agent2World,经实验验证有显著效果,能稳定产出高质量符号世界模型,开辟 AI 理解现实环境新可能。
大模型开网店,谁是经营高手?E-Commerce Bench开源揭秘
为评估模型长程经营能力,联合淘天集团发布E-Commerce Bench,以10万本金、365天经营网店来评测。从多维度评估18个模型,结果差异大,还发现单一指标会掩盖模型表现,评估基准潜力大。
大模型虽好,但恕我直言:在OCR面前,开源小模型更香
作者所在公司项目需处理大量纸质文档,起初考虑云端大模型API调用和开源大模型本地化部署,却因成本高、硬件要求高受阻。后经推荐调研PaddleOCR,其功能全、成本低、易用性强,最终被选为项目核心方案。
DeepSeek点燃大模型效率之争,阶跃火速接棒:JetSpec让大模型解码速度最高提升近10倍
近期,DeepSeek发布DSpark,阶跃星辰发表JetSpec论文,二者聚焦大模型推理效率。DSpark关注验证效率,JetSpec从Draft生成本身入手。结果显示,二者都有加速效果,共同表明推理效率正成Agent落地关键变量。
DeepSeek、GPT、Qwen,所有大模型架构图都有,Karpathy:宝藏画廊!
大模型赛道热闹,架构创新多,理解困难且缺清晰架构图。AI 研究者 Sebastian Raschka 绘制主流大模型结构,整理成在线图谱「LLM Architecture Gallery」,方便研究者查阅对比。