大模型Agent」共找到 10509 篇相关文章

新闻资讯8

拐点出现,中国开源模型下载量超越美国

Interconnects.ai报告显示,截至2025年8月,中国开源模型在HuggingFace下载量快赶上美国,增长速度更快,派生模型数量增多。美国因结构、生态等问题落后,中国模型优势在于速度、迭代等。

鲸选AI
算法论文7

一场「狼人杀」,考倒了一堆模型

南开学等机构设计 InMind 评测框架,在 Avalon 游戏对 11 个前沿模型测试。多数模型停留在表层模仿,仅少数推理增强模型有初步‘风格敏感性’,未来人机交互应关注‘像不像’。

AI科技评论
推荐文章8

多模态语言模型的核心技术架构与训练方法的进化

文章深入剖析多模态语言模型核心技术架构与训练方法的进化,涵盖建模范式、视觉编码器、语言骨干网络、模态对齐、生成范式及训练方法等方面,介绍其演进路径与代表模型,还提及国内模型创新及开源模型OpenVLA。

AIGC开放社区
开源动态7

这可能是,全球最强开源Agent模型,走了一条反Scaling Law的全新范式!

MiroThinker v1.5开源,其30B小模型Agent benchmark上击败万亿参数的Kimi K2T。它以交互深度为新Scaling维度,训练有严格时间管控,实测表现超Search Agent,“小模型+强交互”或成新方向。

探索AGI
算法论文8

联手通义实验室发布ZeroSearch:成本暴降88%,无需搜索即可激活语言模型的检索能力!

与通义实验室发布ZeroSearch框架,可无需真实搜索激活语言模型检索能力。它引入语言模型模拟搜索、采用结构化模板等策略,成本降88%,多项实验显示其性能超越基线与真实搜索方法。

深度学习自然语言处理
算法论文8

模型如何泛化出多智能体推理能力?清华提出策略游戏自博弈方案MARSHAL

近日,清华学等机构研究团队提出 MARSHAL 框架,利用强化学习让模型在策略游戏自博弈。实验表明,多轮、多智能体训练提升了模型博弈决策水平,将推理能力泛化到通用多智能体系统,在一般推理任务表现显著提升。

机器之心
产品应用8

Eino ADK:一文搞定 AI Agent 核心设计模式,从 0 到 1 搭建智能体系统

语言模型发展下,Agent成AI落地主流,但传统开发有痛点。Eino ADK为Go开发者提供智能体开发框架,解决核心难题,还介绍了Agent功能、ADK模式、构建方法及多Agent协作场景等。

InfoQ
产品应用8

三星研究院发布手机端侧模型MeKi:基于Memory的LLM扩展新范式,支持旗舰手机端侧部署

三星研究院发布端侧模型架构MeKi,提出用存储空间扩展模型容量、提升LLM性能的新范式。它利用手机ROM缓解内存压力,实现容量与性能提升。实验显示其性能、效率表现优,为边缘部署LLM提供新思路。

AI科技评论
推荐文章7

当代码遇上模型:智能编程助手的架构设计与工程实践

在 InfoQ 举办的 QCon 全球软件开发会上,字节跳动段潇涵介绍如何基于语言模型构建智能编程助手。他分享实践经验,剖析研发痛点,介绍技术架构,还探讨未来发展方向,如认知增强、工具整合等。

InfoQ
开源动态8

浙江学联合华为发布国内首个基于昇腾千卡算力平台的DeepSeek-R1-Safe基础模型

2025年9月18日,浙江学任奎教授团队联合华为在“华为全联接会2025”发布国内首个基于昇腾千卡算力平台的DeepSeek-R1-Safe基础模型,提升了我国AI系统自主安全防控水平,该模型已全面开源。

AIGC开放社区