Agent基座模型」共找到 9407 篇相关文章

开源动态8

爆火的腾讯WorkBuddy发了篇论文,公开了自家底牌

腾讯 WorkBuddy 团队将内部模型选型评测等开源成 Benchmark,公开多模型 Agent 工作台选型底牌。Bench 优点是任务分布真实且开源可审计,论文介绍了核心方法论、四大赛道拆解、榜单结果,还对比了现有工作。

PaperAgent
新闻资讯8

中国第一,直逼OpenAI!神秘「扫地僧」冲到全球前七

神秘中国AI「扫地僧」MopMonk以73.1%胜率杀入CyberGym全球前七,紧咬OpenAI。它用MiniMax M3为基座,靠结构化记忆、多Agent并行等策略提升漏洞挖掘执行力,示范开源基座极致利用之路。

新智元
产品应用7

AI 企业 Day 0 出海,如何少走技术弯路?

InfoQ与多家AI出海企业交流发现,很多企业放弃常见Agent平台和流行框架,选择自研全栈平台。GMI Cloud升级产品,构建完整基础设施图谱,解决全球算力部署、模型调用和Agent商业化落地问题。

InfoQ
新闻资讯7

刚刚,全球最难考试惊天大反转!黑马AI冲破36%,顶流模型集体翻车

ARC-AGI-3测试中,顶级大模型Opus 4.6仅得0.2%,人类获满分。而Symbolica公司用Agentica框架首日就取得36.08%的成绩。该框架有独特技术路径和策略,但成绩未经验证,ARC-AGI-3被视为通向AGI的‘北极星’。

新智元
新闻资讯7

模型是「躲在洞穴里」观察世界? 强化学习大佬「吹哨」提醒LLM致命缺点

加州大学伯克利分校副教授、强化学习大牛Sergey Levine在博客指出,当前大语言模型(LLM)只是对人类大脑和思维的间接「扫描」,如同被困洞穴看人类智慧「投影」,无法代替真正思维。

机器之心
推荐文章7

存量代码库难适配、人机边界模糊?百度拆解Coding Agent企业级落地的硬核解法

本文基于百度资深研发工程师颜志杰在2025 AICon大会演讲整理,剖析Coding Agent企业级落地三大挑战,分享百度“知识体系 + Rules建设”等实践,揭示开发者构建工程配套跨越代际鸿沟的方法。

InfoQ
产品应用8

对话 Seede AI:帮人类创作只是第一步,我们想帮人类理解 Agent 产出的内容

本文对话 Seede AI 创始人 Longyi,探讨 AI 设计产品发展。Seede AI 主打将原始素材转化为可交付设计稿,易上手、受众广。创始人认为不转向 AI - Native 没救,产品已跑通 PMF,目标是帮人类理解 Agent 产出内容。

Founder Park
开源动态7

94.5K Star!2026现象级开源 AI Agent,Moltbot(原Clawdbot)+飞书保姆级安装教程!

2026年现象级开源Agent工具Clawdbot改名Moltbot,获94.5K Star。它能接管本地设备,可通过飞书交互。文章给出Moltbot搭建教程,包括准备工作、部署步骤和接入飞书机器人方法。

开源星探
算法论文8

下一代目标检测模型:3B参数MLLM Rex-Omni首度超越Grounding DINO,统一10+视觉任务

IDEA研究院团队用3B参数的Rex - Omni打破MLLM目标定位精度僵局。它统一视觉任务,结合坐标编码与强化学习,在多项检测基准超Grounding DINO等,解决定位和行为缺陷,为MLLM成下一代检测模型提供方案。

机器之心
开源动态8

英伟达4段简短提示词,IOI夺金!开源模型也能征服最难编程竞赛

英伟达研究者提出GenCluster框架提升开源LLM解题能力,让开源模型gpt - oss - 120b在IOI 2025获金牌级别高分。它执行‘海选+筛选+比拼+提交’流程,优势明显,标志开源AI里程碑式突破。

新智元