执行层」共找到 806 篇相关文章

开源动态8

颠覆AI Agent开发,一个容器搞定所有开发环境!

AI Agent开发环境配置复杂,开源项目AIO Sandbox将浏览器、终端等工具整合到Docker容器,形成统一沙箱执行环境。它有一体化沙箱等亮点,还提供多语言SDK,能一键启动。

开源星探
算法论文8

谷歌DeepMind曝光首个“AI 经济体”完整架构,Agent催生全新经济体正在悄然成形

谷歌DeepMind论文描绘由AI Agent自主交易和协作的经济体,提出“沙盒经济”框架,分析其起源与隔离程度,指出发展方向及挑战,还给出应用场景、市场机制、设计方案、基础设施和行动建议。

AI寒武纪
开源动态8

中国科大Science-Star(科星) : 一体化、可扩展的科学智能体搭建平台

中科大认知智能全国重点实验室开发了 Science - Star 科研智能体平台。它基于 ReAct 引擎,有一体化可视化支持、插拔式模块化架构和跨学科工具集成等特色,为科研智能体研发与实验提供高效基础设施。

PaperAgent
产品应用7

不吹不黑,GPT-5代码能力究竟怎么样?跟 Gemini 和 Claude 的对比测试给你答案

作者测试了 GPT-5 的代码能力,并与 Gemini 和 Claude 对比。在不同代码任务中,各模型表现不同。如在生成网页任务里,GPT-5 部分结果不错,但受 32K 上下文限制,长文本处理不如 Gemini,硬实力也不如 Claude。

歸藏的AI工具箱
推荐文章8

别听模型厂商的,Prompt 不是功能,是 bug

风险投资Conviction创始人Sarah Guo分享2025年AI创业观察,指出从用户体验看,prompt是缺陷非功能;传统低技术行业正快速拥抱AI;还分析了AI能力进展、应用案例及投资机会等。

Founder Park
算法论文8

港科大&北京人形提出LOVON:足式机器人开放世界全域目标追踪新范式!

港科大广州联合北京人形创新中心推出LOVON框架,融合大语言模型、开放词汇视觉检测和语言 - 运动映射模型,解决足式机器人开放世界全域目标追踪难题,有抗干扰视觉处理等优势,性能超传统方法。

机器之心
算法论文8

ACL 2025 Oral | 你的模型评测搭子上线:Evaluation Agent懂你更懂AI

上海人工智能实验室与新加坡南洋理工大学合作研发 Evaluation Agent,它能按需评估视觉生成模型,有可定制、高效率等优势。框架分提案和执行两阶段,评估结果佳,未来将拓展功能。

机器之心
新闻资讯7

OpenAI将发布AI Agent浏览器,挑战谷歌Chrome

路透社消息,OpenAI将在未来几周发布AI Agent驱动的网络浏览器,或挑战谷歌Chrome。其设计让部分交互在聊天界面完成,还能整合产品自动执行任务,不过也面临激烈竞争。

AIGC开放社区
开源动态8

首个面向科学任务、真实交互、自动评估的多模态智能体评测环境,ScienceBoard来了

ScienceBoard是首个面向科学任务、真实交互、自动评估的多模态智能体评测环境。它集成多领域科研软件,构建科研任务集合,评估智能体在科学任务上的表现,发现现有模型在科研工作流中远未成熟。

机器之心
开源动态8

135 个项目、七大趋势、三大赛道:撕开大模型开源生态真相,你会怎么卷?

在开发者大会密集登场之际,5月27日蚂蚁集团开源团队发布《2025大模型开源开发生态全景图》。展示135个项目、七大趋势、三大赛道,剖析开源生态现状与变化,揭示应用重塑和生态位博弈。

机器之心