开源动态8
ROMA:DeepResearch最佳开源平替
开源星探
AI 摘要
Sentient AGI团队开发的ROMA框架霸榜GitHub,能递归拆解复杂问题,性能超Grok - 4等闭源产品。它功能丰富、易上手,适用于研究分析、金融决策等场景,是DeepResearch的开源平替。
阅读原文 · 开源星探
2.3K Star 霸榜GitHub!DeepResearch最佳开源平替!
DeepResearch能递归拆解复杂任务自动生成报告,但OpenAI的相关产品费用高且闭源。霸榜GitHub的ROMA由Sentient AGI团队开发,性能超Grok - 4等,是开源杀手,还介绍了功能、使用方法和应用场景。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
新闻资讯7
J-Space让V4 Pro超Fable 5?测试结果翻车!
前两天J-Space凭夸张测试结果刷屏,宣称一份Skill接入Agent环境,能让V4 Pro在多基准大幅提升,部分成绩超Fable 5。但社区复测结果相反,作者未公开完整评测记录,还删质疑帖,引发公开打假。
机器之心
推荐文章7
Karan:Hermes Agent 让 AI 更懂你
科技创作者 Peter Yang 对话 Hermes Agent 作者之一 Karan Malhotra,探讨 Hermes Agent 与其他产品的差异、模型谄媚问题、开源意义等。Karan 指出其独特自我改进系统与专注用户需求特点,还提及让模型更贴合用户的方法。
AI科技大本营
开源动态7
Stripe测试:AI智能体校验环节有短板
Stripe推出基准测试套件,评估AI智能体构建完整Stripe集成方案的能力,测试聚焦金融系统贴近生产环境的集成场景。测试显示,不同任务类型评测结果差异显著,核心瓶颈在于验证环节,当前智能体短板在校验逻辑等方面。
InfoQ
新闻资讯8
ALE考试:AI距替人干活还差得远
AI飞速进步,人类最后考试(HLE)已不够用,伯克利牵头推出智能体最后的考试(ALE)。ALE真实、全面、可验证,当前最强AI在最难档通过率仅8.6%,主流系统平均2.6%,显示AI距替人干活尚远。
AIGC开放社区