「自主智能测试」共找到 5068 篇相关文章
中国具身智能融资新纪录诞生!它石智航Pre-A轮融资4.55亿美金,高瓴红杉美团联合领投
4月16日,具身智能公司它石智航宣布完成4.55亿美元Pre - A轮融资,刷新行业纪录。它以物理世界AI和通用机器人技术为核心,针对数据、模型、硬件问题给出解法,还攻克工业难题创吉尼斯纪录。
OpenAI公开未来路线图!具体到28年3月AI研究员将完全自主,奥特曼承认“关于GPT-4o我们搞砸了”
OpenAI完成组织架构调整后直播,公开研究目标时间表,2028年3月将实现AI研究员完全自主。奥特曼承认GPT - 4o问题处理搞砸。还介绍新架构,投入多领域研究,问答环节回应诸多疑问。
Coding Agent 自主解题很强,但用户改一行代码就"翻车"?自所团队提出 SWE-Touch 揭示共享工作空间下的能力缺口
当前基于大模型的Coding Agent是热门研究方向,现有评测多假设其独占代码仓库。中科院自动化所团队构建SWE - Touch框架,对9个前沿模型测试,发现用户干预下模型性能下降、排名洗牌。
2025具身智能创投全景:554亿热钱,4大估值梯队,10亿元现金流门槛|量子位智库报告
2025年具身智能赛道迎来资本狂欢,投资事件从173起涨至447起,资金从137亿飙升至554亿。政策、产业链等因素致融资金额陡增,财务、产业、国资三股资本重塑格局,还形成估值四梯队。
优理奇机器人完成两轮合计3亿元天使++++轮及天使+++++轮融资,“算法-硬件-场景”三位一体加速具身智能应用落地
优理奇机器人近日完成两轮合计3亿元融资,是半年内第五轮。其坚持“场景驱动”,产品在运动会获奖,量产交付订单超千台。构建完整技术栈,推出标准化机械臂产品,创始人看好具身智能统一发展。
中科院信工所发布首篇LLM智能体幻觉综述!梳理5类幻觉、18大诱因与10种缓解方案,300+论文资源开源
中科院信工所等机构团队发布首篇聚焦LLM智能体幻觉的综述,厘清其与传统语言幻觉区别,提出5类幻觉分类体系和18大触发原因,给出10种缓解策略,还开源300+论文库并指明未来研究方向。
每个人的AI科学助手!全球首个通用科学智能体来了,全网资源+1.7亿学术文献让科研效率狂飙
全球首个通用科研智能体SciMaster在WAIC亮相,由上海交大与深势科技共同发布。它能结合全网资源和1.7亿科学文献,有深度调研等功能,免费且可用于工作生活多方面,还将重塑科研范式。
打破具身世界模型可执行性鸿沟 !港中深-跨维智能团队提出EVA框架,用强化学习让视频世界模型真正“动”起来
近期,利用视频生成模型为机器人构建“世界模型”成热门路线,但存在“可执行性鸿沟”。港中深 - 跨维智能团队提出 EVA 框架,用强化学习优化视频生成,实验显示其能提升视觉规划、仿真任务成功率及真实部署稳定性,还有数据合成潜力。
狂揽 9.9K star!比Selenium更好用的网页自动化利器,功能超强,太6了!
本文分享开源项目 SeleniumBase,它包装 Selenium 的 WebDriver API,功能强大。支持主流浏览器,内置测试框架,能搞定防爬检测。有智能等待等特色,安装简单,GitHub 有大量示例。
可能是比Lovable还好的Vibe Coding产品-MiniMax Agent体验
作者测试MiniMax Agent,用其生成法国景点介绍、艺术家作品对比、攻壳机动队分析等网页。它能自主找信息、整理,生成图、音等。和Lovable对比,它表现更优,还支持免费试用。