UI自动化测试框架」共找到 2235 篇相关文章

产品应用8

Claude「永久大脑」,真的来了!

著名AI追踪平台TestingCatalog爆出,Anthropic正为Claude测试「双模记忆系统」,包括「经典记忆」和「文件记忆」。此外,「梦境」预览版亮相,还有终极Agent平台Claude Conway登场,7x24h永不下线。

新智元
新闻资讯7

谷歌智能体发力:增强版Gemini Deep Research和专属API都来了

OpenAI强势更新,谷歌也没闲着。正式发布增强版的Gemini Deep Research,配套推出DeepSearchQA基准测试集,还发布了Interactions API,这不仅是Deep Research升级,还是Gemini生态的大升级。

量子位
算法论文8

Nature新研究:AI竟然分不清事实和信念

斯坦福大学团队在Nature发表研究,测试15个大模型,发现其区分事实、信念和知识存在严重缺陷。如处理第一人称信念准确率低,对语言线索依赖高,在高风险领域应用令人担忧。

AI工程化
新闻资讯7

刚刚,UCLA周博磊也加入了一家机器人公司

加州大学洛杉矶分校副教授周博磊官宣加入机器人初创公司Coco Robotics,同时该公司成立Physical AI Lab,周博磊任首席AI科学家。Coco积累大量数据,想借此推进自动化研发,且与OpenAI有合作。

机器之心
推荐文章7

[Triton编程][基础] Triton Fused Softmax Kernel详解: 从Python源码到PTX分析

文章详细介绍Triton Fused Softmax Kernel实现,从Naive Softmax到Triton实现,分析访存量、row索引计算、num_stages作用等,还修复官方年久失修代码,性能测试带宽吞吐提升约4倍。

GiantPandaLLM
开源动态7

真是天才!有人把做软著做成了skill,自动生成全套软著申请材料

介绍了SoftwareCopyright - Skill,它能一键生成符合软著申报要求的源代码文档和用户操作手册,全链路自动化,功能特点多,如真实代码抽取、智能合规排版等,还给出项目链接。

开源AI项目落地
算法论文8

同时监督和强化的单阶段大模型微调,告别“先背书再刷题”,推理泛化双提升|中科院&美团等

中国科学院自动化研究所联合美团提出单阶段监督 - 强化微调方法 SRFT,结合监督微调与强化微调,解决传统两阶段方法的不足,在多任务中提升推理和泛化能力。

量子位
算法论文8

GPT-4o-Image仅完成28.9%任务!上海AI实验室等发布图像编辑新基准,360道人类专家严选难题

上海人工智能实验室等团队针对图像编辑AI提出问题,推出RISE任务及配套评测基准RISEBench。测试九个视觉编辑模型,结果显示当前模型完成复杂指令能力欠缺,闭源与开源差距大。

量子位
开源动态8

微软发布多智能体 Web 操作系统!让 AI 成为真正“可控、协同、透明”的网页执行助手!

微软推出新一代多智能体 Web 操作系统 Magentic - UI,它能自动浏览网页、处理数据等,具备多智能体协同能力。其界面透明可控,功能丰富,安装使用友好,适用于多种复杂场景。

开源星探
开源动态8

清华发布AutoSOTA:一周刷新105个顶会SOTA,推动AI科研回归创新本质

在AI研究中,研究者常为提升1%性能反复调参。清华与中关村学院联合发布AutoSOTA,实现端到端AI科研自动化,一周发现105个性能显著提升的SOTA模型,推动科研回归创新本质。

机器之心