「AI测试集」共找到 10975 篇相关文章

新闻资讯7

中国机器人产业生态营在首钢园开营,构建产业协同新范式

10月30日,中国机器人产业生态营在首钢园开营,由首程控股发起。其整合多方资源构建闭环式创新生态,旗下基金已投资多家企业。生态营学员多元,罗振宇进行AI夜话分享,后续还有专家授课。

首钢园
开源动态8

开源对机器人的价值,远超大模型时代的想象丨唐文斌深度对谈抱抱脸创始人

Dexmal联合创始人唐文斌与Hugging Face联合创始人Thomas Wolf指出当前机器人研究痛点,联合推出开放、统一、可复现的真实世界机器人评测平台RoboChallenge.ai,探讨开源对机器人的价值、评测平台搭建等问题。

量子位
新闻资讯8

刚刚,Claude Sonnet 4.5重磅发布,编程新王降临!

北京时间今天凌晨,Anthropic发布Claude Sonnet 4.5,被定义为全球最强代码模型。它在多方面有显著突破,Anthropic还对全线产品更新,其在多项测试表现出色,且对齐性更好、更安全。

新智元
产品应用8

Anthropic发布Claude Sonnet 4.5:编程能力再登顶,新产品试图颠覆Windows操作系统

今日凌晨Anthropic发布Claude Sonnet 4.5,该版本在编程、计算机使用等能力上显著提升,开放Claude Agent SDK,还推出多项产品功能更新及“Imagine with Claude”研究预览,或对AI编程和Agent产品洗牌。

花叔
新闻资讯8

Gemini灵魂人物加盟xAI,马斯克亲自夹道欢迎!

前谷歌DeepMind资深研究员Dustin Tran加盟xAI,他是Gemini共同创造者,助谷歌追回AI风口。Tran介绍跳槽原因,涉及算力、数据和认同马斯克理念,还补刀OpenAI点子库存见底。

量子位
新闻资讯7

直播预约 | Transformer 模型能否通过连接训练数据中的离散知识进行推理?

为研究Transformer是否具备组合式推理能力,提出FTCT合成任务。实验发现Few - shot CoT提示可激发推理能力,训练与测试相似度、模型复杂度影响推理能力。还分析了其内在机制,展示其泛化推理潜力。

深度学习自然语言处理
开源动态8

智谱发布GLM 4.5,不仅开源模型还把训练框架也开源了

智谱AI发布GLM 4.5,不仅开源模型,还开源整套后训练基础设施。模型规格亮眼,性能也超越qwen 235b。其开源的训练框架slime专为强化学习扩展设计,完整工具链支持多种模型。

AI工程化
产品应用7

XBOW 发现Wordpress 任意文件读取漏洞的过程

XBOW用AI系统做全自动化渗透,在HackerOne排名第一。其博客文章分享发现WordPress Ninja Tables插件任意文件读取漏洞的过程,从侦察端点到编写脚本攻击,最终确认漏洞并进行了负责任披露。

AI与安全
新闻资讯7

Meta离职大牛千字「血书」,怒揭黑幕!内斗、抢功、末位裁员,全是毒瘤

Meta前研究员Blankevoort发2000字「血书」,控诉公司文化崩坏、末位淘汰如毒瘤、团队抢功无下限。他指出AI业务深陷泥潭,各部门内斗,合作缺失。Meta领导层重视此事,天价挖人能否带来改变存疑。

新智元
算法论文8

说句话就能飞!北航发布语言交互的无人机控制模型

北航刘偲教授团队提出语言引导的细粒度无人机轨迹控制研究框架,定义Flow范式。采用模仿学习法让无人机响应指令,构建数据集和仿真评测基准,还提出协作策略和算法,实现真机部署。

量子位