AI模型测试」共找到 13799 篇相关文章

算法论文8

ICML 2026|让AI自动发现前沿风险:创智×复旦×牛津发布AutoControl-Arena

AI智能体走向真实应用,前沿风险藏于复杂长尾场景,难以靠人工覆盖。创智、复旦、牛津联合发布AutoControl Arena框架,自动合成可执行测试环境,还构建X - BENCH验证,已在GitHub开源。

机器之心
产品应用8

Wan3.0正式上线千问AI平台:稳定、真实、有质感

今天,视频生成模型Wan3.0正式上线千问AI平台。它在多维度全面升级,公测以来收到大量反馈,获创作者、企业用户等好评。在多领域经检验表现出色,还持续进化,部分API限时7折,已被多平台接入。

阿里云开发者
新闻资讯7

Mistral的首个强推理模型:拥抱开源,推理速度快10倍

本周二,欧洲人工智能公司 Mistral AI 发布全新大语言模型 Magistral 系列,有企业版 Magistral Medium 和 24B 参数开源版 Magistral Small。它推理强、多语言表现好,速度比竞品快 10 倍,应用于主流云平台,成本有竞争力。

机器之心
新闻资讯7

抨击 AI 炒作、曝企业需求为先,Anthropic 联创:模型提 0.01 性能就血赚,算力烧钱但值!

Anthropic 由 7 位前 OpenAI 核心成员创立,联合创始人兼总裁 Daniela Amodei 在接受采访时表示,“AI 安全”是核心优势,企业客户对安全性的高要求与之匹配。Anthropic 以“不要相信炒作”为价值观,谨慎对待支出和算法效率。

InfoQ
产品应用8

突破遥操瓶颈!全新无本体数据世界动作模型Noe-0发布

穹彻智能发布世界动作模型 Noe - 0,全链路采用无本体采集数据。其数据来自真实环境,配合 World Action Model 架构和 AI - Native 数据基础设施,跑通从真实世界经验到机器人能力转化的完整链路,是具身智能的里程碑。

机器之心
开源动态8

12.4K 标星!开源AI编程神器 Dyad,v0、Bolt的开源平替!

AI 编程领域的 v0、Lovable、Bolt 等平台虽降低开发门槛,但有联网、隐私等问题。开源项目 Dyad 可作其替代方案,支持本地运行、多模型,能与 IDE 等集成,已获 12.4K 标星。

开源星探
新闻资讯7

CEO卷款夜逃迪拜,15亿美元独角兽爆雷!700印度码农冒充AI,坑惨微软

Builder.ai自称用AI简化软件开发,吸引微软、软银等巨额投资,估值一度超15亿美元。但实际靠人工冒充AI,财务造假,最终破产。类似的“AI诈骗”不止这一起,多家公司被指控欺诈投资者。

新智元
新闻资讯7

扒一扒Meta全新大模型Muse Spark里藏着的PDR技术

Meta发布闭源大模型Muse Spark及‘沉思模式’,背后藏PDR推理技术。该技术通过‘并行起草+精炼’突破性能瓶颈,对比传统长CoT范式优势明显,在AIME竞赛题目测试中准确率显著提升。

PaperAgent
新闻资讯9

The Batch: 981 | Ox Alpha 被揭晓为 GLM-5.3-Flash

本文是DeeplearningAI The Batch专栏的AI行业资讯,揭秘此前匿名上线爆火的Ox Alpha模型,公开其为Z.ai推出的GLM-5.3-Flash,详细介绍该模型的架构、性能、定价与授权信息。

DeeplearningAI
新闻资讯7

AI人才争夺战加大薪资差距,OpenAI前副总裁:能留住人才是最重要的

随着AI人才争夺战白热化,大模型公司员工薪酬差距扩大,研究与非研究人员薪资差距明显。OpenAI前副总裁Peter Deng认为留住人才最重要,有独特优势的人定价能力强,Meta未来战略看重超级智能。

量子位