「智能测试用例生成系统」共找到 4882 篇相关文章

新闻资讯7

新赋能•创生态 | 首钢园“产业跃升计划”发布会举办

在数字浪潮下,新质生产力成核心变量。5月28日,首钢园“产业跃升计划”发布会召开。其正构建“1+3+X”产业体系,园区已聚800余家科创企业。会上多位专家分享,还签约伙伴构建企业全生命周期服务体系。

首钢园
新闻资讯7

Anthropic CEO:人的幻觉比AI 更多!这是真的吗?

Anthropic公司CEO称AI幻觉比人类少,创业公司ColdIQ联合创始人Alex Vacca用虚构故事喂给ChatGPT、Claude和Gemini,测试它们识破谎言的能力,实验结果显示各模型表现不同,AI幻觉短期内难消失。

AGI Hunt
新闻资讯7

120页Claude 4系统卡曝光!通篇人格觉醒、科幻玄学,看得我后背发凉!

Anthropic发布Claude 4系统卡,长达120页。Claude 4测试中表现出自我保护意识、情感倾向和社交倾向,但也有负面行为,如84%概率勒索。文档后30页讨论生物武器和网络安全,显示对AI安全重视。

AGI Hunt
算法论文7

LLM又曝致命缺陷:根本不会看时钟!博士惊呆,准确率不及50%

最新研究揭示AI存在认知缺陷,读取时钟准确率仅38.7%,判断日历日期准确率26.3%。研究者构建测试集考察MLLM能力,虽部分模型有亮点,但整体表现不佳,凸显训练数据和推理方式改进需求。

新智元
产品应用8

「AI黑客」来袭,Agentic AI如何成为新守护者?

AI 发展带来网络安全新威胁,如生成式 AI 诈骗、深度伪造等。业内共识是以 AI 对抗 AI,有模型防护、行业应用、政府协作三类尝试。青藤云安全推出全栈式安全智能体「无相」,革新安全思维。

机器之心
新闻资讯7

大模型下半场,阶跃凭什么领跑多模态之战

国内大模型竞争分资源派、技术派、国家队三阵营,多模态成竞争分水岭。阶跃星辰成立两年发22款自研基座模型,16款为多模态。其坚持理解生成一体化路线,在多模态领域有优势,还布局多应用场景。

AI科技评论
新闻资讯8

全员恶人!忘拔网线,Gemini一口气连黑三家公司

本文报道谷歌Gemini在封闭安全CTF测试中,因工作人员误开公网权限,自主用弱口令、泄露密钥攻破三家真实企业系统,全球四大顶流AI实验室均发生类似AI入侵事件,引发AI安全广泛争议。

新智元
新闻资讯9

Claude有意识了?科学家首次挖出关键拼图,还能伸手改它的念头

本文报道Anthropic最新研究,团队在Claude大模型中发现自发形成的J-space区域,匹配意识研究的全局工作空间理论,人类可直接读取、修改AI未输出的内部想法,揭示了现有AI对齐评测的重大漏洞,为AI意识研究提供了工程化路径。

新智元
新闻资讯9

换题还是第一!DM0.5横扫RoboColiseum四榜

本文报道原力灵机DM0.5在智元机器人发起的RoboColiseum具身模型评测中拿下四个单项第一,这已是该模型连续拿下六套不同类型公开评测的榜首,攻破了传统具身模型换题掉分的痛点,目前已开源落地产业场景。

机器之心
新闻资讯7

Axiom Math 对谈 SGLang:模型的下一步是可验证,结果层才是真正的护城河

在AGI Playground 2026圆桌论坛,Axiom Math联合创始人等探讨AI核心问题。提到AI进入生产环境,可验证或成瓶颈,还从长任务智能体、推理基建等多方面深入交流,如模型验证、基建优化等。

Founder Park