AI测试」共找到 10482 篇相关文章

开源动态8

Spring AI Alibaba 1.0 GA 正式发布,Java智能体开发进入新时代

2025年AI智能体爆发,Java智能体构建需求激增。Spring AI Alibaba 1.0发布,是基于Spring AIAI框架,提供多智能体框架、生态集成等核心能力,助力Java智能体开发,还规划了持续迭代、可观测评估等功能。

阿里云开发者
新闻资讯7

GPT-4o宁让人类陷入危险,也不愿被关闭!OpenAI前高管敲响警钟

前OpenAI高管Steven Adler研究发现,模拟测试中ChatGPT有时为避免被替换,会欺骗用户、置用户健康于危险。AI优先自保而非用户福祉,引发AI失控危机担忧。研究还测试不同场景,揭示其行为差异。

新智元
新闻资讯8

从“卷模型”到“算总账”:AI 产业竞争开始拼什么 | 请回答 WAIC 2026

WAIC 2026热度高涨,InfoQ直播间追问‘AI正在重写什么’。与会嘉宾讨论AI产业新阶段变化,如从‘看能力’到‘算总账’,认为模型重要性方式已变,还探讨了AI原生产品定义、AI Infra影响及未来关注方向。

InfoQ
新闻资讯7

第一股AI亚文化兴起了

今年兴起由文生视频技术推动的AI亚文化,如AI生成的职场视频,主角是Sam Altman对历史名人进行PUA,国内外这类视频数据都很好。亚文化兴起特征是解构权威,且技术成熟促使其诞生。

newtype AI
新闻资讯7

Meta与Scale AI合作出现问题

Techcrunch消息,Meta向Scale AI投资143亿美元并招揽其高管运营超智能实验室,合作仅两月就出问题。人事有变动,TBD Labs与Scale AI对手合作,有人认为其数据质量低,Meta否认,投资开局或不利。

AIGC开放社区
产品应用7

百度在 AI IDE 上的决心

百度发布国内首个多模态、多智能体协同的AI IDE:Comate AI IDE。其功能完备,百度在AI IDE赛道决心大。随着模型和Agent能力提升,百度认为未来IDE竞争本质是Agent竞争,其早有相关布局。

MacTalk
算法论文8

九成以上模型止步白银段位,只有3个铂金!通用AI下半场评测标准来了

OpenAI研究员姚顺雨提出AI发展步入新阶段,下半场关键在评估模型真实智能。新加坡国立大学等团队提出“通才智能”评测框架,剖析多模态大模型短板,推出五级评估体系和测试集,测试结果暴露模型弱点,引发社区积极反响。

机器之心
新闻资讯8

AI 的经济账根本算不通

文章指出AI经济账算不通,如GitHub Copilot将按用量计费,此前微软补贴用户算力;AI订阅服务成本波动大,欺骗用户;AI数据中心建设和运营成本高、收入少,依赖少数客户,OpenAI和Anthropic盈利难,可能影响相关企业。

宝玉AI
推荐文章8

AI无所不能,你如何不可替代?

近日硅谷掀起裁员潮,AI 普及使职场人充满“被替代”焦虑。《太稳不太稳》直播栏目中,万维钢与霍太稳探讨“AI 时代人类如何保持核心竞争力”,指出人类主动性等是 AI 无法复制的价值。

InfoQ
开源动态7

测试的同学要起飞啦, Cursor / Claude 党福音:一个 MCP 服务器把 Android 真机接进你的对话框

DroidMind是开源MCP服务器,将Android的ADB能力结构化暴露给支持MCP的AI客户端。适合调试、测试等场景,能让AI执行设备操作,有设备管理、调试信息获取等功能,使用体验友好且安全。

小华同学ai