「传统软件测试」共找到 3160 篇相关文章
《圣经》成书时间或被改写!AI竟发现《死海古卷》早于所罗门时代
科学家用AI重构《死海古卷》时间线,发现许多卷轴比原先认为的年代更早。AI模型Enoch结合碳14定年与笔迹分析首创定年方法,超越传统古文字学,还可能揭示圣经作者线索。
MCP进阶:一键批量搞定MCP工具部署
在AI应用复杂当下,传统MCP工具集成有痛点。文章提出基于阿里云计算巢的一站式方案,可多MCP工具批量部署,首创双通道调用能力,还介绍部署、使用、增减工具及问题排查等内容。
阿里云通义点金发布DianJin-R1金融领域推理大模型,32B模型荣膺榜首
阿里云通义点金团队与苏州大学合作推出DianJin-R1金融领域推理大模型,介绍其开源数据集与模型、基于通义点金平台的数据合成,展示了其在性能测试中的优异表现,推动金融科技智能化进程。
一分钟的奇迹与幻觉:实测世界模型Happy Oyster
4月16日阿里发布世界模型Happy Oyster,支持多模态输入与音视频联合生成。实测显示,它在场景构建、渲染上有优势,可替代部分传统引擎工作,但存在一致性不足问题,现阶段更适合改造游戏开发流程。
字节手里的牌,比收购 Manus 更狠 - AnyGen 体验一周有感
本文作者分享使用字节海外推出的通用AI Agent产品AnyGen的体验,介绍其功能亮点、多场景测试效果,对比竞品,认为它定位职场场景,性价比高,或引领通用Agent竞争转向用户体验。
奥特曼仓促亮剑GPT-5.2!一张图爆火全网,全面碾压Gemini 3
谷歌发布Gemini 3,其惊艳表现打乱OpenAI阵脚,公司进入「红色警戒」,将提前于12月9号发布GPT - 5.2应对。网传GPT - 5.2测试分数全面超Gemini 3 Pro,但遭网友质疑。OpenAI面临用户流失等危机。
Vibe Coding 产品最大的错觉,是以为自己真的有护城河
Base44创始人Maor Shlomo认为Vibe Coding工具易被复制,技术护城河难寻。他指出真正的护城河是“垂直整合”,构建全栈平台很关键。还谈到市场竞争、软件发展趋势、公司策略等多方面内容。
最强开源0.9B级OCR模型!本地Agent、知识库都有救了!
百度飞桨PaddleOCR团队开源多模态文档解析模型PaddleOCR-VL,参数量仅0.9B,对算力要求低。它在OmniDocBench V1.5榜单屠榜,经测试,能精准识别发票、图表等,适合本地环境与资源受限设备。
国产大模型新SOTA:蚂蚁万亿级旗舰模型赶超GPT-5
蚂蚁集团开源万亿参数旗舰大模型Ling-1T,属Ling 2.0家族。它激活比例低降低运算成本,训练有“Ling缩放定律”等方法,多项测试超主流模型,不过处理超长上下文成本较高。
当下的 AI 产品:有 revenue,但不是 recurring 的
当下AI创企有收入但非经常性,ARR指标被扭曲。因定价权在巨头手里,传统SaaS的ARR已不适用。初创生态封闭循环,未来ARR可能不再是评估方式,新指标或聚焦留存率等。