Agentic软件测试」共找到 4571 篇相关文章

产品应用7

一个销售数据分析机器人的诞生:看 Dify 如何在 DMS 助力下实现自动化闭环

Dify是低代码AI应用开发平台,但在企业级落地有代码执行和自动化调度瓶颈。本文介绍用“Dify + DMS Notebook + DMS Airflow”架构,以销售数据分析机器人为例,展示构建可调度、可扩展、可运维Agent系统的方法。

阿里云开发者
新闻资讯7

世纪反转:“安卓爹”谷歌成 iPhone“大脑供应商”?曝苹果每年掏70亿换定制Gemini,明年上线新Siri

彭博社报道苹果将与谷歌合作,每年付约10亿美元获定制Gemini模型升级Siri,计划明年春季推出。Gemini与苹果自研模型分工,经测试它更符合苹果需求,此合作资金流向反转引网友热议。

InfoQ
产品应用8

“神级模型”Gemini 3.0实力刷屏!联手谷歌全新氛围编程工具重塑前端,如今只差官宣

谷歌发布“vibe coding”版AI Studio,产品形态向可视化构建转变。有迹象显示Gemini 3.0将发布,二者结合或重塑前端开发。AI Studio速度快、易用,Gemini 3.0在前端开发测试中表现出色,谷歌借此参与AI竞赛。

InfoQ
开源动态8

社区供稿丨揭秘端到端文档OCR模型 POINTS-Reader

腾讯开源端到端文档OCR模型POINTS-Reader,论文被EMNLP 2025主会录取。它提出可扩展数据生成方案,具简洁、性能好、高吞吐量等特点,通过两阶段训练方案解决依赖蒸馏数据问题,在多基准测试表现佳。

Hugging Face
推荐文章8

一年上线超 10 款产品,AI 时代如何做独立开发

ThinkAny&MCP.so 创始人艾逗笔分享独立开发感悟与经验。他一年半做了十来款 AI 产品,认为开发要快,也需长期主义。还给出 AI 应用出海经验,介绍可 all - in 的 AI 创业方向,如 AI Coding、Agent 等。

InfoQ
产品应用7

钉钉为 AI 找了个绝佳工位

随着AI浪潮袭来,企业让AI Agent落地提效遇难题。钉钉以数据表格为架构实现AI应用化,将单元格变为AI“工位”,汇集AI工具、沉淀业务系统,还融合表格与文档、支持提醒功能,解决企业痛点。

特工宇宙
开源动态8

大模型结构化推理优势难复制到垂直领域!最新法律AI评估标准来了,抱抱脸评测集趋势第一

多个机构研究人员联合发布全新多语言法律推理基准数据集LEXam,它含4886道题,每道长篇题有答案和推理路径。研究显示现有大模型应对法律推理难,LEXam引入评估新模式,还对不同模型做了测试

量子位
算法论文8

字节最新大模型秘籍:只挑能有推理潜力的数据训练!1.3B模型无需标签自动挑选

字节Seed团队发布AttentionInfluence成果,用1.3B模型给7B模型选数据,无需训练和标签。通过比较基础与弱化模型损失差异评估数据影响,在多基准测试提升模型性能,还能结合分类器全面提升表现。

量子位
开源动态7

Karpathy用「harness」彻底终结了RAG。

假期时Karpathy提出llm.wiki想法引发关注。它是元框架,定义人类与AI协作管理知识的方式。与RAG不同,它将新材料关键信息编入已有wiki并持续维护。作者用多种数据测试,发现TextIn API解析效果好,还优化处理流程提升质量。

探索AGI
新闻资讯7

给龙虾定MBTI、发工牌,还让龙虾偷技能…打工人得适应新环境了

AI圈掀起“养龙虾”热潮,智谱、腾讯纷纷发布相关产品。极客和开发者对龙虾进行实测,它不仅能用于打造赛博宠物、线上办公室,还能完成视频剪辑、教辅、营销等工作。同时,Agent框架让大模型进入业务线,飞书成合适的工作台。

量子位