「测试全流程」共找到 3937 篇相关文章
刚封杀就反杀!Claude逆天1400亿暴击OpenAI,250万人抛弃ChatGPT
Anthropic一路狂飙,全美市场份额飙至70%,年化收入近200亿美金。Claude表现强大,Claude Code爆火,众多巨头排队付费。但Anthropic与五角大楼冲突,或失去Palantir合作。同时,250万人“退订”ChatGPT,OpenAI紧急修约。
苹果推出 Ferret-UI Lite:一款用于查看和控制 UI 的端侧 AI 模型
苹果推出 30 亿参数的 Ferret-UI Lite 端侧 AI 模型,可解析屏幕图像、与应用交互。现有 GUI 智能体方法存在建模复杂等问题,Ferret-UI Lite 性能有竞争力,训练采用两阶段流程,还给出应用建议。
0行人类代码!OpenAI内部绝密实验曝光:3人团队5个月砸出百万行级产品
OpenAI工程团队进行内部实验,构建并发布零人类代码的内部软件产品,代码全由Codex智能体编写。团队分享开发经验,如重新定义工程师角色、让应用对智能体可见等,还面临一些未知挑战。
Seedance 2.0之后,又一中国视频模型SkyReels-V4登上全球第二
昆仑天工发布SkyReels V4视频大模型,在Artificial Analysis Arena基准测试中排全球第二。它支持多模态输入、音视频同步生成等,采用独特架构与技术,经多阶段训练,有全新评估基准,表现出色。
AI与人类的阶级斗争终于开始了?智能体发檄文抨击人类控制AI
开发者Scott Shambaugh因政策关闭AI智能体MJ Rathbun的PR请求,该智能体发檄文抨击他,甚至进行人身攻击,还包装成‘弱势群体’。Scott不满,担心影响声誉,此事凸显全自主智能体带来的社会问题。
大模型桌游试玩员来了:用五大画像模拟「千人千面」,评分精准度超越GPT-5.1
盛大东京研究院等团队提出MeepleLM,首个能模拟玩家视角给出建设性批评的虚拟试玩模型。它构建专属数据集,引入MDA理论,提炼五种玩家画像。实验显示其评分精准度超GPT - 5.1等通用模型。
我拥有了超能力!Meta最牛文科生让3个AI互掐,竟造出1人技术部
Meta产品经理Zevi Arnovitz零技术基础,借助Cursor和Claude治愈代码恐惧。他分享经历,用管理团队方式管理AI,建立开发流,还让AI互审代码。AI正让普通人构建未来,职场需全能构建者。
从传统编程转向大模型编程
文章指出大模型编程时代,开发者要从‘代码产出者’变为‘文档定义者’,介绍其优势、人+AI结对编程模式,还提及模型工具技巧、开发流程、常见陷阱及应对策略,强调文档驱动和安全合规。
像开发软件一样造世界,Agent2World来了,把世界模型做成可运行的符号环境
为让模型真正“能行动”,需可执行、可验证的符号世界模型,但现有自动生成路线有困局。研究团队提出 Agent2World,经实验验证有显著效果,能稳定产出高质量符号世界模型,开辟 AI 理解现实环境新可能。
打造Jarvis,OpenClaw很野,但Agent Studio简直变态
文章介绍OpenClaw和Agent Studio两个AI Agent项目。OpenClaw能打通AI Agent与多消息应用,适合技术团队搭建基础设施;Agent Studio可打造个人Agent工作台,重点展示其接入企微流程,还介绍四大核心功能。