「传统软件测试」共找到 3156 篇相关文章
Claude Code之父版「职场MBTI」:AI洗牌后只剩5类人,你选哪种?
Claude Code之父Boris Cherny提出AI时代「职场MBTI」,含原型师、建造师等五类角色。他认为传统职能将被洗牌,未来是通才的黄金时代,还给出团队组队方案及个人自救建议。
确认!DeepSeek多模态AI已经开测
DeepSeek研究员陈小康、陈德里确认其V4视觉模式开始灰度测试。更新后出现识图模式,具备真实图像理解能力。陈小康是多模态研究组负责人,陈德里负责语言模型等核心方向,V4可谓满血归来。
成本降九成,准确率100%!MIT反常识架构挑战硅谷信仰
慕尼黑工业大学等研究者指出企业AI落地问题源于数据乱。RUBICON架构用AQL查询语言,把操作权交用户,让LLM在精确范围工作。测试中它准确率100%,成本低,优于现有智能体AI方案。
UniPat AI开源SWE-Vision:五百行代码打造SOTA视觉智能体!
多模态大模型代码能力进步大,但基础视觉任务常失误。UniPat AI开源SWE-Vision框架,让模型用Python代码处理视觉判断。它极简设计,在五个视觉基准测试达最优,提升前沿模型视觉表现。
规范对齐时代:GPT-5 断层领先,让安全与行为边界更明晰
上海交通大学等团队提出规范对齐概念,构建评测基准 SpecBench 评测 33 个主流模型,发现多数模型有不足。还探索测试时深思方法,如 Align3 能提升规范遵循度,GPT - 5 在规范对齐上断层领先。
Lovable 仅凭 35 个员工创造 8000 万美元 ARR 的原因
Lovable 仅35人7个月达8000万美元ARR,因其有大量 AI 原生员工。AI 原生员工默认用 AI,能快速解决问题。聘用此类员工可释放自主权、提升速度,传统公司转型难,未来组织将变革。
技术思辨|AI Coding:经验壁垒正在失效,工具进化重塑编程
AI飞速发展,AI Coding对传统研发模式冲击大。文章总结5个变化趋势,如专业性转移升级、效率体现为高质量专注等,还探讨AI时代开发者核心技能及经验价值,指出变革带来挑战与机遇。
DeepSeek R2没来,DeepSeek R1+来了~
DeepSeek官方发布通知,DeepSeek R1模型完成小版本升级成DeepSeek - R1+。PaperAgent实测近1000行代码无错,网友测试显示CoT有显著变化、前端审美提升,还提及DeepSeek - R2可能快来了。
52天73次产品级更新,个个爆款太神了,AI原生组织的进化恐怖如斯
2月1日到3月23日,Anthropic在52天内进行73次产品级发布,Claude Code和Cowork表现亮眼。其核心是把AI当基础设施,实现商业化且推动公司高估值,给传统组织带来冲击,AI赛道成组织进化竞赛。
AI顶会模式出了问题? 「不发表,就出局」的恶性循环,正在压垮整个AI学界
随着AI领域发展,NeurIPS等大型学术会议愈发热门,但也带来诸多问题,如发表激增、碳排放过载、研究与会议脱节等。新加坡国立大学团队研究后指出传统模式弊端,并提出社区联合型会议新模式。