「传统软件测试」共找到 3156 篇相关文章
GUI 将死,CLI 才是一切
文章指出 GUI 时代将尽,CLI 正赢下一个十年,其用户将是 Agent。介绍了 CLI - Anything 项目,它能为软件生成 CLI 接口,让 Agent 用命令行操控软件,还探讨了 Agent 命令执行权限等问题。
震荡股市中的AI交易员:DeepSeek从从容容游刃有余? 港大开源一周8k星标走红
2025年10月美股震荡,港大黄超教授团队开源AI-Trader项目启动实盘测试,上线一周在GitHub获近8K星标。6位AI交易员投入纳斯达克100交易,实验测试其交易纪律、市场耐心和信息过滤能力。
ICML 2025 Spotlight | 多模态大模型暴露短板?EMMA基准深度揭秘多模态推理能力
最新研究推出 EMMA 基准测试,揭示顶尖多模态大语言模型在深度视觉与文本融合的复杂多模态推理上显著不足。该研究已被 ICML 2025 接收,代码数据开源。实验表明,现有模型与人类专家差距大,视觉推理是核心瓶颈。
The Batch: 864 | GLM-4.5:一款开放的智能体竞争者
大型语言模型推动智能体能力交互竞赛正酣,中国 Z.ai 推出 GLM - 4.5 系列开源权重模型,在推理、编程等基准测试中表现出色,还介绍了其工作原理、研究和测试结果等。
EAAI | 香港理工大学王旭等:一种增强MFNN的多源气动数据重构方法
飞行器气动压力分布获取依赖风洞试验或数值模拟,多源数据差异为气动数据重构带来挑战。本研究提出增强型多保真神经网络,通过差分运算提升模型泛化精度,在跨声速压力分布重构中效果显著。
AI Code:Cursor狂飙,Anthropic开战
生成式AI使软件开发成巨大市场,全球开发者带来每年3万亿美元经济贡献。Cursor等初创公司崛起,介绍了AI编程工作流程、代码生成审查方式、质量保证等,还探讨了软件开发的变化及发展趋势。
Google情报报告:滥用 AI 工具的最新进展
谷歌威胁情报小组(GTIG)报告显示,2025年攻击者将新型AI恶意软件用于实际攻击,恶意软件采用即时AI、利用社会工程绕过防护,AI工具网络犯罪市场成熟,如PROMPTFLUX等利用AI动态改变行为。
人工智能研究者如何意外发现:我们对“学习”的理解,可能全是错的
传统理论认为大模型会过拟合,而如今大模型却驱动了诸多应用。2019年研究者突破传统扩大模型规模,出现‘双下降’现象。‘彩票假说’解释其成功原因,还重新定义了‘智能’,揭示科学进步规律。
国产模型新盛况!王座易主:Kimi K2 Thinking开源超闭源
月之暗面开源 Kimi K2 Thinking 模型,多方面性能超 GPT - 5 等闭源模型。它擅长多轮调用工具和持续思考,在多项基准测试达 SOTA 水平,成本低且授权宽松,引发全网讨论。
真实物理加持,人物动画再也不像塑料人!UIUC华人让角色活起来了 | ICCV'25
PhysRig是UIUC与Stability AI联合提出的面向角色动画的可微物理绑定框架。它用物理建模替代传统绑定权重设计,解决传统LBS无法克服的问题,显著提升角色动画真实感,还适用于动作迁移任务。