「测试框架」共找到 3137 篇相关文章
全网首测!首款国产GPU「AI算力本」现场上手
新智元报道首款国产GPU「AI算力本」MTT AIBOOK,它搭载国产全功能显卡,预装开发环境,打破系统壁垒。其背后的MUSA架构全栈自研,软件升级、有翻译工具,硬件架构革新,还有开源计划,产品应用广泛。
挖掘注意力中的运动线索:无需训练,解锁4D场景重建能力
香港科技大学(广州)与地平线团队提出VGGT4D,通过分析VGGT内部机制,利用注意力层运动线索,提出无需训练框架,在动态物体分割等任务表现优异,为低成本4D重建提供新思路。
以孔子命名,超越Claude 4.5 Opus,Meta发布工业级自我进化AI软件工程师CCA
Meta与哈佛联合推出工业级软件工程师CCA,它是一套让AI在工业级代码库协作的方法论,解决长上下文推理等难题。其三维解耦设计、精细记忆机制、自我进化能力获数据验证,还适合引入强化学习。
谷歌最强大模型付费上线,在DeepSeek开源后被吐槽太贵
谷歌最强模型Gemini 3 Deep Think上线,推理能力强,能将草图变3D场景、搭建游戏。它在多评测基准表现出色,准确率超GPT - 5 Pro等。但仅向Ultra会员开放,月费约1800元,被吐槽贵,开源的DeepSeek-V3.2成冲击因素。
NeurIPS 2025|CAKE:大模型驱动的贝叶斯优化新配方,让黑箱优化更智能、更高效
香港中文大学(深圳)等高校研究人员提出 CAKE 方法,被 NeurIPS 2025 接收。它利用大语言模型动态设计高斯过程核函数,构建自适应贝叶斯优化框架,在多领域实验中效果优,还具备可解释性。
全国首部AI大模型私有化部署标准,公开征集起草单位和个人!
大模型浪潮下,企业对AI投入加大,私有化部署需求凸显,但缺乏成熟实施框架。全国首部AI大模型私有化部署标准《人工智能大模型私有化部署技术实施与评价指南》应运而生,已聚集30余家单位参编。
超实用提示词模板!AI科学家教你用协作提示词激发大模型潜力
文章由知名AI科学家Lance Eliot所写,指出主流大语言模型因训练机制变得‘短视’,缺乏深度协作能力。介绍协作提示词技术,能让AI成为主动引导者,并以测试展示效果,还说明了适用场景。
6款小游戏难倒所有顶级VLM!愤怒的小鸟让它们全军覆没,性能不如随机猜测
淘天集团未来生活实验室提出首个系统性评估多模态大模型(VLM)交互式物理推理能力的综合基准DeepPHY。它集成六个物理环境,对17个主流VLM测试,揭示其在物理交互等方面短板。
“我不想一辈子只做PyTorch!”创始人8年封神后宣布卸任,AI 圈进入接班时刻
11月6日,PyTorch创始人Soumith Chintala宣布卸任框架负责人并离开Meta。他回顾了PyTorch的发展,称其已成为AI研发核心支柱。他8年升至副总裁,还讲述了PyTorch开源成功路,未来将从头做小事。
用 AI 开发网站?这个 MCP 必装,Next.js 原生 MCP 已上线!
Next.js官方发布了自己的MCP,具备自动化调试等诸多功能,能增强代理在该框架下的开发能力。它可集成Playwright MCP,查询文档和最佳实践等,还说明了使用流程、提问方式及原理。