测试全流程」共找到 3906 篇相关文章

算法论文8

视频模型也能推理,Sora2推理能力超过GPT-5

DeepWisdom团队研究发现视频生成模型能推理,在空间类任务上比图文模型更擅长。团队推出VR - Bench基准测试,构建客观评分体系。实验显示视频模型在空间推理有优势,相关代码和数据集已开源。

量子位
产品应用7

AI花17小时写了篇30页学术论文!自主选题,包含实验,还符合APA格式规范

Virtuous Machines AI系统花17小时、114美元,找288个真人做实验,写了篇30页认知心理学领域学术论文,从选题到成稿自动化。其架构独特,不过也存在理论误解等小缺点。

量子位
产品应用8

又一款国产高性能GPU问世,实力对标海外巨头

2025年9月22日,芯动科技发布“风华3号”功能GPU,它架构面,功能覆盖广,在大模型等领域有多个突破,还适配多生态与系统。该产品能为多行业定制服务,标志国产GPU进入规模化应用阶段。

芯师爷
新闻资讯7

马斯克机器人出街卖爆米花,还会捉弄顾客

马斯克的特斯拉Optimus机器人出街卖爆米花,还会捉弄顾客、给小朋友递爆米花、拍照比剪刀手。它是黑款,此前还曝出金色款,且开通中国区微博。此外,小鹏首款机器人‘Iron’亮相慕尼黑车展。

量子位
新闻资讯8

Cursor终结者?Grok 4正式登顶!马斯克扬言编程碾压,20万N卡年赚47亿美金!

时隔5个月,xAI发布通用模型Grok 4,后续还将推编码、多模态代理和视频生成模型。Grok 4已上线,有三个订阅版本。马斯克称其智能超博士生,在多基准测试中领先,编码或超Cursor。

InfoQ
产品应用7

R2没来,却等来综合性能更优的DeepSeek R1T2

抱抱脸热门排行榜出现R1变体模型DeepSeek-TNG-R1T2,构建于多个父模型之上,在智能与输出token长度间达新平衡点,速度快且测试表现佳,还给出与不同模型对比的选择建议。

PaperAgent
算法论文7

LiteReality来了!用一张扫描图还原真实3D世界

剑桥大学提出 LiteReality,可将室内 RGB - D 扫描数据转为 3D 虚拟副本,支持多种图形渲染功能,适用于多领域。它通过多步骤流程重建场景,还引入新框架解决材质恢复问题,但也存在依赖人工等局限。

带你学AI
开源动态8

球首个!10万小时人类数据开源,Hugging Face罕见站台

上周Dyna Robotics公司用超100万小时人类第一视角视频训练DYNA - 2模型,发现物理AI有Scaling Law。8月20日光轮智能宣布10万小时模态人类行为数据EgoSuite - Open100K开源,与Hugging Face联合发布。

新智元
开源动态7

Clawdbot 深度拆解: 7 个问题看懂它。

近日,AI技术圈焦点是开源项目Clawdbot(已改名Moltbot)。它是“天候Jarvis”,GitHub星标超8万。本文深度拆解,介绍其概念、对比同类、分析独特魅力、创意场景、安装配置、运行原理及面临的挑战。

AI大模型应用实践
新闻资讯8

Chiplet(芯粒) —— 后摩尔时代的芯片“乐高”玩法

当单芯片逼近物理极限,Chiplet技术应运而生,它将大芯片拆分成小芯片,通过先进封装技术整合。该技术成本低、良率高,应用场景多元,但面临热管理、测试和标准统一等挑战,未来发展前景广阔。

芯师爷