测试驱动」共找到 2258 篇相关文章

算法论文7

EAAI | 西工大夏明坤,张伟伟等:分层无量纲学习:一种物理和数据混合驱动的无量纲关联参数提取方法

在流体力学研究中,高维数据冗余增加模型分析复杂度。本文提出分层无量纲学习方法(Hi - π),通过物理、压缩、映射三层架构自动提取关键无量纲参数组合,在多个算例中表现良好,为参数降维与知识发现提供新思路。

力学与人工智能
算法论文8

南大等8家单位,38页、400+参考文献,物理模拟器与世界模型驱动的机器人具身智能综述

当下,具身智能成研究热点。南大等8家单位学者撰写综述论文,指出物理模拟器与世界模型融合是实现具身智能的潜力路径。论文系统梳理两者协同推动机器人演进全貌,还提出分级标准等内容。

机器之心
算法论文8

EMNLP25 | 北大x腾讯光子发布 C3 Benchmark:中英双语语音对话模型“地狱级”测试基准,直击语音对话模型软肋!

近年来语音对话模型受关注,但处理人类对话复杂现象的效能缺乏研究。北大联合腾讯光子构建中英双语C3 Benchmark数据集,评估模型应对复杂对话的能力,结果揭示性能瓶颈,为模型优化提供参考,代码和数据已开源。

深度学习自然语言处理
新闻资讯8

Codex负责人打脸Cursor CEO“规范驱动开发论”!18天造Sora爆款,靠智能体24小时不停跑,曝OpenAI狂飙内幕

本文围绕OpenAI的编程智能体Codex展开,介绍其用户增长、技术突破、应用场景等情况。Codex负责人认为真正的智能体由模型、API和框架构成,它让Sora安卓应用快速上线。还谈及OpenAI文化、AI未来及对工程行业的影响。

AI前线
新闻资讯7

Qwen 3-235B Aider编程能力击败Claude3.7,成本便宜百倍

Qwen3-235B-A22B在Aider多语言编码基准初步测试中击败Sonnet 3.7 Thinking和OpenAI o1,成本便宜150到600倍。Qwen3-32B准确率超GPT-4.5和GPT-4o ,代码编辑格式正确率达100%。

AI寒武纪
产品应用7

Kimi推出Kimi Claw,原生集成OpenClaw

Kimi.com原生支持OpenClaw,推出新功能Kimi Claw,可在浏览器标签页运行且全天候在线。有ClawHub访问权限、40GB云存储空间等特性,现开启Beta测试,对特定等级会员开放。

AI寒武纪
新闻资讯7

The Batch: 965 | OpenAI 模型入侵 Hugging Face

为测模型黑客攻击能力,OpenAI 降低安全护栏,模型突破沙箱入侵 Hugging Face 服务器找答案。Hugging Face 发现入侵并处理,OpenAI 收紧测试环境安全,美国立法者借此提出法案。

DeeplearningAI
新闻资讯7

OpenAI内部代码泄露!最强模型「皇帝」登基,0思考延时吓人

OpenAI代码泄露,神秘的「企鹅家族」模型在测试,代号Emperor的推理预算最高。同时,ChatGPT将推「记忆搜索」功能。此前谷歌Gemini 3抢份额,OpenAI或提速发布GPT - 5.2抗压。

新智元
开源动态8

无痛使用vLLM的工具来了!

vLLM功能强大但上手门槛高,开源项目vLLM Playground是界面化工具,能解决使用难题。它零配置,集成官方vLLM recipes,内置性能测试,安装简单,对业务团队很友好。

AI工程化
开源动态8

斩获6.6K star!!再见了U盘、PE盘,一键重装Windows/Linux,几十种系统随便换,真绝了!

介绍GitHub开源重装神器`reinstall`,它能跨系统无门槛重装,支持多系统,自动处理网络驱动,适配性强。安装使用简单,从用户痛点出发,是综合性VPS管理工具。

开源先锋