测试用例生成」共找到 3678 篇相关文章

产品应用7

Nano Banana 邪修之王最强科研成果!教你自定义生图比例!

Nano Banana 出图有分辨率低和比例不可控问题。作者发现用垫图方式可控制其生图比例,已生成图片也适用,还给出操作方法、提示词,介绍不同平台效果及案例图下载方式。

歸藏的AI工具箱
开源动态8

腾讯开源WMT2025冠军大模型:拿下30个第一,同类最佳

昨晚腾讯开源WMT2025冠军翻译大模型Hunyuan - MT - 7B,它在31种语言测试中获30个第一,成同类最佳。文中介绍其架构、训练过程,还通过多场景翻译案例展现优势,有望推动高质量翻译普及。

AIGC开放社区
新闻资讯7

波士顿动力机器狗侧空翻炸场!穿轮滑鞋照样能翻

风头被中国机器人盖过的波士顿动力,让机器狗Spot完成侧空翻等动作。工程师称它并非为空翻设计。空翻是严苛测试手段,能验证系统性能,还透露了训练细节,此外它还将上《美国达人秀》。

量子位
产品应用7

深入体验 A2A SDK:一步步教你构建“服务化”的 Agent 系统

文章基于A2A最新Python - SDK,介绍将LangGraph的Agent通过A2A协议对外暴露并服务的方法,涵盖核心架构、概念、交互流程,以及A2A Server端、Client端实现和测试总结,还提及A2A优势。

AI大模型应用实践
算法论文8

从「记忆解题」到「深度推理」:港科大推出首个本科数学动态评测基准 UGMathBench

港科大团队发表在 ICLR 2025 的研究 UGMathBench,是首个本科数学动态评测体系。它涵盖 16 个学科领域,通过变量扰动创建多版本试题,引入创新指标评估模型推理能力,测试结果揭示了当前模型短板。

AI科技大本营
算法论文8

统一架构新思考,北大团队UniWorld-V1统一大模型

北大袁粒课题组提出统一大模型架构UniWorld-V1。通过对GPT - 4o - Image实验,发现其依赖语义编码器提取视觉特征,据此设计架构,在多基准测试表现优异,开源代码等促进研究。

AI寒武纪
推荐文章7

评论送书 | 奇点何时到来?AI会成为人类的威胁吗 ?

文章从非线性非平衡多自由度系统研究视角探讨生成式AI发展态势,对‘规模增大引发相变实现奇点’及‘AI成人类威胁’观点存疑,指出人类智能与AI智能有差异,推荐《智能的真相:AI能替代人脑吗?》。

AIGC开放社区
算法论文7

AI在「赚钱锦标赛」夺冠,比人类还会做生意!躺赚时代要来了?

研究人员提出自动售货机运营模拟环境Vending - Bench,测试大模型智能体管理业务能力。实验显示不同大模型性能方差大,Claude 3.5 Sonnet净资产表现最佳,人类基线在可靠性上表现较好,各模型长周期表现波动大。

新智元
新闻资讯7

马斯克说今年编程就要死了,你信吗?

近期一条推文称马斯克预言编程今年将消亡,引发热议。但实际是作者二次创作,马斯克只是即兴推测年底或不用写代码。‘AI 直接生成二进制’有跨平台、可审查、可靠性三个问题,编程更可能走向‘AI写、人审’。

宝玉AI
开源动态8

Meta 新成立超级智能实验室,让大模型RAG推理速度飙升30倍

Meta新成立超级智能实验室(MSL),首篇论文REFRAG将RAG推理速度提升30倍以上。它先把上下文压缩成摘要再解码,减少计算量和延迟,在多任务测试中表现出色,为大模型部署提供实用方案。

AIGC开放社区