验证框架」共找到 2315 篇相关文章

算法论文8

AI生成视频总不符合物理规律?匹兹堡大学团队新作PhyT2V:不重训练模型也能让物理真实度狂飙2.3倍!

匹兹堡大学团队提出 PhyT2V 框架,论文已被 CVPR 2025 接收。该框架不依赖重训练或大量外部数据,通过链式推理与迭代修正机制,增强主流 T2V 模型物理场景泛化与生成能力,应用前景广。

机器之心
新闻资讯7

疯了……Claude 最强风控:验你实名身份证!

Anthropic更新支持文档,宣布在Claude平台引入身份验证机制,目的是防滥用、执行政策和履行义务。验证需有效证件、带摄像头设备,由Persona Identities处理数据。此前OpenAI也有类似机制,这或加剧AI使用人群分化。

AGI Hunt
算法论文8

港科广×腾讯联手打造《我的世界》神操作,400张截图就能让AI挖矿通关,成本降至5%|EMNLP 2025

港科广与腾讯联合团队提出VistaWise框架,将“跨模态知识图谱+轻量化视觉微调”引入开放世界智能体。实验显示其在“获取钻石”任务表现出色,成果被EMNLP 2025主会录用。该框架以低成本、跨模态为突破口。

量子位
算法论文8

刷新3D生成上限!一键生成精细到毛发的3D资产

在高质量3D生成需求增长背景下,现有3D生成框架在兼顾效率和质量上有瓶颈。南洋理工大学等提出Ultra3D框架,采用coarse - to - fine两阶段流程,用Part Attention机制提升效率,支持高分辨率输出。

量子位
算法论文8

在失败中进化?UIUC联合斯坦福、AMD实现智能体「从错误中成长」

伊利诺伊大学厄巴纳 - 香槟分校等团队发布论文,剖析LLM智能体失败机制,提出可自我修复的创新框架AgentDebug。研究指出智能体常见失败类型,构建错误分析体系、数据集,实验显示该框架效果显著,为AI可靠性提供方案。

机器之心
开源动态8

五百行代码打造SOTA视觉智能体!UniPat AI最新开源

多模态大模型代码能力强,但基础视觉任务常失误。UniPat AI推出极简视觉智能体框架SWE-Vision,让模型用代码弥补视觉短板,在五个主流视觉基准测试达最优。该框架设计独特,开源代码和数据已发布。

量子位
新闻资讯7

GPT-5.5反杀Claude登顶,AI编码旧榜不准了?

Datacurve推出新基准DeepSWE,号称「零污染」,用113道原创题挑战旧编程榜单。它使GPT和Claude名次逆转,揭示旧基准验证误差大、存在作弊现象,虽有局限,但反映编程基准竞争转向抗污染和验证可信。

新智元
算法论文8

合成数据>人工数据,绝对性能暴涨超10个点!仅需任务定义,高效微调大模型

为解决基础模型在专业领域表现不佳、依赖人工标注数据的难题,北大、MIT等机构提出「合成数据强化学习」框架。该框架仅需任务定义,能生成合成数据微调模型,在多领域基准上性能提升显著,代码已开源。

新智元
算法论文8

CVPR 2025 多模态大一统:斯坦福 x 复旦提出符号主义建模生成式任务

来自多机构研究团队提出基于符号化表征的生成任务描述框架,将符号化思维引入生成任务建模。实验证明,该框架在跨模态生成任务中表现出色,为推进生成式人工智能能力提供了成本效益高且可扩展的基础。

机器之心
算法论文7

OpenAI久违发了篇「正经」论文:线性布局实现高效张量计算

OpenAI 近日发布研究论文,提出用于高效张量映射的统一代数框架 Linear Layouts,解决了 Triton 等深度学习编译器中长期存在的难题。该框架是使用二元线性代数的张量布局通用代数形式,评估显示其优化版 Triton 性能有提升。

机器之心