「特征提取」共找到 220 篇相关文章
阿里 Qwen3-TTS 两大更新直接封神!支持跨物种音色克隆,3 秒复刻!
阿里通义上线 Qwen3-TTS 两大核心能力,VoiceDesign 支持全文本控制音色特征,VoiceClone 能 3 秒音频跨语言、跨物种克隆音色。更新指标亮眼,如 0.1 秒级生成速度等,还可上手体验。
破立之间:智驾芯片博弈的“新赛道”
全球汽车产业向智能化转型,智驾芯片成产业链核心。当前产业面临多重困境,国际巨头垄断高端市场,行业陷入“算力堆砌”。SDSoW技术是破局之道,有三大特征,能实现性能、能效等多方面提升。
中国科学PMA|西工大张伟伟、索玮、宋家豪、曹文博:PINNs的局限性讨论与微分方程智能求解展望
物理信息神经网络(PINNs)是求解偏微分方程的热点方法,有统一处理正、反问题等优点,但也存在求解精度低、普适性差等局限。文章剖析其失效根源,展望了改进方向,为构建微分方程智能求解框架提供参考。
最新视觉大模型 DINOv3论文精读(逐段解析)
DINOv3是突破性自监督视觉基础模型,其创新围绕数据与模型协同扩展、Gram锚定技术、多阶段训练策略。它解决传统自监督学习难题,在多任务上无需微调达最优,为计算机视觉树立新标杆。
爬虫界“瑞士军刀”!开源高性能爬虫工具,实施进度监控、全栈SDK支持、n8n深度集成!
在AI驱动的数据时代,WaterCrawl是基于Python和Scrapy的开源网页爬虫工具,专为大规模数据提取和LLM优化设计,支持多语言内容抓取、实时进度监控和深度AI平台集成,优势显著。
ACL 2025 | 让小说角色 「活」起来!复旦BookWorld打造沉浸式小说世界模拟系统
复旦大学团队主导的BookWorld系统,是ACL 2025论文成果。它能从小说提取数据构建AI世界,让角色AI互动创作故事。系统有自主和干预模式,实验表现出色,未来可成互动娱乐平台。
LibTV这个邪修功能,大大减少AI视频抽卡次数!
作者分享在LibTV用「深度动作捕捉」功能做AI视频,将视频动作提取成深度图,可减少AI视频生成失败率,且不花积分,深度图管几何,提示词管外观,提一次能用多次。
微小目标漏检只是因为小?从数据到代码:一文读懂 AI-TOD-R 与 DCFL 如何解决旋转微小目标检测
此文指出旋转微小目标检测存在数据空白、学习偏差、特征易丢失等难题,提出AI-TOD-R数据集、全检测范式基准和DCFL框架。DCFL可缓解偏差,在8个数据集达SOTA,还给出实战代码案例。
镜头被油污糊住,机器人还稳定操作?北大/清华等给VLA加一道信息筛选,不靠额外数据,效率提升14x,真机鲁棒性反而更高了 | ICML 2026
北大、清华等机构联合提出StableVLA,相关工作被ICML 2026接收。该工作提出轻量级IB - Adapter,不依赖额外数据对视觉特征筛选对齐,让机器人遇视觉干扰仍能稳定执行任务,实验展现出鲁棒性提升。
AI看不到的爱心,成了最棒的AI检测器。
作者以漂浮爱心图检测AI,Gemini 2.5 Pro、GPT - 5等模型均失败。又用噪点鹿视频测试,AI准确率为0%。原因是AI是空间王者、时间瞎子,无“共同命运法则”视觉系统,存在时间盲视。