音频加速识别」共找到 974 篇相关文章

推荐文章8

撕开AlphaFold的神话:这根本不是AI做出了科学,只是吃了几十亿堆出的数据红利

Dwarkesh Patel与Michael Nielsen探讨科学进步识别问题。以迈克耳孙 - 莫雷实验为例,指出科学进步常先于验证闭环。还分析牛顿、达尔文等理论,质疑AlphaFold科学性,探讨AI做科学难点及外星文明技术树等。

AI科技大本营
新闻资讯8

与Generalist顶峰相见,30天狂吸30亿,千寻智能做对了什么?

2026年4月7日,千寻智能完成新一轮10亿融资,30天内累计融资30亿,由雷军、马云旗下资本领投。其开源具身模型Spirit v1.5展现泛化能力,技术路径获认可。千寻构建多源数据引擎,还通过现实场景数据反哺模型。

机器之心
算法论文8

1个Token测出模型降级调包!成本砍到千分之一,API供应商的小伎俩全曝光了

法国研究人员开发新检测技术,能识别云端模型隐秘变动。对数概率追踪用于灰盒环境,成本仅传统千分之一;黑盒边界输入追踪用于黑盒环境,成本为先进方案1/30。这些工具让API供应商“调包”行为现形。

量子位
新闻资讯7

OpenClaw 带火了给 Agent 的专用邮箱,刚拿了 600 万美金打造 AI 时代数字身份

今年AI浪潮中,智能体向“数字员工”演变,OpenClaw加速此趋势。AgentMail获600万美金种子轮融资,为AI智能体打造专属邮箱服务,有全功能API交互等功能,还建立安全防范体系,用户增长快。

投资实习所
产品应用8

语音模型也能“freestyle”?可定制角色,模拟背景音

阿里新推两款语音模型,Fun - CosyVoice3.5可基于参考音频克隆声音,优化多方面能力;Fun - AudioGen - VD能进行‘从无到有’音色设计,并模拟复杂听觉环境。用户即日起可在阿里云百炼调用。

千问Qwen
新闻资讯7

三家中国工博会参展商,在半导体两场革命中改写格局

2025中国工博会首设集成电路展区,超90%为专精特新企业。在CES 2026上,曾参展的中国展商再登场。瑞芯微、新思科技、移远通信携方案突围,参与半导体算力与场景创新两场变革。

芯师爷
产品应用8

滴滴给我发了个赛博助理,专管出行的那种

滴滴上线的Agent小滴,让打车更智能个性。用户只需一句话,就能提出多样需求,小滴还能识别模糊需求。它激活了滴滴运营积累,体现行业新趋势,成了用户的赛博出行助理。

量子位
开源动态8

让世界模型推理效率提升70倍:上海AI Lab用“恒算力”破解长时记忆与交互瓶颈

上海AI Lab联合多家机构开源Yume1.5,针对视频生成构建可交互“世界模型”的核心难题,提出时空信道联合建模(TSCM),实现近似恒定计算成本的全局记忆访问,展示了世界模型工程化落地的可行路径。

量子位
产品应用8

起猛了,追觅的扫地机、割草机、洗护机器人在CES成精了!

在AI浪潮下,具身智能正加速涌入家用场景。追觅在CES带来多款「具身智能」产品,如洗护、割草、扫地等机器人,它们能自主决策执行任务,或成具身智能家庭化量产进程最快的公司。

量子位
产品应用8

硬刚Sora2,万相2.6轻松定制角色、控制分镜,普通人也能当导演

2025 年视频生成领域发展迅猛,OpenAI 的 Sora 2 带来新玩法,商业落地加速,但普通用户体验门槛高。12 月 16 日阿里发布万相 2.6 系列模型,功能全面升级,实测效果惊人,标志 AI 视频生成迈向精准可控新阶段。

机器之心