成本性能」共找到 6932 篇相关文章

算法论文8

肝脏也“按需定制”?科学家研发新型植入物,让肝组织在体内自己长

哈佛大学怀斯研究所团队研发“BOOST”策略,结合组织工程与合生物学,创造可在体内远程接收长指令的工程化肝脏构建体,在动物实验中实现植入后按需扩增,为解决肝脏移植供体短缺带来新希望。

DeepTech深科技
8

龙虾“黑入”卡帕西家的智家居系统:本来需要控制六个软件,现在用WhatsApp就操控

特斯拉前AI总监卡帕西做客播客,分享诸多AI观点。如编程个人力问题,可让AI写代码;用龙虾打理智家居,整合多软件;还谈及autoresearch、模型力断层、模型分化、开源闭源格局等内容。

量子位
开源动态8

AI 真看懂物理世界吗?FysicsWorld:填补全模态交互与物理感知评测的空白

多模态大语言模型正经历范式转变,目标是实现全模态协同交互。但现有评测体系难跟上模型发展。飞捷科思和复旦团队推出 FysicsWorld 基准,可评测模型多力,还提出 CMCS 策略,为全模态智发展提供指引。

机器之心
新闻资讯7

安谋科技Arm China闪耀2025全球计算大会|赋绿色算力,加速AI普惠

安谋科技Arm China受邀出席2025全球计算大会,参与多项活动。深度参与撰写《算力经济绿色研究发展报告》,推进本地化标准建设,还在具身智领域发力,其“周易”NPU IP将助力具身智落地。

芯师爷
开源动态8

21.7K 标星的开源TTS!FishAudio开源情感语音核弹:200万小时炼“声优AI”!

FishAudio团队推出新一代TTS语音模型OpenAudio S1,基于200万小时音频数据训练,采用Qwen3+Descript Audio Codec架构。它实现情感表达,在TTS - Arena榜单登顶,还提供不同版本适配,适用场景广泛。

开源星探
开源动态7

ICML25 | 让耳朵「看见」方向!仅依靠360°全景视频,就3D空间音频

空间音频技术提升沉浸式体验关键,但现有技术未充分利用360°全景视频空间信息。OmniAudio研究可直接从360°视频生空间音频,相关代码和数据集已开源,虽有局限但前景好。

量子位
算法论文8

备受Meta折磨,LeCun依旧猛发论文!新作:JEPAs不只学特征,还精准感知数据密度

备受Meta审核规定“折磨”,LeCun仍发新论文。其团队发现自监督模型JEPAs学会了数据“密度”,打破学界以往认知。还提出JEPA - SCORE工具,经多组实验验证其效果。

量子位
新闻资讯7

马斯克宣布:Grok学会看片了!无字幕看懂陶哲轩菲奖级难题

马斯克宣布Grok可分析任何视频。它对伪造视频鉴假溯源,但也有处理画面靠字幕、有幻觉问题和效果不稳定的缺陷。实测中它理解无字幕视频,还整理访谈内容。这功虽便利,但引发人类力退化担忧。

新智元
产品应用8

“天下苦CUDA久矣!”KernelCAT率先掀桌,实现国产芯片无痛适配

中国AI产业与英伟达GPU及CUDA生态深度依赖,国产AI根基脆弱。KernelCAT作为AI Agent,开发高性算子,在昇腾芯片调优测试中表现出色,还让国产模型在昇腾芯片上高效部署,实现35倍加速。

InfoQ
产品应用8

硬刚Sora2,万相2.6轻松定制角色、控制分镜,普通人也当导演

2025 年视频生领域发展迅猛,OpenAI 的 Sora 2 带来新玩法,商业落地加速,但普通用户体验门槛高。12 月 16 日阿里发布万相 2.6 系列模型,功全面升级,实测效果惊人,标志 AI 视频生迈向精准可控新阶段。

机器之心