音频驱动虚拟形象」共找到 856 篇相关文章

算法论文8

Nature子刊:攻克医疗器械「看不清」难题,赋予自动驾驶视觉

MicroSyn-X首创无需真实数据的AI合成影像技术,让机器在无标注虚拟X光中学会追踪微型手术器械,突破医疗数据稀缺瓶颈,为自动化微创手术提供新路径,且代码和数据已开源。

新智元
算法论文8

2026开年关键词:Self-Distillation,大模型真正走向「持续学习」

2026年刚开场,Self - Distillation成大模型领域高频词汇。传统强教师依赖范式难适配大模型持续进化,MIT等顶尖机构发布三项成果,用不同方法实现自蒸馏,推动模型持续学习。

机器之心
算法论文8

经验记忆黑科技:LightSearcher让AI工具调用减39.6%、推理快48.6%

现有的 RL 驱动的深度思考大模型系统面临准确率与效率的「跷跷板」困境,北邮百家 AI 团队提出 LightSearcher 框架,解决了这一痛点,在保持准确率的同时,显著提升了工具调用效率。

机器之心
开源动态8

微软GigaTIME登上《Cell》:5美元切片变成免疫图谱

微软GigaTIME登上《Cell》,能把5美元H&E切片翻译成稀缺免疫图谱,在人群尺度重建TIME。它突破癌症免疫研究旧限制,成果经多数据集验证,已在Foundry Labs与HuggingFace全量开源。

新智元
新闻资讯7

比996更高效!夫妻合伙人不「下班」,狂赚$4700万

AI初创公司Serval的CEO Jake Stauch和COO Tatiana Birgisson这对夫妻创业成功获4700万美元融资。他们将工作与生活高度融合,工作高效且家庭温情,证明工作与生活深度整合模式的价值。

新智元
算法论文8

碾压π0.5,复旦团队首创「世界模型+具身训练+强化学习」闭环框架

复旦团队针对当前 VLA 策略依赖模仿学习、真实机器人在线 RL 成本高、传统物理仿真器有局限等问题,提出 ProphRL 框架。该框架以世界模型 Prophet 为核心,结合 RL 算法,为具身智能落地提供更可行路径,实验效果显著。

机器之心
新闻资讯7

明晚直播|从《黑客帝国》到迪士尼乐园:谈《拟像与拟真》

法国后现代思想大师让·波德里亚在《拟像与拟真》中预警数字时代图景。2025年12月5日19:30—21:30,豆瓣读书联合南大社·守望者邀汪民安等嘉宾,结合电影探讨波德里亚思想及拟像,直播在豆瓣读书视频号同步。

豆瓣读书
产品应用8

Couchbase与爱奇艺的十年之约:Magma引擎如何破解TB级缓存性能与成本难题?

在AI驱动应用革新浪潮下,海量数据处理的性能与成本平衡成挑战。Couchbase技术直播中,爱奇艺专家分享实践经验,揭秘其如何破解性能、扩展性与成本难题,还介绍了Capella AI Services等。

InfoQ
开源动态7

SGLang Model Gateway 0.2 发布:企业级一体化AI原生编排

市面上一体化AI原生编排方案稀缺,Oracle和SGLang团队推出SGLang Model Gateway 0.2。它从SGL - Router重构而来,核心能力升级,架构分三层,部署灵活,还支持Kubernetes集成和向后兼容。

AI工程化
产品应用7

AI Agent的未来之争:任务规划,该由人主导还是AI自主?——阿里云RDS AI助手的最佳实践

文章以阿里云RDS AI助手实践为例,探讨AI Agent任务规划该由人主导还是AI自主。实测发现大模型自主规划效果不佳,企业更需稳定可靠,人工规划是最佳选择,还提出用‘混合规划’兼顾灵活与可靠。

阿里云开发者