数字人模型」共找到 8665 篇相关文章

开源动态8

Transformer开始构建三维世界:开源模型几张图片秒级生成可探索3D场景

影溯将最新研究成果做成免费3D捕捉工具Crystal空间相机,背后技术QuerySplat已开源。其模型Topos - Lite改变组织三维空间方式,少量图片就能秒级生成3D场景,还能扩展容量。影溯团队经验丰富,技术应用场景广。

机器之心
新闻资讯7

半年不写代码,Claude Code之父:3年后写代码的暴涨100倍

Claude Code之父Boris Cherny称,虽软件工程师职称或消失,但3年后写代码、用智能体的会是现在100倍。他列出Claude Code团队的5种角色,指出岗位边界在融化,AI时代清理者角色更关键。

新智元
新闻资讯7

GPT 4o-mini华领队离开OpenAI:真正推动AI进步不是模型架构,而是互联网

前OpenAI研究员Kevin Lu加入Thinking Machines Lab,该公司2025年7月获约20亿美元早期融资,估值约120亿美元。Kevin Lu曾主导GPT - 4o mini发布,他认为真正推动AI进步的是互联网,而非模型架构。

新智元
开源动态8

中科院甩出多模态“核弹”!类GPT-4o多模态模型开源!支持语言-视觉-语音任意组合交互!

中国科学院计算技术研究所(ICTNLP)开源类GPT - 4o多模态模型Stream - Omni,支持文本、视觉和语音任意组合交互,核心是高效模态对齐技术,少量多模态数据即可训练,有多种使用场景。

开源星探
开源动态8

狂涨26.5K star!一个接口搞定20+AI大模型,开箱即用,太香了!

文章介绍开源项目One API,它是LLM API管理与分发系统,能统一管理主流AI模型,用一个接口搞定调用。有友好界面和可视化操作,在Github获26.5K star,还介绍其性能特色、安装使用方法。

开源先锋
开源动态8

2.6K Star!超逼真端侧TTS模型,0.5B参数3秒音频即时克隆!

文章介绍开源项目NeuTTS Air,它是免费、轻量级超逼真语音合成模型,仅0.5B参数,媲美商用TTS引擎,能在低功耗设备运行,支持3秒音频克隆声音,还给出使用步骤和应用场景。

开源星探
新闻资讯7

一夜裁员4000!前推特CEO挥刀,硅谷白领的安全感崩了

金融科技巨头Block毫无征兆裁掉4000,CEO称是智能工具催生新工作方式。但专家指出AI未大规模提高生产效率,裁员或因员臃肿和财务问题,如今白领工作受AI冲击大。

新智元
产品应用8

懂方言,通诗词,精通30国语言,阿里发布语音识别大模型Fun-ASR1.5

阿里发布语音识别大模型Fun - ASR1.5,可精准识别30种语言,覆盖中文七大方言体系及二十余种地方口音,强化古诗词诵读专项识别,后处理环节优化标点预测和文本归一化,降低工成本。

千问大模型
新闻资讯7

他们,诠释了 QCon 的技术厚度 | 2025 QCon 上海站优秀出品与明星讲师揭晓

2025 QCon全球软件开发大会(上海站)圆满落幕,超1300参与。大会聚焦可持续工程能力建设,强调‘落地实践’。收官之际揭晓优秀出品与明星讲师,他们推动知识流动,诠释QCon技术厚度。

InfoQ
新闻资讯7

代码碾压一切!OpenAI神秘模型o3-alpha一夜刷屏,却遭41岁大神绝地反杀

OpenAI神秘模型o3 - alpha曝光,代码能力强大,疑似在编程大赛获亚军,不敌类选手Psyho。ChatGPT Agent也实力惊。比赛组织者指出AI代码优化强,但缺类创造力。

新智元