可动物体生成」共找到 5451 篇相关文章

算法论文8

合成数据≠生成模型:一文读懂合成数据的全新范式

最新研究提出合成数据全新分类框架,突破‘生成模型=合成数据’传统认知,涵盖多种方法。还按应用层次划分场景,指出合成数据面临模型坍塌等挑战,正成新型基础设施。

新智元
算法论文7

解释性杀疯了!结合机器学习,发顶会轻轻松松!

在机器学习领域,模型解释性愈发重要。结合XAI技术能提升模型透明度与信度,如预测儿童饮食多样性、心血管疾病分类准确率很高。还整理9篇相关论文,解析两篇文章创新点、方法和结论。

机器学习AI算法工程
开源动态8

效果非常不错!阿里昨开源图形海报生成模型Qwen-Image

阿里昨日开源多模态图像基础模型Qwen-Image,基于20B参数MMDiT架构,在复杂文本渲染和精确图像编辑方面有重大突破,支持多风格图像生成、智能图像编辑等,还介绍了使用、部署等方法。

GitHubStore
新闻资讯7

Node.js 拟内置虚拟文件系统,AI 生成代码引争议

Node.js 技术指导委员会成员 Matteo Collina 提议在 Node.js 核心新增 `node:vfs` 模块引入原生级虚拟文件系统,引发关注。功能解决常见工作流程难题,已获部分开发者支持,但因用 AI 开发引争议。

InfoQ
开源动态8

Google 开源 InkSight,把手写笔记直接变成编辑数字笔记!

Google 开源 InkSight,能将手写照片转为数字墨迹,与传统 OCR 不同,它「还原书写方式」。具备离线转在线、多语言支持等功能,核心是「阅读 + 书写」双重训练,有两种使用模式。

开源星探
开源动态8

图像、视频一模搞定!字节全能原生多模态本地部署

字节开源原生多模态模型Lance,仅3B激活参数,40G显存就能跑,已登顶huggingface趋势榜。它能进行图像与视频的理解、生成、编辑等操作,在多个基准测试中表现优异,多项性能居首。

AIGC开放社区
开源动态8

隐私堡垒!Presenton开源革命:本地AI生成PPT,敏感数据永不触网!

本周GitHub新开源项目Presenton离线制作PPT,支持主流AI模型,本地运行保护数据隐私,有灵活自定义模板和API集成功能,还具备多模型支持、主题定制等特性。

开源星探
产品应用8

重磅!iPhone 端侧部署 Gemma 4 了!完全零token消耗!

PhoneClaw 是运行在 iPhone 的本地 AI Agent,离线运行 Google Gemma 4。它支持多模态,有隐私保障和灵活模型管理。文中介绍使用方法、自定义 Skill 方式、常见问题,还提及后续扩展计划。

GitHubStore
新闻资讯8

刚刚,谷歌重大突破!量子计算首次验证,登《Nature》封面

谷歌宣布重大成果,全新量子回声算法在 Willow 芯片运行,解决原子相互作用问题比传统超级计算机快 13000 倍,结果验证,相关研究登《Nature》封面,朝量子计算实用迈进一大步。

机器之心
开源动态8

腾讯重磅开源!端到端视频音效生成模型HunyuanVideo-Foley

腾讯混元正式开源端到端视频音效生成模型 HunyuanVideo-Foley,适用于多场景。它采用新型框架结合 REPA 策略,有三大核心优势,能适配多种场景,抑制底噪,保证音频保真度。

带你学AI