「多场景隔离」共找到 5326 篇相关文章
图像、视频一模搞定!字节全能原生多模态本地可部署
字节开源原生多模态模型Lance,仅3B激活参数,40G显存就能跑,已登顶huggingface趋势榜。它能进行图像与视频的理解、生成、编辑等操作,在多个基准测试中表现优异,多项性能居首。
机械手成精了:能变形、能爬行、自己抓东西,全程无人操控
武汉大学高霄团队设计出可拆卸爬行机械手,能像普通机械手抓取物体,还能脱落爬行够取远处物品。其完成全套取物任务,未来有望用于工厂、救援、家庭等场景。
多模态开发革命!Gabber开源:图形化构建实时AI应用,效率提升10倍!
AI应用迈向多模态交互,传统开发方式周期长。开源项目Gabber是实时AI应用引擎,通过模块化与图形化简化开发,有诸多特性,还给出安装指南,适用于多种场景。
隐私堡垒!Presenton开源革命:本地AI生成PPT,敏感数据永不触网!
本周GitHub新开源项目Presenton可离线制作PPT,支持主流AI模型,本地运行保护数据隐私,有灵活自定义模板和API集成功能,还具备多模型支持、主题定制等特性。
安卓彻底变了!Gemini接管所有屏幕,苹果连影子都没追上
谷歌在 Android Show I/O Edition 宣布,Android 从「操作系统」转型为「智能系统」,Gemini Intelligence 植入安卓设备,覆盖多硬件,还推出 Googlebook。谷歌端侧铺 Gemini,云端投 Claude,与苹果策略形成对照,竞争关键在分发。
创新中心| AI视觉创意不再拼“出图快”,而是拼“人味浓”?
北京AIGC视听产业创新中心位于朝阳区,是推动影视制作基地建设的举措。由多方参与,首创郎园运营,提供六大服务平台,截至2025年8月汇聚60余家伙伴。首创郎园拓展能力,项目延伸多地。
any-llm:又一个统一模型服务接口的Python代理库
Mozilla AI开发的开源项目any-llm,解决多LLM提供商接口统一问题,能让开发者用一个接口调用不同大语言模型。它吸取此前产品长处,有统一接口等优势,使用和安装简单。
Vidu Q3:「参考生」之王,让视频生成走向工业化量产时代
Vidu Q3 上线「参考生」功能,解决 AI 视频生成结果不可控问题。其画面参考范围扩大,特效、音效提升显著,还优化特定场景,接入企业级能力,让 AI 视频从创意验证走向实际生产。
25个实战案例告诉你:原来 Blender + Seedance 才是AI视频创作的终极组合!
文章介绍开源仓库Awesome-Blender-Seedance-Workflow-Usecases,汇集25个Blender与Seedance结合的实战案例。阐述两者组合原理及优势,展示多类案例亮点,还给出快速上手指南,体现人机协作创作新理念。
JSON 瑞士军刀,效率直接起飞!
现在很多接口、日志、配置文件用JSON,数据结构复杂时处理麻烦。`jq`是专门处理JSON的工具,支持格式化、过滤、提取等操作,语法简单,在多场景常见,安装方便。