「开源实现」共找到 4661 篇相关文章
最强开源机器人大脑!蚂蚁两万小时真机数据开启物理AI缩放定律
蚂蚁集团开源具身智能基座模型LingBot-VLA,用两万小时真机数据证明机器人学习有缩放定律且未达瓶颈。该模型优势显著,在多平台表现出色,团队还从数据、架构、工程等方面进行优化,并开源代码等加速行业探索。
华为开源突破性技术Flex:ai,AI算力效率直升30%,GPU、NPU一起用
11月21日,华为发布AI容器技术Flex:ai并联合高校将其开源。该技术基于Kubernetes构建,有三大核心突破,能提升算力利用率,异构兼容性优于Run:ai,将推动国产算力应用。
制造企业如何实现 AI 产品经理“能力复制”?|极客时间 AI 人才培养实践
在数智化转型中,企业开展AI培训却难转化业务价值。极客时间与制造企业合作,用“线上+线下+实战”的OMO训练营,实现AI产品经理“能力复制”,成果获认可,模式可复制。
自回归模型杀回图像生成!实现像素级精准控制,比Diffusion更高效可控
当下AI图像生成领域,Diffusion模型虽为主流,但在精准控制上有不足。伊利诺伊大学香槟分校等机构研究者提出MENTOR框架,用自回归模型实现像素级精准控制,比Diffusion更高效可控。
小红书最新开源TTS力作!4人对话自然无缝,毫秒极速响应!
近年来TTS技术爆发,但多人对话的自然流畅性和长序列稳定性一直是难点。小红书团队开源的FireRedTTS - 2是面向多人对话场景的TTS模型,实现自然切换和低延迟,支持多语言,适用于多种场景。
腾讯AI Lab开源可复现的深度研究智能体,最大限度降低外部依赖
腾讯AI Lab推出全开源智能体框架Cognitive Kernel - Pro,解决现有开源框架依赖付费工具问题。它有模块化架构等核心设计,创新训练方法,在多任务中表现出色,降低外部依赖,相关论文登HuggingFace热榜。
炸裂开源项目,程序员 + 学生福音:一键把 Markdown / LaTeX 公式「完美粘贴」到 Word/WPS
PasteMD是开源托盘小工具,从剪贴板读取内容,调用Pandoc转成DOCX或表格,自动插入到Word/WPS/Excel光标位置,解决AI对话、网页复制内容粘贴到Office格式错乱问题。
14.9g颠覆行业,AI眼镜终于实现无感日常佩戴|甲子光年
在AI硬件浪潮中,AI眼镜被视为有潜力替代手机的形态。心眸科技发布的AI眼镜Moonix,重14.9克,回归眼镜本质,以“记录”为核心,具备主动式AI能力,能实现“记录 - 理解 - 分享”闭环。
数字人视频革命!MultiTalk开源:15秒多人对话一键生成,歌唱/卡通全驾驭!
在AI驱动的视频生成领域,创建多人对话场景是难题。MultiTalk是开源音频驱动多人对话视频生成框架,由MeiGen - AI等联合研发,输入多路音频等就能生成嘴型同步的视频,适用于多种场景。
Vercel 开源 json-render!短短 4 天狂揽 7500 Star,这才是 AI 生成 UI 的终极解法!
Vercel 开源的 json - render 4 天获 7500 Star,解决生成式 UI 不可控问题。采用‘AI → JSON → UI’公式,结合‘约束’与‘流式’机制,还有反向生成源码功能,介绍了快速入手办法与适用场景。