「平台化」共找到 2017 篇相关文章
Labubu换装记!让视频换装变得如此简单!基于扩散Transformer的视频虚拟试衣新突破
今天介绍开源项目MagicTryOn,它是基于大规模视频扩散Transformer的视频虚拟试衣框架,能实现高质量视频换装。采用三项关键技术创新,支持图像、视频试衣及定制化方案,目前仍在积极开发。
吉卜力风「手游」爆火,可灵+Midjourney生成的!教程已出,支持复刻
吉卜力风格“手游”在Reddit和推特爆火,它由AI制作,创作者用可灵AI、Midjourney结合文字提示实现效果,公开教程支持复刻。还介绍了制作方法及提示词示例,可灵AI发展势头也很猛。
让机器人学会系统2慢思考,叠衣服倒咖啡等不在话下 | 上海交大&智元机器人
上海交通大学与智元机器人等团队推出Hume——融合系统2慢思考的双系统VLA模型。它结合深度推理与实时控制,在多种机器人平台实验中表现出色,平均成功率达91%,显著超越现有模型。
OpenAI久违发了篇「正经」论文:线性布局实现高效张量计算
OpenAI 近日发布研究论文,提出用于高效张量映射的统一代数框架 Linear Layouts,解决了 Triton 等深度学习编译器中长期存在的难题。该框架是使用二元线性代数的张量布局通用代数形式,评估显示其优化版 Triton 性能有提升。
谷歌突袭发布AI应用,无需Wi-Fi、手机就能跑大模型!网友实测两极分化
谷歌推出 Google AI Edge Gallery 应用,可让用户在 Android 设备离线运行 AI 模型。它有响应快、隐私性好等优点,但网友实测评价不一,还有人认为它落后于苹果 CoreML。
2025 Google I/O 大会开发者主旨演讲干货盘点
今年 Google I/O 大会开发者主旨演讲亮点多。展示在 Google 平台应用构建,利用 Google DeepMind 的 AI 模型创新。如 Google AI Studio 集成 Gemini 2.5 Pro,还有 Jules 等工具,以及多款新模型发布。
从亚太到欧美,阿里云瑶池数据库凭何成为中企出海的技术底气?
在中企出海迈向‘深水区’时,阿里云瑶池数据库成关注焦点。它涵盖多版块,能提供全链路生命周期服务。对话负责人薛菲可知,其满足出海数据库需求,在多场景表现出色,融入AI能力,获国际认证,为中企出海提供底气。
1/8成本比肩Claude 3.7,Mistral Medium 3来了
“欧洲OpenAI”Mistral AI发布多模态新模型Mistral Medium 3,主打编程和多模态理解,成本仅Claude 3.7的1/8,性能达其90%,API已上线,还推出企业聊天机器人服务,引发网友不同看法。
通用 Agent 向左,Agentic Browser 向右
作者五一深度体验了Fellou,认为它和Manus走不同路线,Manus专注做Agent,Fellou做基于浏览器的全新系统。还介绍了Fellou核心功能,也指出其上手门槛高、执行慢等不足,认为发展尚早,值得期待。
Meta全开源HumanCLAW:基础模型正进入具身智能的决策层
过去基础模型主要理解和描述物理世界,如今开始进入机器人控制栈。Meta等提出HumanCLAW,将高层行动与低层运动控制分开。评测显示当前模型在行动决策上存在不足,未来可从多方向推进研究。