「布局控制生成」共找到 2892 篇相关文章
不想买几百刀的 ChatGPT Pulse?这款开源替代 + 本地部署可以白嫖试试
MineContext是开源跨平台桌面应用,可把电脑操作变成“上下文记忆库”。它能自动收集信息、生成总结和待办等。有自动截屏、生成总结等功能,使用体验好,适合常忘工作内容的信息工作者。
突破具身智能“专家困境”!北大新方法让宇树G1靠单一框架掌握跳舞和侧手翻
北京大学与BeingBeyond团队联合研发的BumbleBee系统,用创新的‘分治 - 精炼 - 融合’三级架构,实现人形机器人在多样化动作中的稳定控制,破解传统控制策略的‘专家困境’与‘现实鸿沟’。
8岁小孩哥「聊出」操作系统,一部手机、几句话,原生App直接生成
8岁小孩扑满借助秒哒做出「操作系统」雏形,百度2026 Create大会上秒哒3.0迎重要升级,从移动端、原生App、企业版、Agent能力四个维度重构,降低开发门槛,提升能力至生产级。
无需训练的3D生成加速新思路:西湖大学提出Fast3Dcache
在AIGC浪潮中,3D生成模型虽进化快,但‘慢’和计算量大制约其应用。西湖大学AGI实验室提出无需训练、即插即用的Fast3Dcache框架,能在加速同时保持或提升模型几何质量。
告别直接生成,文生图进入Agent时代:港中文联合伯克利开源Gen-Searcher
过去文生图多是‘直接出图’,遇真实世界知识等易翻车。港中文等团队提出Gen - Searcher,让图像生成模型像Agent一样搜索等,数据、模型和代码均已开源,实验显示它提升了生图准确性和质量。
生成式推理再排序,可能会是LLM4RecSys的新突破口吗?
Meta AI研究者尝试把推理模型引入推荐系统再排序阶段。论文通过监督微调等赋予模型推理能力,超LLM4Recsys标杆。中期内化物品语意ID,生成推理路径,推理赋能再排序,披露重排序提升空间。
快手高欢深度解读:多模态理解如何成为AIGC视频生成的“幕后功臣”?
2024 年 AIGC 爆发,多模态理解技术支撑 AIGC 原生应用。快手高欢在 AICon 大会分享多模态理解在 AIGC 场景应用,介绍主流 AIGC 产品形态,探讨其背后多模态理解方法、提升能力途径及赋能 AIGC 的方向。
CVPR 2026|AI开始会拍电影了:一分钟十镜头,全程不崩剧情
多镜头视频生成要求模型处理不同镜头间稳定信息和变化信息,现有方法有局限。Meta与哥本哈根大学研究者提出OneStory,建立跨镜头记忆机制,设计关键模块,实验表现好,为视频生成打开新可能。
自动生成n8n工作流!这个神级开源方案,绝了~
文章分享全自动构建n8n工作流的方案,核心是开源项目n8n - mcp,它是AI Agent的n8n外挂知识库,能让AI深度理解和使用n8n。文中介绍其安装、使用,还展示不同难度案例的生成效果。
DeepSeek急招Agent方向!一口气放17个岗位,重度Vibe Coding用户优先
DeepSeek一口气开放17个招聘岗位,核心聚焦Agent方向,覆盖算法研究、数据评测、基础设施等全链条。岗位要求显示其Agent布局从研究落地到能力建设,还追求数据闭环与技术栈全面布局。