多任务架构」共找到 6451 篇相关文章

算法论文8

视频生成不再「断片」:OneStory给模型装上「选择性记忆」,跨镜头讲故事人物场景始终如一丨CVPR'26

镜头视频生成挑战大,现有方法有局限。Meta与哥本哈根大学研究者提出OneStory,为镜头视频生成建立跨镜头记忆机制,可生成连贯长视频,在复杂叙事中保持一致。

量子位
产品应用8

AI视频生成平台

酷模Cumob AI是基于Next.js构建的AI内容生成平台,集成AI服务提供商API,有漫画生成等工作流,具备并发处理、资源管理等优化,支持种部署,有诸功能特性与亮点。

GitHubStore
开源动态8

Paper2Page: 让每一篇论文都能“自己长出”一个项目主页

AI领域论文众,研究者难让工作脱颖而出,精美项目主页很重要但制作繁琐。AutoPage是智能体协作框架,能将论文一键转为项目主页,经三步协作,在速度、成本、质量等方面表现出色,代码已开源。

深度学习自然语言处理
推荐文章8

直播预约 | Evaluation论文分享@ICML&ACL2025

2025年6月11日20:00将直播分享Evaluation论文。位嘉宾参与,涉及SyncPL奖励建模、文本事实一致性验证、大模型评测方法等领域论文,涵盖模型优化、基准测试等内容。

深度学习自然语言处理
算法论文8

科研数据不再碎片化!一张可计算图,连起整个科研世界

UIUC研究团队打造ResearchArcade,将ArXiv论文、OpenReview评审等碎片数据连接成动态知识图谱。它有源、模态等特征,支持种格式数据导入导出,定义了六个任务,验证了图结构在科研数据处理中的作用。

新智元
推荐文章7

扩散语言模型深度思考

作者探讨扩散语言模型(dllm),认为其建模方式或冲击AR。团队在AAAI报告介绍项工作,还整理当前diffusion问题及观点,如推理架构、词表、优化范式等,并附项目网站和agent demo。

机器之心
开源动态8

GitHub热搜,腾讯黑科技炸场!PhotoMaker:10秒定制真人级头像,百万开发者已疯狂

PhotoMaker是腾讯ARC实验室联合南开大学发布的人像图像生成项目,荣膺CVPR 2024。它能秒级生成高质量人像,有高保真ID嵌入等机制,V2版升级显著,适用场景,比同类项目优势明显。

小华同学ai
算法论文8

ICLR 2026 Oral|中科院团队提出新框架「SparseRL」,深度强化学习可自动生成高性能CUDA代码

中科院计算所团队提出 SparseRL 框架,将深度强化学习引入稀疏 CUDA 代码生成任务。实验显示,在 SpMV 任务上编译成功率提升 20%,执行速度提升 30%。该成果已入选 ICLR 2026 Oral。

机器之心
算法论文8

DeepSeek押注的Harness,被这篇最新综述彻底讲透了

这篇综述讲透了Agent Harness Engineering,CMU等联合提出ETCLOVG七层架构,证明Harness Engineering是LLM Agent工业落地主战场,介绍了其发展阶段、各层架构及作用等。

PaperAgent
开源动态8

创智刘鹏飞、Sand.ai曹越,两大AI青年学者团队联手,开源音视频基座模型

开源模态生成领域获架构级底层突破。上海创智学院与 Sand.ai 联合研发的 daVinci - MagiHuman 正式开源,打破开源界音视频联合同步生成三重局限。它采用单流 Transformer 架构,能力强、推理效率高。

机器之心