「生成式过程监督」共找到 2594 篇相关文章
Light-X来了!全球首个「镜头×光照」双控4D视频生成框架,单目视频秒变电影级
新加坡南洋理工大学等科研机构联合推出Light - X,全球首个「镜头×光照」双控4D视频生成框架。它解耦相机与光照,在扩散模型中融合,还构建Light - Syn数据管线,实验显示其效果显著优于现有方法。
Kubernetes 被 AI 打回“半成品”!K8s 之父发出警告:代码生成越快,程序员越危险
Kubernetes联合创始人Brandon Burns表示,AI让Kubernetes回到‘未完成’状态,它得适应GPU调度等新需求。他还谈到AI对编程工作的影响,如代码审查成核心技能,未来编程语言或为AI设计。
开源2天狂揽3.3K Star!超火的隐形AI桌面助手,实时捕捉屏幕与音频,生成结构化知识!
GitHub爆火的隐形AI桌面助手Glass,开源2天Star超3.3K。它由Pickle团队开发,能捕捉屏幕和音频活动,转化为结构化信息。适合会议记录等场景,有屏幕活动捕捉等核心能力,提供不同系统安装方式。
《TAML》好文推荐 | 来自清华大学张宇飞团队最新研究成果 基于文本生成翼型:FoilCLIP,一种语言驱动的气动设计新框架
传统翼型设计依赖CFD和风洞试验,成本高。清华大学张宇飞团队提出端到端双向映射框架FoilCLIP,通过对比学习建立文本与翼型几何双向映射,还提出数据增强策略,验证了其在语言驱动设计中的应用潜力。
我手搓了一个Seedance 2.0分镜Skill:一键生成电影级Prompt,再也不用为提示词发愁了
作者为解决用Seedance 2.0写分镜提示词难题,手搓Seedance Storyboard Skill。它能引导用户完成分镜细节,输出专业提示词。作者实测4种风格案例效果佳,还介绍了Skill原理、安装使用方法。
老黄在CES 2026 上预言:将要告别应用软件的预编译时代,未来的应用是 GPU 上实时生成每一个像素
黄仁勋在CES 2026预言,应用将告别预编译时代,在GPU上实时生成像素。他回顾2025年AI关键进展,介绍Agentic AI特点与能力,还谈了其搭建及应用前景,指出未来软件或基于Agent交互。
科学进步实际上很大程度依赖于实打实的实验结果,而不仅仅是理论智力|AI 自我提升不会突然“起飞”,而是逐渐加速的过程
如今未实现AI自我提升,一旦实现将是重大突破。但它不会突然飞跃,而是缓慢持续的过程。不同领域提升难度有别,科学进步受现实实验速度限制,AI自我提升更可能是缓慢加速进程。
刚刚微软开源视频录制技能skill-recorder
微软开源视频录制技能 Skill Recorder,能将用户完成任务的过程转化为 AI 智能体可重复执行的技能。它捕获屏幕工作会话,用 GitHub Copilot CLI 重构操作,生成可复用内容,支持多平台。
大模型幻觉检测新方法:实时高亮不确定内容
来自苏黎世联邦理工学院等机构团队,开发流式幻觉检测器,能在生成过程中即时标记幻觉实体。核心是识别具体“实体”是否虚构,实验表现出色,团队已将数据集和代码开源,有局限但应用前景好。
AI 播客原理解析
作者分享用豆包AI播客将英文长文转成高质量播客的体验,解析AI把文章变真人对话式语音播客的原理,涉及提示词工程和文字转语音技术,还介绍提示词写作与优化过程及长文处理方法。