「信息图生成」共找到 2941 篇相关文章
我手搓了一个Seedance 2.0分镜Skill:一键生成电影级Prompt,再也不用为提示词发愁了
作者为解决用Seedance 2.0写分镜提示词难题,手搓Seedance Storyboard Skill。它能引导用户完成分镜细节,输出专业提示词。作者实测4种风格案例效果佳,还介绍了Skill原理、安装使用方法。
老黄在CES 2026 上预言:将要告别应用软件的预编译时代,未来的应用是 GPU 上实时生成每一个像素
黄仁勋在CES 2026预言,应用将告别预编译时代,在GPU上实时生成像素。他回顾2025年AI关键进展,介绍Agentic AI特点与能力,还谈了其搭建及应用前景,指出未来软件或基于Agent交互。
AI在实时视频里秒“剪”出你想要的部分!输入文字/图/视频片段,它都能秒懂|ICCV2025
最新混合模态在线视频定位技术OVG - HQ开挂了!它能根据文字、图、视频片段等线索,在实时视频流中精准裁剪出关心的事件,已收录于ICCV2025,破局以往技术“离线”“词穷”缺陷。
镜头被油污糊住,机器人还稳定操作?北大/清华等给VLA加一道信息筛选,不靠额外数据,效率提升14x,真机鲁棒性反而更高了 | ICML 2026
北大、清华等机构联合提出StableVLA,相关工作被ICML 2026接收。该工作提出轻量级IB - Adapter,不依赖额外数据对视觉特征筛选对齐,让机器人遇视觉干扰仍能稳定执行任务,实验展现出鲁棒性提升。
Claude Managed Agents 公测发布!Agent 开发成本直降 500 倍
Claude 宣布 Managed Agents 进入公测,可大幅降低 Agent 开发成本。它能自动生成配置和代码,接管多项任务,实现长时间自主运行。多家早期客户使用后效果显著,还介绍了定价、接入方式及与自建的差异。
上下文工程(Context Engineering)综述:大模型的下一个前沿
文章提出“上下文工程”学科,通过整合1400余篇论文构建“基础组件 - 系统实现”框架。它将上下文定义为动态结构化信息集合,揭示LLMs理解强于生成的矛盾,为AI研究指明方向。
AI 创作继续:Google 推出Pomelli,一款能读懂你网站气质的 AI 营销设计师
Google Labs推出AI营销工具Pomelli,可帮中小企业几分钟内创建符合品牌的社交媒体活动。流程为给其网站,它建立品牌“商业DNA”,生成活动创意和资产,用户编辑调整即可。输出仅支持英文,出海网站可尝试。
谷歌偷偷上线免费Cursor,程序员饭碗又摔碎了!
Google AI Studio增加build按钮,相当于免费的cursor。能用一句话、图或文件生成完整AI应用并一键部署。可通过对话修改应用,分享应用消耗他人免费配额,利于推广Gemini生态。
我有听书障碍,但被这个 AI 电台拿捏了
作者曾有听书障碍,却被 Huxe 这款 AI 音频 App 吸引。它由 Google 团队打造,能将邮件摘要、新闻等生成“私人电台”。有个性化简报、自定义音频内容等功能,集成 ASR、NLP 和 TTS 模块。
CVPR2025|MCA-Ctrl:多方协同注意力控制助力AIGC时代图像精准定制化
中国科学院计算技术研究所团队提出无需微调的通用图像定制方法 MCA - Ctrl,利用扩散模型内部知识,结合条件语义与主体内容。实验显示其在编辑和生成任务表现优,解决了现有技术瓶颈。