「复杂运动生成」共找到 3037 篇相关文章
《TAML》好文推荐 | 来自清华大学张宇飞团队最新研究成果 基于文本生成翼型:FoilCLIP,一种语言驱动的气动设计新框架
传统翼型设计依赖CFD和风洞试验,成本高。清华大学张宇飞团队提出端到端双向映射框架FoilCLIP,通过对比学习建立文本与翼型几何双向映射,还提出数据增强策略,验证了其在语言驱动设计中的应用潜力。
我手搓了一个Seedance 2.0分镜Skill:一键生成电影级Prompt,再也不用为提示词发愁了
作者为解决用Seedance 2.0写分镜提示词难题,手搓Seedance Storyboard Skill。它能引导用户完成分镜细节,输出专业提示词。作者实测4种风格案例效果佳,还介绍了Skill原理、安装使用方法。
老黄在CES 2026 上预言:将要告别应用软件的预编译时代,未来的应用是 GPU 上实时生成每一个像素
黄仁勋在CES 2026预言,应用将告别预编译时代,在GPU上实时生成像素。他回顾2025年AI关键进展,介绍Agentic AI特点与能力,还谈了其搭建及应用前景,指出未来软件或基于Agent交互。
美团开源LongCat-Image,6B参数挑战80B效果,中英双语理解、图像逼真度及复杂指令编辑新突破
美团开源6B参数图像模型LongCat-Image,在双语文本理解、图像逼真度及复杂指令编辑任务中表现出色。它以轻量化设计超越大模型,还解决中文文本渲染难题,有精确图像编辑能力,且提供全链路开源方案。
Anthropic发布多Agent协作模式指南:5种架构与适用场景
当单个AI Agent无法完成任务时,多Agent系统就派上了用场。Anthropic最新发布的指南给出了五种经过验证的模式,包括生成 - 验证模式、编排 - 子代理模式等,并介绍了适用场景和陷阱。
首款推理具身模型,谷歌DeepMind造!自主理解/规划/执行复杂任务,打破一机一训,还能互相0样本迁移技能
谷歌DeepMind发布新一代通用机器人基座模型Gemini Robotics 1.5系列,由GR 1.5和GR - ER 1.5组成,结合视觉、语言与动作,实现“规划 + 执行”闭环,还提出Motion Transfer机制,能跨机器人迁移技能。
Karpathy公开附议:AI Agent 的输出格式,正在从 Markdown 走向 HTML
随着 Agent 处理任务变复杂,Markdown 在长文档中可读性与排版局限凸显。HTML 能无损表达信息、支持双向交互,但生成耗时久、版本控制难。AI 研究者 Karpathy 附议,HTML 成探索方向。
【栏目对话和访谈】ClawdBot 创始人 Peter:AI 是杠杆,不是替代品;编程语言不重要了,重要的是我的工程思维
这是对 ClawdBot 创始人 Peter Steinberger 的访谈。他分享 ClawdBot 开发历程,认为 AI 是杠杆非替代品,编程语言不重要,工程思维才关键,还预测 80% App 会消失,批判复杂智能体编排系统。
99%的人都不知道:MCP 必须在 Claude Code 外面装
作者分享飞书MCP安装经验,指出MCP要在Claude Code外安装,介绍用Cursor生成安装命令、验证安装、删除服务等技巧,还整理《MCP安装指令文档》,复制粘贴就能用。
170次搜索+50次反思:用GLM-4.7盘点2025 Agent行业趋势,结果太震撼!
作者给智谱新开源的GLM - 4.7布置调研2025年Agent赛道企业的任务,结果令人震撼。该模型进化显著,能整理详细企业信息,还能生成高审美PPT。国内有不少特色AI落地企业。