「动态工具生成」共找到 4072 篇相关文章
多模态大模型理解物理工具吗?PhysToolBench提出了衡量多模态大模型对物理工具理解的基准
香港科技大学等团队提出 PhysToolBench,用于衡量多模态大模型对物理工具的理解。它将理解分为三个等级,测试 32 个模型,揭示了大模型在工具理解上的不足,也为未来发展指明方向。
下一代架构设计工具,说话就能画
next-ai-draw-io是开源项目,用自然语言描述就能让AI自动生成draw.io格式的图。有文字生成图表等核心功能,技术栈用Next.js + AI SDK + react-drawio,支持多提供商,还介绍了安装、部署方法。
能导出 PSD 的 AI 设计工具,出现了
国内 Seede AI 团队发布海外新产品,无需写咒语,填文案信息就能让 AI 搞定排版等。它生成可编辑源文件,适合有内容但不会设计的人,还支持多格式导出,不过不擅长创意生图。
实时交互式长视频生成
文章提出用于实时交互式长视频生成的帧级自回归框架 LongLive,解决了长视频生成在效率和质量方面的挑战,具备长视频生成、实时推理、高效微调等亮点,还给出安装、推理、训练等步骤。
OpenAI点赞转发的冠军项目,背后藏着一个国人3D生成团队
近日,iOS产品StoryWorld获OpenAI Codex Hackathon冠军,其核心3D资产生成用了DeemosTech的Hyper3D Rodin。从黑客松到英伟达工程场景,3D生成重稳定性等特性。Hyper3D团队技术强,发布编辑功能,推动3D生成走向可控。
我复刻了 Claude 刚发布的生成式 UI 交互!
Anthropic在Claude上线基于生成式UI的新交互,作者复刻该功能到Code Pilot。介绍其多种玩法,如数据分析、制作小工具等,还阐述实现过程与体验打磨细节,保证生成式UI视觉稳定。
高保真、多控制集成于「统一画布」,组合式图像生成新范式!
Canvas - to - Image是新型图像生成框架,将多种控制方式整合到统一画布,用户可直观操作生成高保真、多控制图像。它简化创作流程,解决了现有方法控制单一分散、交互性差的问题。
我做了个 Claude Code 对话共享工具,可以让别人半路接手你的工作。已开源
作者开发开源工具 cc-go-on,解决 Claude Code 等工具会话难共享问题。该工具可加密导出会话,支持接力对话,有五层安全防护,适配多工具,还待完善,邀开发者贡献。
X-Actor 惊艳登场!长时唇动+情感同步人像动画生成
字节提出 X - Actor,一个音频驱动自回归扩散框架,能通过一张静态参考图像和一段音频生成逼真、富有情感表达的人像动画视频。其核心是两阶段解耦生成流程,实现长时间唇形同步与情感音频一致性。
全国首部“AI生成内容合规”标准,现公开征集起草单位和个人
随着AIGC转向产业落地,监管对生成内容管控成趋势,AI生成内容风险也凸显。全国首个AI生成内容合规团体标准《人工智能生成内容合规管理指南》应运而生,现公开征集起草单位和个人。