
字节笔记本
2026年10月9日 · 约 3 分钟读完
先摆分镜再生成,这个开源工作室不靠提示词碰运气
提示词框对得起概念图,对不齐分镜。ArtCraft 把自己写成给艺术家用的 IDE:先在画布上摆位置、搭景、摆姿势,再挑生成模型出图或出视频。仓库 storytold/artcraft 用 Rust 写后端,GitHub 约 9200 星、1360 个 fork,主页 getartcraft.com。官网一句话是 The open-source studio for controllable AI image and video,平台覆盖 macOS、Windows 和 Web,宣称免费起步、没有订阅门槛。
它和站内常见的 coding agent 不是一类东西。GitHub 日榜今天仍有两千多星增量,热度来自「可控生成」而不是又一个对话框。

先摆场景,再按生成
README 把流程从「写一段话碰运气」拧成可视化编排。Image to Location 把照片变成能反复用的场地,方便多镜头对齐。3D 合成给图层真实深度,2D 合成保留手绘和抠图。图片可以变成网格去卡位,角色用人体模型摆姿势、调机位,再把素材包拼成场面。文生图、蒙版改图、静帧转动画都还在,只是被放进这套场面语言后面。

模型目录官方写成 62 项:图像 16 家(含 Nano Banana、GPT Image、FLUX、Seedream),视频 25 家(Seedance、Kling、Veo、Sora、Vidu、MiniMax、Flux),音频 5 家,网格 11 家,世界/splat 5 家。部分条目标注停用或受限。生成仍走各家接口,ArtCraft 管的是场面和可重复的合成,不是自己再训一套大模型。

怎么拿到手
官网提供 Windows 和 macOS 稳定包,也可以拉 GitHub 最新构建。Linux 走源码编译,仓库带开发文档。LICENSE.md 在仓库里,API 返回的 license 字段是 Other,正文不宜写成 MIT 或 Apache。本机编译适合要改引擎的人;只想摆场景出片,装官方包就够。
适合谁
适合已经在用多家图像和视频模型、却苦于镜头对不齐的人:短片分镜、角色设定、需要同一场地多机位的内容。不适合只想一句话出一张海报的人,那条路径更短。它也不替代剪辑时间线,导出之后还是要进你原来的后期。
和纯提示词工具比,ArtCraft 把「位置」做成一等操作。和传统三维软件比,它把生成模型接进同一块画布,而不是先在 DCC 里建完再导出。日榜还在涨,产品仍在补预览和打光一类能力。如果你最近的烦是「同一角色换个角度就不像了」,这个工作室比再调一百次提示词更对症。



