
GPT Image 2 的七种歌声舞台:萌音莜奈插画图集
用 GPT Image 2 为哔哩哔哩虚拟日语歌势主播萌音莜奈生成的一组插画记录:从蓝色舞台、粉色戏剧到黑白留白,看看同一个角色如何在不同视觉情绪里变成不同的歌。
今天想记录一组用 GPT Image 2 生成的萌音莜奈插画。
萌音莜奈是我这组图里想象的哔哩哔哩虚拟日语歌势主播。与其说是在做一张“标准立绘”,不如说是在尝试给同一个角色搭建七个不同的舞台:她可以站在蓝色的演出灯光里,也可以进入偏粉红和深红的戏剧场,还可以被放进黑白灰的安静画面中。角色没有被固定在一种表情或一种姿势里,而是在不同画面气质之间切换。
先从最直观的颜色说起
这组图最明显的共同点,是色彩承担了“声音”的作用。
17 号图几乎完全由深蓝、蓝色和青色组成,整体像一块横向展开的舞台屏幕。蓝色给人的感觉比较冷静、清澈,也有一点电子设备和直播间的质感;青色的高光像是舞台灯或屏幕上的反射,把画面从单纯的深色背景里提了出来。这张图适合被理解成演出开始前,灯光已经亮起、歌声即将进入第一句的瞬间。
18 号图延续了蓝色基调,但构图更接近竖幅海报。画面里加入了少量紫、粉、红色的点缀,像是在冷色舞台上藏了一些情绪变化。它不再只是“蓝色的主播”,而是让蓝色成为背景,把人物和局部高光推到画面中心,整体更像一张可以直接用作封面或节目视觉的主视觉图。
到了 19 号图,色温突然转向粉红、红色和暗红。它的情绪也因此变得更浓,更像一段带有戏剧冲突的歌曲:甜美不是单纯的可爱,而是带着一点强烈、夸张和舞台化的表演感。粉色铺开了大面积的情绪,黑色和暗红则把画面压住,让这张图拥有比前两张更强的戏剧重量。
黑白灰不是“没有颜色”,而是另一种歌
20、21、22、23 号图逐渐进入黑白灰的区域。它们的颜色被压低之后,画面的重点从“她是什么颜色的角色”转移到了“她正在怎样存在”。
20 号图使用了大量灰、白和黑,整体像一幅粗粝的舞台速写。灰色区域带来颗粒感和现场感,黑色让人物或结构从背景里凸显出来,白色则像曝光过度的灯光。相比蓝色组的电子感,这张更像演唱会结束之后留下的记忆片段:灯还在,声音却已经远了。
21 号图的横向构图更加开阔,白色和灰色的比例很高,粉色与紫色只在局部留下痕迹。它的气质更轻,像是舞台灯光穿过烟雾之后的瞬间。画面不靠强烈的颜色吸引视线,而是用明暗关系把视线引向中心,给人一种“正在看一张演出现场截图”的感觉。
22 号图则拥有更明显的纵向延展感。灰色和白色构成了大面积的空间,青色的冷光让这张图不像传统黑白插画那样完全静止,反而保留了一点数字屏幕和未来感。这里的萌音莜奈更像是被放在一个很大的舞台环境里,人物并不需要把画面填满,留白本身就是氛围的一部分。
23 号图的留白最多,也最克制。白色几乎占据整个画面,灰色和黑色集中在中下部,粉红色只留下非常少的痕迹。它像一首歌的尾奏:没有强烈的动作,也没有密集的舞台装饰,只有人物、光线和逐渐安静下来的空间。七张图放在一起看,23 号像是这组视觉实验最后的停顿。
同一个角色,为什么能拥有这么多种气质?
我觉得关键不在于给她不断更换衣服,而在于保持一些稳定的识别线索,再改变舞台、光线和构图。
这组图始终围绕“虚拟日语歌势主播”这个核心展开。她不是普通的静态二次元角色,而是一个应该被想象成会唱歌、会直播、会和观众交流的人。蓝色画面强调她的电子舞台属性,粉红和深红画面放大她的表演性,黑白灰画面则让她更接近一段被保存下来的演出记忆。
从横向宽画幅到竖向海报,从高饱和蓝色到几乎无彩的留白,这些变化让角色从“人物设定”变成了“演出现场”。如果只看一张,可能会把它当成一张普通的 AI 插画;但把七张放在一起,它们更像是同一首歌的七个视觉段落:前奏、进入、高潮、转场、回望、余韵和结束。
这次生成里我最喜欢的部分
我最喜欢的不是某一张图是否“完美”,而是 GPT Image 2 把同一个创作方向扩展出了不同的视觉语言。
17、18 号适合代表“舞台上的萌音莜奈”,蓝色和青色让她有一种清爽的虚拟演出感;19 号则更像“被聚光灯推到最前面的萌音莜奈”,粉红、红色和暗部让她的表演感明显增强;20 到 23 号开始从角色展示转向氛围表达,尤其是最后两张,人物不再需要依靠高饱和色彩证明自己的存在。
这也是我觉得 AI 图像生成有意思的地方:它不只是把一句描述变成一张图片,还可以帮我测试一个角色在不同情绪和媒介感里的边界。当然,生成结果并不等于最终设定,画面里仍然会有需要继续调整的细节。但作为一次视觉方向探索,这七张图已经让我看到了萌音莜奈更多可能性。
最后把这组图留在这里。她可以是蓝色舞台上的歌手,也可以是粉红色戏剧里的主角,还可以只是站在一片白色和灰色之间,安静地唱完最后一句。
图集:使用 GPT Image 2 生成的萌音莜奈插画,按生成文件编号整理。