创意丝滑出海,亚马逊云科技AI技术轻松搞定分镜设计!上篇
分镜设计艺术堪称现代内容创作的基石,在电影制作、动画、广告创作以及用户体验设计等领域,均发挥着关键作用。
以往,创作者通常依靠手绘连续式插图来创作分镜。如今,诸如Amazon Nova Canvas、Amazon Nova Reel等AI基础模型,能够将文本和图像输入转化为专业级视觉素材和短视频片段,有望彻底创新前期制作流程。


然而,这一技术进步也带来一系列挑战:尽管这些模型擅长快速生成丰富多样的创意概念,有助于创作者探索更多创意想法,但要在不同场景中保持角色的一致性和风格的连贯性,仍具有很大难度。即便是细微调整提示词或模型配置,都可能会生成截然不同的视觉成果,这不仅可能破坏叙事的连贯性,还会为内容创作者增添额外的工作负担。
为应对上述挑战,特推出本系列文章,分上下两篇探索实现视觉一致性的实用解决方案。
本文将深入探讨提示词工程与角色开发流程,并分享已经过验证的、能够在Amazon Nova Canvas和Amazon Nova Reel上生成可靠且具有一致性效果的提示词模式。
下篇将探索微调Amazon Nova Canvas等技术,实现卓越的视觉一致性和精准的角色控制,敬请期待!



借助Amazon Nova Canvas
实现一致的角色设计
有效的分镜设计,基础在于制定清晰明确的角色设计方案。Amazon Nova Canvas提供了多种强大技术,可帮助您在整个视觉叙事过程中创建并保持角色的一致性。
您可参阅GitHub代码库中提供的完整代码示例及相关资源,跟随详细步骤指导同步进行操作,了解如何在自身项目中应用这些技术。
若您是Amazon Nova Canvas新用户,建议先阅读《使用Amazon Nova生成图像指南》,熟悉基本概念。
GitHub代码库:
https://github.com/aws-samples/sample-character-consistent-storyboard/tree/main/01-character-consistent-storyboarding-with-amazon-nova
《使用Amazon Nova生成图像指南》
https://docs.aws.amazon.com/nova/latest/userguide/image-generation.html
基础文本提示词
与大语言模型(LLM)不同,Amazon Nova Canvas等图像生成模型不会解读指令或进行逻辑推理,而是对描述性文字的响应效果最佳,能够将文本描述直接转化为视觉图像。
在提示词中加入细节信息,例如角色的外貌特征、服饰搭配及风格元素等,都会直接影响最终生成的图像效果。
例如:一位7岁的秘鲁女孩身着校服,深色头发梳成双麻花辫垂在胸前。
这一描述向模型提供了清晰的视觉元素,可供其生成初始的角色概念,具体效果如下图所示。

视觉风格应用
要实现分镜设计的一致性,不仅需要角色特征保持统一,而且视觉风格也要协调统一。为此,可在提示词中将风格信息拆分为两大关键要素。
-
风格描述:用于定义视觉媒介的开篇短语,例如:一幅绘本风格的插画,描绘了......
-
风格细节:用于明确艺术元素的结尾短语,例如:线条粗重、阴影浓重、色彩为平涂色调。
这种结构化方法有助于创作者探索绘本、素描、3D插画等多种艺术风格,同时能在整个分镜中始终保持角色的一致性。
以下是一个示例提示词模板,以及一些可供您尝试的风格信息。
{style_description} A 7 year old peruvian girl with dark hair in two low braids wearing aschool uniform. {style_details}styles = [{"name": "graphic-novel","description": "A graphic novel style illustation of","details": "Bold linework, dramatic shadows, and flat color palettes. Usehigh contrast lighting and cinematic composition typical of comic bookpanels. Include expressive line work to convey emotion and movement.",},{"name": "sketch","description": "A simple black and white line sketch of","details": "Rough, sketch-like lines create a storyboard aesthetic. Highcontrast. No color",},{"name": "digital-illustration","description": "A 3D digital drawing of","details": "High contrast. Rounded character design. Smooth rendering.Soft texture. Luminous lighting",},]
左右滑动查看完整示意

通过seed值实现角色变化
seed参数是一种在遵循相同提示词的前提下,可生成不同角色的工具:创作者无需从零开始创作,只需保持同样的文本描述,仅调整seed值,就能探索角色设计的多种呈现形式。具体效果如下图所示。


通过cfgScale参数
控制提示词遵循程度
cfgScale参数是另一个维持角色一致性的工具,能够控制Amazon Nova Canvas对提示词的遵循程度。该参数的取值范围为1.1至10,数值越低,模型拥有的创作自由度越高;数值越高,则会强制模型更严格地遵循提示词。
默认值6.5通常能实现最佳平衡,但合适的参数设置至关重要,如下图所示:数值过低可能导致角色呈现不一致,而数值过高则可能过度强调提示词中的元素,进而牺牲画面构图的自然感。


通过一致参数实现场景融合
现在可整合上述技术,测试角色在不同叙事场景下的一致性,具体效果如下图所示。保持风格、seed与cfgScale参数的输入一致,仅调整场景描述,以确保角色在整个场景序列中始终具有辨识度。

一幅绘本风格的插画:一位7岁的秘鲁女孩,深色头发梳成两条低马尾辫,身着校服,正在山间小路上骑自行车。画面采用粗重的线条、浓重的阴影与平涂色调,运用高对比度光线及漫画分镜特有的电影感构图,同时通过富有表现力的线条传递情绪与动态感。

一幅绘本风格的插画:一位7岁的秘鲁女孩,深色头发梳成两条低马尾辫,身着校服,正行走在安第斯山脉高草丛生的小路上。画面采用粗重的线条、浓重的阴影与平涂色调,运用高对比度光线及漫画分镜特有的电影感构图,同时通过富有表现力的线条传递情绪与动态感。

一幅绘本风格的插画:一位7岁的秘鲁女孩,深色头发梳成两条低马尾辫,身着校服,正在海滩上吃冰淇淋。画面采用粗重的线条、浓重的阴影与平涂色调,运用高对比度光线及漫画分镜特有的电影感构图,同时通过富有表现力的线条传递情绪与动态感。
分镜设计开发流程
基于此前探讨的角色一致性技术,现可搭建一套端到端的分镜设计开发流程,能将文字形式的场景描述与角色描述,转化为视觉连贯的分镜作品。
这种系统化方法会沿用既定的风格描述、seed值及cfgScale参数,适配不同叙事场景,同时确保角色的一致性。
场景与角色描述示例如下。
"scenes":[{"description": "Mayu stands at the edge of a mountainous path, clutchinga book. Her mother, Maya, kneels beside her, offering words of encouragementand handing her the book. Mayu looks nervous but determined as she preparesto start her journey."},{"description": "Mayu encounters a 'danger' sign with a drawing of asnake. She looks scared, but then remembers her mother's words. She takes adeep breath, looks at her book for reassurance, and then searches for a stickon the ground."},{"description": "Mayu bravely makes her way through tall grass, swingingher stick and making noise to scare off potential snakes. Her face shows amix of fear and courage as she pushes forward on her journey."}],"characters":{"Mayu": "A 7-year-old Peruvian girl with dark hair in two low braids wearing aschool uniform","Maya": "An older Peruvian woman with long dark hair tied back in a bun, wearingtraditional Peruvian clothing"}
左右滑动查看完整示意

首先使用Amazon Nova Lite,依据既定的最佳实践,生成优化后的图像提示词,随后将提示词传递给Amazon Nova Canvas生成图像。
通过调高numberOfImages参数值(通常为3个版本),同时保持seed值和cfgScale参数值一致,本方案为创作者提供了多个能保持角色一致性的选项。
使用以下提示词,利用Amazon Nova Lite生成优化后的图像提示词。
Describe an image that best represents the scene described. Here are some examples:scene: Rosa is in the kitchen, rummaging through the pantry, looking for a snack. Shehears a strange noise coming from the back of the pantry and becomes startled.imagery: A dimly lit pantry with shelves stocked with various food items, and Rosapeering inside, her face expressing curiosity and a hint of fear.scene: Rosa says goodbye to her mother, Maya. Maya offers her words of encouragement.imagery: A wide shot of Rosa's determined face, facing Maya and receiving a small wrappedgift.Only describe the imagery. Use no more than 60 words.scene: {scene_description}imagery:
左右滑动查看完整示意
随后生成以下分镜画面。

Mayu站在山间小路,手里怀抱一本书。她的妈妈Maya蹲在她身旁,一边说着鼓励的话,一边把书递给她。Mayu面露紧张,眼神中却又透着坚定,正准备踏上旅程。

Mayu遇到了一块画有蛇的“危险”警示牌。她面露惊恐,但很快想起了妈妈说的话,深吸一口气,看了看手里的书给自己打气,然后寻找一根木棍防身。

Mayu在草丛中穿行,挥舞手中的木棍发出声响,吓跑可能潜伏的蛇。她继续前行,脸上交织着恐惧与勇敢两种神情。
尽管这些技术显著提升了角色一致性,但并非完美无缺,仔细观察便会发现,即便是同一场景内的图像,角色一致性也存在差异。
使用一致的seed值有助于控制差异,而且与基础的提示词工程相比,本文所介绍的技术已大幅提升了角色的一致性。若您的使用场景要求近乎完美的角色一致性,敬请关注本系列下篇文章介绍的高级微调技术。
用分镜生成动画视频
如果您想突破静态场景图像的限制,将分镜转化为简短的动画视频片段,则可使用Amazon Nova Reel。
通过Amazon Nova Lite将图像提示词转换为视频提示词,同时添加适用于Amazon Nova Reel模型的细微动作与镜头运动效果,这些提示词会与原始图像一同作为创作约束条件,供Amazon Nova Reel生成最终的动画序列。
以下是示例提示词,及其生成的GIF格式动画场景。
A sunlit forest path with a 'Danger' sign featuring a snake. A 7-year-old Peruvian girlstands, visibly scared but resolute. Bold linework, dramatic shadows, and flat colorpalettes. High contrast lighting and cinematic composition. Mist slowly drifting.Camera dolly in.
左右滑动查看完整示意

输入图像

输出动画
总结
本文介绍了借助Amazon Nova Canvas,实现角色与风格一致性的基础技术,涵盖结构化提示词工程、搭建端到端的分镜设计流程。同时探讨了如何结合风格描述、seed值以及精准控制cfgScale参数,显著提升角色在不同场景中的一致性。
此外,文章还展示了如何整合Amazon Nova Lite与Amazon Nova Reel,优化分镜设计工作流,实现高效的提示词生成与动画序列制作。
尽管这些技术为生成具有一致性的分镜角色提供了可靠支撑,但其并非完美无瑕,仍有可能出现细微差异。因此,诚挚邀请您关注即将推出的本系列下篇内容,届时将探讨如何利用高级模型微调技术,达成近乎完美的角色一致性与视觉逼真效果。
我们正处在Agentic AI爆发前夜。企业要从"成本优化"转向"创新驱动",通过完善的数据战略和AI云服务,把握全球化机遇。亚马逊将投入1000亿美元在AI算力、云基础设施等领域,通过领先的技术实力和帮助“中国企业出海“和”服务中国客户创新“的丰富经验,助力企业在AI时代突破。
更多推荐


所有评论(0)