【免费下载链接】waoowaoo首家工业级全流程 AI 影视生产平台。Industry-first professional AI Agent platform for controllable film video production. From shorts to live-action with Hollywood-standard workflows.项目地址https://gitcode.com/gh_mirrors/wa/waoowaoo点击查看免费下载导读本文基于 waoowaoo工业级全流程 AI 影视生产平台开源仓库中的 asset-development Skill 文档完整讲解该平台从精确源文本筛选可复用资产、完成稳定可见设计、产出最终图片 Prompt 与结构化生成批次的专业创作方法。它回答三个核心问题什么样的实体值得登记为资产、每种资产的稳定身份应该如何描述、最终批次 JSON 该如何填写才能被服务端媒体 Operation 逐字冻结执行。读完本文你将掌握角色/场景/道具三类资产的设计纪律、asset_generation_batch输出 Schema 的字段语义以及生成后评审检查点的落地方式。Skill 定位资产专业结果的唯一 Writer在 waoowaoo 的创作管线中asset-development资产范围与视觉设计是六个专业 Skill 之一。它对应assets创作域产出唯一专业结果asset_generation_batch资产生成批次并由主 AgentMain Agent作为唯一 writer 将该批次直接交给媒体 Operation 执行。从源码结构可以确认这条调用链Skill 定义注册在 src/lib/creative-skills/registry.ts版本为5.4.0摘要为从精确源文本筛选可复用资产完成稳定设计与最终图片提示词声明可复用资产类型与生成后评审检查点生成画幅由服务端资产策略决定Skill 通过skill://asset-development/SKILL.md这一 URI 被读取Skill 枚举与输出类型定义见 src/lib/creative-skills/types.ts在 src/lib/creative-skills/output-registry.ts 中asset_generation_batch被绑定到专业 Skillasset-development、保存文档 Schemaproject.asset_manifest、媒体 Operationcreate_image。这意味着资产范围与视觉设计不是一个孤立提示词而是与运行时 Schema、WorkspaceResource 类型注册、媒体执行入口强绑定的正式创作契约。资产筛选三门槛与 no_assets 决策必须同时通过三个门槛原文档明确规定一个实体要登记为可复用资产必须同时通过三个门槛真实呈现在画面中真实出现或承载可见动作跨镜头一致性其身份/空间结构需要跨镜头保持一致或被后续生成独立引用不可替代性不能被另一已选资产完整代表而不丢失关键视觉连续性。仅被看见本身不够。只在对白、旁白或背景设定中提及而没有画面呈现的实体不登记瞬时背景物、无身份群众、普通装饰和不影响连续性的偶发物也不登记。拆分的粒度纪律同一实体的机位、景别、构图、光线或短暂动作变化不能成为新资产只有独立且持久的视觉身份才拆分同一叙事地点中视觉结构明显不同、各自真实承载画面动作且后续需要独立参考的空间必须拆分例如山顶与坠落后的崖底仅转场一闪而过、没有动作落点或无需独立视觉连续性的空间不拆分。no_assets 也是合法决策当没有任何实体通过全部门槛时批次应使用decision: no_assets、空items并在overview中解释原因。不得为了让清单非空而虚构或升级多余资产也不得提交这份无任务清单。这一语义在运行时 Schema 中被强制约束见下文批次 Schema 的superRefine校验。对齐决策的触发条件主角级且风格空间大的视觉身份——换一种设计方向就会改变整部作品观感的核心角色、标志性生物、核心产品或核心形象——其设计方向属于可对齐决策在批次冻结前交由主 Agent 按其对齐契约处理配角、功能性资产以及方向已由源文本、用户输入或 Creative Direction 确定的资产不触发对齐。稳定创作身份canonicalName assetKind原文档强调canonicalName assetKind表达稳定创作身份。不得发明系统 ID、使用数组位置或新增含糊的other类型。实际媒体身份由输出 WorkspaceResource 路径与 resourceId 拥有。可复用视觉资产只有三种类型character、location、prop。不得发明 style-board、mood-board、visual-style、预览图或泛化参考图作为可复用资产类型——风格由 Creative Direction 的文本承载不由图片资产承载。这一约束在仓库中体现为资产类型注册表的严格枚举src/lib/assets/kinds/registry.ts 中仅注册了character、location、prop三个 kind且均属于visualfamily、支持多变体supportsMultipleVariants: true。此外资产是基础身份设计不是任意时刻的状态快照。剧情产生持续的新状态重伤、换装、剃发、损毁且后续生成需要独立引用时创建新版本或新资产表达新状态不改写原资产的既有解释。风格消费边界稳定描述与最终 Prompt 分离这是本 Skill 最重要的一条职责边界Creative Direction 非空时使用完整已采纳方向自行判断哪些政策影响资产筛选、身份设计和最终呈现。但stableDescription只记录资产自身可见且可复用的身份、外观、材质和结构画幅、版式、背景和生成要求只进入最终 Prompt 与批次参数不污染身份事实最终 Prompt 必须自行合并稳定设计、项目视觉风格和本 Skill 的资产图版式。提交阶段与服务端都不会追加、改写或补全创作指令——对应 src/lib/workspace-resource/generation-request.ts 中finalPromptSchema的描述Complete final provider-ready creative prompt. The server validates and freezes it verbatim.服务端校验并逐字冻结stableDescription使用与用户内容一致的语言中文内容写中文英文内容写英文角色稳定身份描述不混入艺术风格、滤镜、光影、背景或构图场景基础描述保存真实空间结构、材质与物理光源条件最终 Prompt 再合成项目风格与场景资产图格式视频使用跨媒体总体风格不应继承资产图专用灯光或材质处理用户或项目风格高于参考图画风参考图用于身份与结构不能覆盖明确指定的美术风格忽略原图偶然色调、光线、模糊、噪点和瑕疵。角色设计规范人类角色的可见信息清单原文档要求人类角色必须写明以下可见信息明确性别呈现和具体年龄感脸型、可见五官特征、眼睛形状与大小、眼睛颜色头发颜色、长度、发型与发质身高感、体态、肩宽、腰线和整体轮廓肤色、肤质和可见标记粗糙、光滑、雀斑、胎记、疤痕或纹身。肤色与发色、瞳色一样是跨镜头身份锚点用中性、具体的描述写清——不写就会被生成模型每次随机化服装写清款式、年代、材质、配色、结构和细节鞋子是完整人物设计的必要部分必须写款式、材质和颜色只添加能加强身份和复用性的可穿戴配饰眼镜、耳饰、项链、手表或戒指服装、发型、鞋履和配饰必须符合故事年代与社会背景。非人类角色动物、神话生物、非人形生物或明确的风格化形象不强套人类外貌模板。描述从角色名或物种名开始围绕形态、轮廓、表面、关键器官、服饰和核心辨识特征展开。修改时保留其身份锚点只改变用户明确要求的部分。描述纪律只写稳定外貌不写表情、姿态、动作、背景、环境、手持剧情道具或故事性句子不用或可能也许大概等不确定词每个视觉选择明确具体不写气场强大成熟稳重的气息等无法直接看见的抽象气质——若需要表达身份能量应转译为可见轮廓、服装、材质和配饰以原文明确外貌为最高优先级在不过度锁死的前提下保留合理生成空间。除非输入要求不规定每根发丝、每个色块或每件配饰。参考角色图的使用规则当存在参考图时从参考图提取脸部结构、发型、体型、服装结构和可穿戴配饰等稳定身份特征参考图只展示局部身体时根据可见服装与角色身份合理补齐下装、鞋履、手臂和手部补全部分必须与已见部分协调图像反推按画面实际可见情况写肤色和眼睛颜色但仍不得描述表情、动作、背景和姿势反推分析可以给出由画面直接支持的整体造型或气质关键词帮助理解身份方向进入最终生图描述时必须把这些关键词转译成可见的轮廓、服装、材质和配饰不能留下无法视觉化的抽象判断。场景设计规范从明确的场景名称或空间身份开始把泛称具体化为稳定可控的真实空间而不是停留在教室办公室等标签忠实保留用户指定的核心场景身份、关键物体、材质、时代感和空间关系不能替换为更熟悉但无关的场景类型写清建筑与空间结构墙、地面、天花、门窗、边界、开口、尺度和纵深材质、颜色和表面状态具体可见加入有叙事价值的使用痕迹、生活痕迹与陈设避免泛化美术词明确前景、中景、背景或近处、中部、远处的层次保持完整全景和可理解的空间边界不生成局部裁切或含糊背景设置至少三个稳定、清晰可见的空间锚点并在其周边保留可用地面或空白区域供后续人物落位——这只是隐形构图指导不能画标签、轮廓框、箭头、引导线或人工占位场景稳定描述中的光线只记录真实来源、位置、时间和对空间的物理影响不写由执行层统一合成的戏剧化光影效果私密空间或明确空镜不加入人物宴会厅、集市、上课教室等天然有人群的场景可以加入模糊、无身份的人群不能引入有名主角或剧情动作场景资产应是可复用的环境建立画面不是某个瞬间的叙事分镜——不要出现对白、字幕、解释文字、水印、标注、箭头或 Logo场景世界中自然存在的招牌、路标、门牌、海报、包装或屏幕文字只有在属于环境时保留并保持次要自然避免随机乱码和漂浮文字。道具设计规范只描述道具本体的静态视觉信息主体结构、轮廓、数量关系、材质、颜色、表面处理、纹样、装饰和磨损不写用途、剧情、角色动作、人物、手部、桌面、房间、背景、镜头或氛围光影结果适合白底居中、主体完整清楚的独立道具资产图参考图可提供轮廓、结构、材质、纹样与配色但不能引入参考图中的偶然背景或人物。商业内容中的产品、包装或品牌物按道具处理用户提供的精确 Logo、包装图是参考来源只能作为身份与结构参考不得重绘后冒充权威品牌资产。最终资产生成批次Schema 与字段详解唯一权威 Schema本 Skill 的唯一专业结果是运行时注入 schema 约束的outputKind: asset_generation_batch严格 JSON。该机器 Schema 是字段、必填项和层级的唯一权威本 Skill 不另写文件或第二份模板。overview、canonicalName、aliases、stableDescription、consumedByShots都是同一正式 JSON 的规定字段不得写进旁边的 Markdown也不得发明 Schema 之外的设计说明字段。该 Schema 的完整实现位于 src/lib/workspace-resource/generation-request.ts用 Zod 定义const assetGenerationItemSchema imageGenerationItemSchema.safeExtend({ assetKind: z.enum([character, location, prop]), aliases: textList(64, 300), stableDescription: z.string().trim().min(1).max(16_000), consumedByShots: textList(512, 512), }).strict() export const assetGenerationBatchOutputSchema z.object({ schemaVersion: z.literal(2), outputKind: z.literal(asset_generation_batch), batchId: z.string().trim().min(1).max(191), decision: z.enum([produce, no_assets]), overview: z.string().trim().min(1).max(8_000), items: z.array(assetGenerationItemSchema).max(OPERATION_EXECUTION_MAX_TASKS), assumptions: textList(64, 2_000), warnings: textList(64, 2_000), }).strict().superRefine((batch, context) { if (batch.decision produce batch.items.length 0) { context.addIssue({ code: custom, path: [items], message: decisionproduce requires at least one item. }) } if (batch.decision no_assets batch.items.length ! 0) { context.addIssue({ code: custom, path: [items], message: decisionno_assets requires items to be empty. }) } validateGenerationItems(batch, context) })关键字段语义按源码注释整理字段类型/取值说明schemaVersion字面量2当前批次 Schema 版本outputKind字面量asset_generation_batch唯一专业结果类型batchIdstring1–191 字符批次标识decisionproduce/no_assetsproduce必须至少一个 itemno_assets必须空 itemsSchema 强制overviewstring1–8000 字符批次总览也用于 WorkspaceResource 文本预览items数组上限为OPERATION_EXECUTION_MAX_TASKS每个 item 是一个资产图片生成任务assumptions/warnings字符串列表各最多 64 项、每项 2000 字符假设与告警每个 item 继承图片生成任务的通用字段imageGenerationItemSchemaitemId批次内唯一标识name用户可见资源名服务端据此派生规范 WorkspaceResource 路径folderPath可选的项目相对目标文件夹省略或null表示项目根目录缺失文件夹随输出原子创建count整数 1–6默认 1mediaType固定imageprompt完整最终 Prompt非空服务端校验并逐字冻结——这就是执行层会逐字冻结不能依赖其他字段或服务端再次补写的底层实现schemaId见下文 assetKind 对应表options按当前create_image工具 Schema 填写未固定参数不填写model模型由设置固定固定分辨率、质量由服务端取配置不在 item 中重复填写工具没有options时省略它references只使用精确的 ready Resource 身份与版本——每个引用由resourceId规范 WorkspaceResource 身份、contentVersion不可变输入版本、role、channelcontext或image组成数组顺序即权威顺序服务端分配冻结的内部位置generationReferenceSchema。资产 item 额外字段assetKindcharacter/location/propaliases最多 64 个别名每个最长 300 字符stableDescription1–16000 字符的稳定可见身份描述consumedByShots最多 512 个、每个最长 512 字符的被消费镜头列表。assetKind 与 schemaId 的严格对应Schema 的superRefine强制三重约束源码assetKind与schemaId必须严格对应character → project.character_image、location → project.location_image、prop → project.prop_image否则报错schemaId must match assetKind使用可复用资产 Schema 时必须提供assetKind资产图片必须省略aspectRatio——Asset images use the fixed asset format; omit aspectRatio. 可复用资产的 4:3 画幅由服务端资产策略唯一决定不在专业交接中重复提交generationAspectRatioSchema 也明确固定格式资产图必须省略。这三种 schemaId 的注册值见 src/lib/workspace-resource/schema-registry.tsCHARACTER_IMAGE: project.character_image、LOCATION_IMAGE: project.location_image、PROP_IMAGE: project.prop_image。三类资产的固定版式每类资产图片 item 必须写完整最终 Prompt且遵循固定版式资产版式角色一张 4:3 横向图左右等分左侧同一角色脸部特写右侧同一角色无遮挡全身纯白背景不得出现其他人物、道具或环境场景一张 4:3 横向图正前方完整展示整个空间不拆多视图不得出现人物、松散家具或独立道具场景固定结构可保留道具一张 4:3 横向图只出现一个居中、完整、方向明确、无遮挡的道具纯白背景不得出现人物、其他道具或环境生成后评审检查点本 Skill 声明一个硬对齐检查点生成资产评审时机全部新生成的前置视觉资产就绪之后、任何依赖它们的语音或视频工作开始之前做法检查确切的 ready Resource概述它们的身份与可见质量结果然后由主 Agent 发起一张卡询问用户是否满意选项顺序固定满意并继续在前先暂停不进入下游生产其次并提供本地化的otherLabel邀请用户写出具体修改要求门禁在用户接受、或所要求的资产修改就绪并再次评审之前不得提交依赖它们的生产例外复用已存在的资产不触发本检查点。自检清单与职责边界提交前自检原文档给出的自检问题可直接作为交付检查正式生成批次是否只包含从输入源文本判断值得复用的生产资产注入完整 Creative Direction 时是否使用了所有相关政策且没有把无关领域变成资产事实是否同时保留纯净的稳定设计并把完整最终 Prompt 与正确版式写入批次同时把 4:3 画幅唯一交给服务端资产策略角色是否稳定、完整、年代一致、鞋履明确肤色/发色/瞳色等身份锚点是否写清并排除了动作、背景、不确定词和抽象气质非人类角色是否按真实形态处理而非套用人类模板场景是否忠实、结构完整、层次清楚、锚点稳定并留有无标记的落位空间道具是否只包含静态本体信息Skill 与系统的边界本 Skill 负责资产筛选、稳定可见设计、最终资产图片 Prompt 和对应批次参数。而项目级呈现政策来自已提供的 Creative Direction模型由系统配置决定主 Agent 只按当前create_image工具 Schema 填写创作参数主 Agent 把同一结果的原样 items 提交给create_image。媒体执行、能力校验、计费、审批、Task 与终态由系统服务负责——这正是 output registry 中mediaOperationId: create_image所表达的职责切分也保证了同一个专业结果完成筛选、稳定身份设计与最终 Prompt不输出第二套候选状态或再拼接另一版 Prompt。赞分享【免费下载链接】waoowaoo首家工业级全流程 AI 影视生产平台。Industry-first professional AI Agent platform for controllable film video production. From shorts to live-action with Hollywood-standard workflows.项目地址https://gitcode.com/gh_mirrors/wa/waoowaoo点击查看免费下载相关推荐Toonflow 视觉设计方法从剧情事实推导角色、场景与道具资产Toonflow 视觉设计方法从剧情事实推导角色、场景与道具资产 本文是 Toonflow 视频制作工作流技能包中「视觉设计」方法的完整指南讲解如何在角色外人工智能AI 应用AI AgentRAGAI 写作后端桌面应用火宝短剧 extractor Agent 技能规范深度解析从剧本到角色/场景/道具资产的智能提取与去重实战火宝短剧 extractor Agent 技能规范深度解析从剧本到角色/场景/道具资产的智能提取与去重实战 本篇技术指南围绕火宝短剧Huobao DramaAI 应用人工智能媒体生成音视频AI Agent后端前端Toonflow 角色、场景与道具资产制作指南按制作范围提取、参考板设计、变体管理与生成验收全流程Toonflow 角色、场景与道具资产制作指南按制作范围提取、参考板设计、变体管理与生成验收全流程 在 Toonflow 的 AI 短剧漫剧制作流程中资产人工智能AI 应用AI AgentRAGAI 写作后端桌面应用上一篇如何用Photon光影包为Minecraft打造电影级画质新手完整指南下一篇Windows网络性能测试终极指南iperf3完整下载与配置教程创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考