Guide · 使用教程
Pencil 教程:从品牌素材到可复盘的广告创意测试工作流
一套可执行的 Pencil 广告创意测试流程:整理品牌资产、控制单一变量、生成静态与视频版本、人工审核、发布并用真实数据决定下一轮。
这篇教程会完成什么
这套工作流会用 Pencil 完成一个可审查的广告创意测试:先整理品牌和产品资产,再写清受众、卖点和测试假设,生成有限数量的静态与视频变体,完成人工审核后发布,最后把真实表现变成下一轮创意方向。目标不是一次生成几十条看起来不同的广告,而是让每个版本回答一个明确问题。
教程适合电商、SaaS、移动应用和代理商团队。你需要一个风险较低、已经可以合法投放的产品,一组有授权的品牌素材,以及能够查看广告账户数据的人。若涉及医疗、金融、儿童、收益承诺或人物肖像,应在上传素材和生成广告之前让法务或合规人员参与。
开始前需要准备
准备 3–5 张清晰产品图、3–5 段可用视频、Logo、品牌颜色、字体、语气指南、目标落地页和当前有效的价格或优惠。所有素材都要确认版权、商标、肖像、音乐和客户授权。不要把受 NDA 保护的客户资产、身份证件、未公开财务数据或敏感人物信息直接当作普通生成素材。
再准备一页测试简报,包含:目标受众、他们遇到的问题、产品如何解决、最重要的证据、不能说的内容、行动号召、投放渠道和成功指标。把“做一条高转化广告”改成可验证假设,例如“对第一次购买的用户,展示三步使用过程是否比只展示结果更能提高落地页点击率”。
最后确定预算。Pencil Core 当前每月 50 generations,Growth 为 250 generations,不同文本、图像、视频和编辑操作消耗不同。先为小测试设上限,例如不超过 15 generations、两种视觉方向、每种两个版本。额度每月重置且不结转,盲目批量生成会很快失去成本控制。
第一步:建立品牌与产品上下文
在 Pencil 中为单一品牌创建工作区,上传已经批准的 Logo、颜色、字体、产品图、视频和语气规范。不要一次把整个公司网盘导入。只上传这次广告所需素材,并用清楚的名称区分原始文件、可公开素材和内部参考。
检查品牌库中的产品名称、型号、价格、单位和禁用词。如果产品包装包含文字,准备一张高分辨率正面图作为核对基准。AI 可能在生成时改变包装比例或文字,品牌库能提供上下文,但不能保证像素级保持。
Pencil 声明执行 No-Train,但平台仍会为推理调用不同模型。企业团队应先确认账号套餐、管理员设置、第三方模型、数据区域和 DPA。对高度敏感素材,可以先用脱敏或虚构样本完成流程验证。
第二步:把目标写成单变量测试
选择一个主要指标,例如点击率、落地页浏览、加购或合格线索。一次测试只把一个创意因素设为主变量:Hook、价值主张、视觉场景、演员、证明方式或 CTA。受众、预算、落地页和投放位置尽量保持一致。
示例假设:对于第一次接触产品的中小商家,展示“手工处理前后对比”比只展示最终成品更容易理解价值。由此可以设计两个方向:A 版本展示工作量和痛点,B 版本展示快速完成的结果。不要同时更换折扣、受众和落地页,否则结果无法解释。
把必须保持不变的内容写入简报:正式产品名、价格、活动期限、Logo 安全区、不能出现的功效或收益声明、禁止使用的人物和视觉风格。明确每个版本都要有人审核后才能导出和发布。
第三步:选择 Agent 与模型
先用研究或策略类 Agent整理受众问题、常见异议和可验证卖点,再用文案 Agent 生成少量 Hook 和正文。不要直接接受第一批文案;逐句检查是否夸大、是否引用无法证明的数据、是否把功能写成保证结果。
为静态图和视频选择模型时,先用低成本方案做方向探索,再把通过审核的方向交给更高成本模型。记录每次操作使用的模型和 generations。不同模型在人物、商品、文字、镜头连贯和中文排版上的表现差异很大,不能只比较一张最好看的样张。
如果团队创建自定义 Agent,应限制它能读取的知识、允许调用的工具和输出格式。把品牌规则写成短而可执行的检查项,例如“不得改变包装文字”“价格必须从批准字段读取”“禁止生成用户评价”。长而模糊的品牌故事不等于有效约束。
第四步:生成最小可用变体
为每个方向只生成两个版本。静态广告可以保持文案不变,仅比较产品场景;视频广告可以保持演员和脚本不变,仅比较前三秒 Hook。每次生成后立即淘汰明显错误,不要为了用完额度继续扩展有问题的方向。
检查商品结构、Logo、包装文字、人物手部、画面里的价格、字幕和 CTA。AI 容易把包装文字改成假字,也可能改变产品颜色或尺寸。所有文字最好在最终编辑阶段使用真实字体和可编辑图层添加,而不是依赖图像模型直接绘制。
自动调整 1:1、4:5、9:16 和 16:9 时,要逐个画幅检查主体是否被裁切、字幕是否进入安全区、CTA 是否被平台界面遮挡。自动缩放可以节省时间,但不会理解每个渠道的阅读顺序。
第五步:建立人工审核门槛
在导出前让品牌、增长和合规角色分别检查。品牌检查颜色、Logo、字体和语气;增长检查受众、卖点、CTA 和变量是否清楚;合规检查价格、期限、功效、收益、人物、音乐和行业要求。任何一项不通过都应回到对应步骤,而不是在投放后补救。
给每条素材一个唯一版本号,并记录所用简报、模型、generations、生成时间、人工修改时间和审核人。Pencil 的条款要求输出在公开前经过人工干预、审核和批准,这也符合可追溯的广告管理要求。
不要因为平台提供表现预测就跳过审核。预测分数是基于历史数据和模型的辅助信号,不能识别所有法律、品牌和市场语境问题。
第六步:发布一个可解释的测试
将通过审核的版本发布到目标渠道。一次先选择一个主要平台和一个受众,保持预算、出价、落地页和投放时间尽量一致。为每个版本分配足够展示,避免在样本过小时因为短期波动提前下结论。
Pencil 可以连接 Meta、Instagram、TikTok、YouTube、Google Display、DV360 和 LinkedIn 等渠道,具体可用范围取决于账号和方案。连接广告账户前确认权限最小化,不要给不需要的成员管理员权限。
记录平台原始指标,同时关注业务结果。点击率提高但转化率下降,可能意味着创意承诺与落地页不一致;视频观看高但加购低,可能只是开场吸引而没有说明产品价值。
第七步:把结果变成下一轮假设
常见问题
- 第一次测试应该生成多少广告?
- 建议只做两个创意方向,每个方向两个版本,并只改变一个主要变量。先验证流程和审核门槛,再根据真实结果扩大产量。
- Pencil 的 generations 怎么计算?
- 文本、图像、视频、音频、所选模型和任务规模的计量不同。应在账号内查看当前费率,并记录每条最终可投放素材的总消耗。
- 可以让 Pencil 自动发布所有广告吗?
- 不建议。Pencil 条款要求公开输出前有人干预、审核和批准。品牌、价格、功效、人物、音乐和行业合规都需要人工检查。
- 如何避免一次测试改变太多变量?
- 固定受众、预算、落地页和投放位置,只选择 Hook、视觉、演员、证明方式或 CTA 中的一个作为主变量,并给每个版本唯一编号。
- 预测分数高的素材一定表现好吗?
- 不一定。预测分数依赖历史数据和模型,只适合辅助筛选。最终要看足够样本下的点击、转化、获客成本和业务质量。
- 敏感客户素材可以上传吗?
- 先核对套餐、第三方模型、DPA、数据区域、保留和删除规则。受 NDA 保护、未发布或含个人信息的素材应脱敏,必要时使用企业合同。