用 Codex + Obsidian 搭建文章配图自动化工作流

Source: (unknown)

Summary

演示如何将 Codex 与 Obsidian 笔记库结合,构建一条从文章理解到图片生成的四步配图流水线:阅读理解、场景设计、提示词撰写、出图。核心思路是先让大模型读懂文章再拆解场景,而非直接生图;通过项目总控笔记、人物一致性备忘录、场景清单三份结构化笔记约束大模型,保证人物一致性与画面服务于阅读节奏。最终 Codex 驱动 Image 2.0 批量出图,不满意的按编号重跑,无需重新描述。整套流程不需要编程基础,全程自然语言交互。

Key Points

  • 四步流水线:阅读理解 → 场景设计 → 提示词 → 出图,顺序不能省
  • 先建「项目总控笔记」让模型理解文章内容、图片数量与节奏,再建「人物一致性备忘录」固定人物视觉特征
  • 场景清单精确到编号、正文位置、用途、必须/禁止出现的元素,避免每次重新描述
  • 提示词物料包分两层:全局要求(风格、禁忌)+ 具体场景,不能混在一起
  • 先生成人物原型三视图作为图生图参考物料,保证后续人物稳定性
  • 按编号反攻(如 A03 A09 B15 重新生成)是任务拆清楚后带来的核心效率收益
  • 适用于公众号、小红书图文、PPT 封面、课程配图、视频分镜等场景

Transcript

transcript