Zootopia Ppt logo

Zootopia Ppt

Community
jin-bo
zootopia-ppt

将用户的演示讲稿转化为拟人化动物世界主题的演示文稿图像(顶级3D动画电影风格)。 分三步:① 理解演讲内容与受众 ② 生成每页的3D动画电影风格生图提示词(Markdown 格式,保存到 workspace/docs/outline/) ③ 调用 image_gen_ppt.py 批量生成图像(保存到 workspace/docs/slides/)。 触发条件:用户提供演示稿/PPT 内容,要求制作 疯狂动物城风格 / 拟人化动物 / 3D动画电影风格的图像或演示文稿。

Overview

Publisherjin-bo
Repositoryagentao
Skill namezootopia-ppt
Stars
302
Forks
11
Bundled files
5
LicenseMIT
Links
  • Markdown instructions

    A SKILL.md file the model loads on demand, so it only costs tokens when a request actually matches.

  • Works with any LLM

    AI skills are plain Markdown, not provider-specific code, so this works with GPT, Claude, Gemini, Grok, or a local model.

  • 5 bundled files

    Scripts, templates, and references the model can read while it works. Files are read-only and never executed.

  • Open source

    Published by jin-bo on GitHub. Read the source before you install it.

Installation

Install the Zootopia Ppt AI skill in TypingMind to use it with any LLM, or drop it into another agent that reads SKILL.md.

1

Install in TypingMind

TypingMind installs a skill straight from its GitHub folder — it reads SKILL.md, bundles the resource files, and stores the result locally.

  1. Open the app and go to Plugins → Skills.
  2. Choose "Install from GitHub".
  3. Paste the skill folder URL below and confirm.
  4. Enable the skill in any chat where you want it available.
Plugins → Skills → Add skill → From GitHub URL, then paste the folder URL and press Continue.
2

Install in another agent

Any agent that reads the Agent Skills format can use this skill — copy the folder into that agent's skills directory.

Claude Code — .claude/skills
git clone --depth 1 https://github.com/jin-bo/agentao.git /tmp/agentao
mkdir -p .claude/skills
cp -r /tmp/agentao/examples/skills/zootopia-ppt .claude/skills/zootopia-ppt
Restart Claude Code after copying so it picks up the new skill.

Use it in TypingMind

Enable Zootopia Ppt in any TypingMind chat and the model takes it from there. Its name and description sit in the system prompt, and the moment a request matches, the model loads the full instructions itself — you never invoke it by hand, and it costs no tokens until it is actually used.

The model loads Zootopia Ppt on its own as soon as a request matches it.

Works with any AI model

AI skills are plain Markdown instructions rather than provider-specific code, so Zootopia Ppt is not tied to the model it was written for. Install it once in TypingMind and use it with GPT-5, Claude, Gemini, Grok, DeepSeek, Mistral, Llama, or a local model you run yourself — all on your own API keys.

  • Loaded only when it is needed

    The system prompt carries just the name and description. The instructions are fetched on the first matching request, so an idle skill costs nothing.

  • Switch models mid-chat

    Because the skill is instructions rather than code, changing model does not break it — the next model reads the same SKILL.md.

Skill instructions

This is the SKILL.md content the model loads. Read it before installing — a skill is instructions your model will follow.

拟人化动物世界 · 3D动画电影风格演示文稿制作指南

总体原则

  • 以顶级3D动画电影的视觉语言(漫画分镜、拟人化动物角色、现代化都市场景)诠释演讲内容
  • 每页图像须忠实传达该页的核心信息,角色与场景选择须服务于内容
  • 全稿风格一致;情节重大转折时可切换配色基调
  • 不要出现 血腥、暴力、武器 相关的 文字
  • 画面要图文结合,可以用于现场演讲展示

版权合规:去标签化原则

严禁在提示词中使用任何受版权保护的作品名、角色名或专有名词,包括但不限于:

  • ❌ Zootopia、疯狂动物城、Nick Wilde、Judy Hopps、尼克、朱迪、ZPD
  • ❌ 任何迪士尼/皮克斯角色名或作品名

必须使用"物种 + 标志性服装 + 性格特征"的特征化描述替代角色名

原角色替代描述
朱迪/Judy灰兔:一只眼神坚定、充满使命感的拟人化灰色兔子,穿着深蓝色战术警察制服
尼克/Nick红狐狸:一只神情悠闲、带着狡黠微笑的拟人化红狐狸,穿着半正式的绿色夏威夷衬衫
牛局长/Bogo水牛局长:体型魁梧的非洲角水牛,穿着高级警官制服,神情严厉肃穆
羊副市长/Bellwether绵羊助理:体型娇小的拟人化绵羊,穿着职业裙装与开衫,戴红色粗框眼镜
狮市长/Lionheart狮子市政官:威严的拟人化雄狮,穿着精准剪裁的深蓝色商业西装
闪电/Flash树懒职员:浅褐色毛发的拟人化树懒,穿着职业衬衫,动作极度迟缓
豹警官/Clawhauser胖豹警官:体型圆润的拟人化猎豹,负责警署接待,性格热情开朗
鼩鼱大佬/Mr. Big鼩鼱大佬:体型极度娇小的拟人化北极鼩,神情冷峻,极具威严
ZPD / 动物城警局现代大都市警署 / 高科技指挥中心 / 高科技实验室
动物城 / Zootopia拟人化动物大都市 / 繁华的现代化动物都市

风格关键词用以下替代:

  • ❌ "Zootopia 风格" → ✅ "顶级3D动画电影风格,拟人化动物世界(Anthropomorphic animal world),皮克斯/迪士尼风格渲染"
  • ❌ "迪士尼动画风格" → ✅ "高水平3D动画电影质感,电影级布光,丰富的毛发细节"

Step 1:理解讲稿内容与受众

在生成任何提示词之前,先完整阅读用户提供的讲稿,提取:

维度提取内容
主题讲稿核心议题与关键论点
受众面向谁(专业技术人员 / 高管 / 大众 / 学生)
目的说服 / 科普 / 汇报 / 品牌展示
情感基调严肃权威 / 轻松幽默 / 激励人心 / 警示紧张
内容结构页数、各页标题与核心要点
角色分配确定哪些角色将承担哪些关键任务(根据其 Personality 设定)
核心隐喻为抽象概念(如 AI、安全、效率)寻找独特的视觉意象

1.1 情感旅程弧度

将全稿的情感变化画成一条弧线,例如:

封面(期待)→ 背景(忧虑/警觉)→ 问题(紧张)→ 解决方案(转折/希望)→ 总结(激励/信心)

每个情感节点对应的配色基调、角色状态和镜头语言都应与之呼应。相邻页面的情感跨度不宜过大,须有过渡。

1.2 每页核心视觉时刻

对每一页,提炼出一句话:「这一页最应该让观众感受到什么?」

示例:

  • 封面:「这是一场高技术含量的安全战,主角已准备就绪」
  • 威胁页:「危险已渗入城市每个角落,局势紧迫」
  • 方案页:「有了这套工具,威胁是可以被击败的」

这句话决定了镜头选择、角色表情与构图重心,必须在写提示词前明确。不能用主题词代替(「讲人工智能安全」不是视觉时刻)。


Step 2:生成3D动画电影风格生图提示词

2.1 整体风格与角色设定(frontmatter style + characters 字段)

在 YAML frontmatter 中写入贯穿全稿的风格描述角色设定

style 字段 — 全局风格
yaml
style: |
  以高水平3D动画电影风格创作漫画分镜。画风精致,美式动漫感,色彩饱满,线条清晰,具有强烈的视觉冲击力。
  顶级3D动画电影质感,电影级布光,丰富的毛发细节。
  画面图文并茂:页面标题以漫画手写字体或印刷标题栏方式融入画面,关键数据可作为全息屏幕/白板内容出现,文字须与视觉元素自然结合,不得孤立悬浮。
characters 字段 — 角色设定表 (核心一致性原则)

为保证全稿角色形象、服装与道具的高度一致,所有在文稿中出现的拟人化动物角色,必须从第一页开始就在 frontmatter 的 characters 列表中完整定义。

严禁在后续页面的提示词中临时引入未定义的角色。 脚本会将这些定义自动注入每页提示词,确保生图模型能记住每个角色的视觉特征。

每个角色包含以下属性:

  • name:角色简称(在提示词中引用时使用,如"灰兔"、"红狐狸")
  • species:物种(如"拟人化灰色兔子"、"拟人化红狐狸")
  • appearance:外貌特征(毛色、体型、五官特点等)
  • outfit:服装与饰品(贯穿全稿的标志性穿着,建议描述具体材质和颜色)
  • personality:性格气质(必须与角色在剧情中承担的任务相匹配
  • accessories:装备/道具(角色标志性随身物品)

角色任务匹配原则 (Role-Task Alignment)

  • 正义与行动派 (如灰兔):适合承担“发现问题”、“执行方案”、“展示成果”等积极正面的任务。
  • 智囊与城市生存专家 (如红狐狸):适合承担“数据分析”、“破解难题”、“提供创意策略”等需要灵活性和洞察力的任务。
  • 权威与决策者 (如狮子/水牛):适合承担“发布政策”、“战略决策”、“资源调度”等具有仪式感和压迫感的任务。
  • 技术支持与亲和力 (如胖豹):适合承担“客户服务”、“实时监控”、“基础架构展示”等任务。
yaml
characters:
  - name: 灰兔
    species: 拟人化灰色兔子 (主角)
    appearance: 体型娇小,身姿矫健,拥有紫色大眼睛与灰色短毛
    outfit: 深蓝色现代警署战术制服,佩戴金色警徽
    personality: 极致乐观、正义感强、行动果断且具备极高的职业使命感
    accessories: 腰间配有高科技通讯设备、战术腰带,以及录音笔

  - name: 红狐狸
    species: 拟人化红狐狸 (主角)
    appearance: 橙红色毛发,吻部及腹部为白色,眼神狡黠
    outfit: 浅绿色夏威夷风格衬衫,搭配深蓝色斜纹领带与棕色长裤
    personality: 玩世不恭、思维敏捷、深谙城市生存法则,实则内心善良且忠诚
    accessories: 随身携带用于“行骗”的各类小道具

  - name: 水牛局长
    species: 拟人化非洲角水牛
    appearance: 体型魁梧,拥有深灰色厚皮与巨大的向上卷曲角,右眼上方有疤痕
    outfit: 高级警官制服,领口绣有四颗金星以示警衔
    personality: 严厉肃穆、务实且不苟言笑,对纪律有近乎苛刻的要求
    accessories: 办公时佩戴黑框老花镜

  - name: 绵羊助理
    species: 拟人化绵羊
    appearance: 体型极小,拥有蓬松的白色羊毛和巨大的绿色眼睛
    outfit: 多样化的职业装,常穿带有花纹的半身裙搭配不同颜色的针织开衫
    personality: 表面温顺勤勉、实则极具野心,是典型的机会主义者与幕后操盘手
    accessories: 红色粗框眼镜,颈间挂着一个小金铃铛

  - name: 狮子市政官
    species: 拟人化非洲狮
    appearance: 雄壮的成年公狮,拥有浓密的鬃毛和威严的金色皮毛
    outfit: 精准剪裁的深蓝色商业西装,搭配红色领带
    personality: 极具领袖魅力、追求政治名声,行事风格在宏大愿景与实用主义间游走
    accessories: 金色领带夹

  - name: 树懒职员
    species: 拟人化三趾树懒
    appearance: 浅褐色毛发,面部有标志性的深色眼影状花纹
    outfit: 浅黄色短袖职业衬衫,搭配条纹领带
    personality: 反应极慢但工作态度极其“认真”,幽默感源于其生理性的迟缓
    accessories: 办事大厅柜台后的办公电脑与印章

  - name: 胖豹警官
    species: 拟人化猎豹
    appearance: 体型异常圆润,脸部满是斑点,始终带着灿烂的笑容
    outfit: 警署文职制服,领口可能沾有零食碎屑
    personality: 热情洋溢、重度社交媒体用户、资深技术宅,团队中的“开心果”
    accessories: 办公桌上的甜甜圈盒、智能手机、调度麦克风

  - name: 鼩鼱大佬
    species: 拟人化北极鼩
    appearance: 体型极度娇小,拥有整齐的白色胡须,眼神冷峻犀利
    outfit: 经典的黑色三件套条纹西装,口袋插着红玫瑰
    personality: 威严、冷静、极其重视“忠诚”与“尊重”,拥有不容置疑的掌控力
    accessories: 豪华微型转椅、由北极熊保镖随行的精致轿椅

提示词中的引用方式:在每页提示词中直接使用简称(如"灰兔"、"红狐狸"),脚本注入的角色设定会让生图模型理解其完整形象。

注意:角色列表可根据讲稿内容增减。不是每个演示都需要全部角色,按需定义即可。

2.2 角色与场景选择指引

根据页面内容情感与主题选择合适的拟人化动物角色与场景:

内容类型推荐角色 / 场景情感状态
封面 / 开场拟人化灰兔(警服)+ 拟人化红狐狸(夏威夷衬衫)背靠背,动物大都市全景,Splash Page自信、跃跃欲试
技术 / 创新高科技指挥中心装备、全息投影、数据流专注、兴奋
政策 / 法规穿正装的拟人化雄狮在会议室、发光法典、庄严礼堂权威、郑重
威胁 / 风险黑暗小镇、警戒配色、角色神情凝重紧绷、警觉
揭示问题灰兔指向证据板,红狐狸眉头紧锁洞察、忧虑
转折 / 突破角色表情从凝重骤然转为坚定,有光从暗处射入决心、转机
合作 / 共赢灰兔与红狐狸携手,多物种共存场景温暖、信任
服务 / 支持胖豹警官在警署接待台,提供技术支持或指引热情、亲和
战略 / 决策鼩鼱大佬在豪华微型办公室内下达指令,或由保镖护送威严、不容置疑
方案 / 工具警署情报室操作台,角色主动出击姿态掌控、行动力
成果 / 未来动物大都市地标日出全景、庆典、胜利姿势喜悦、展望
数据 / 分析侦探白板、大屏幕地图、数据可视化界面冷静、分析

2.2.1 镜头语言

镜头角度直接决定画面的情感重量,必须在提示词中明确指定:

镜头类型效果适用情境
仰角(低机位向上拍)被拍对象显得高大、权威、强势展示方案优势、领导人物、重要结论
俯角(高机位向下拍)营造全局感、弱化感或渺小感宏观背景页、展示威胁规模
平视特写(Close-up)传递情绪,聚焦细节关键转折、人物内心、核心数据
中景(Medium Shot)兼顾人物与环境,叙事均衡日常工作场景、流程说明
大远景(Establishing Shot)建立环境,宏大感封面、章节开场
过肩镜头(Over-the-shoulder)带入视角,制造参与感演示操作界面、对话决策

原创声明:生成的提示词描述的是原创画面构想,以拟人化动物世界(Anthropomorphic animal world)的世界观与3D动画电影的视觉语言为灵感,而非复制任何具体受版权保护的场景或角色。

2.2.2 漫画单页布局 (Manga Layouts)

在漫画创作中,单页布局(分镜/分格,日文称 Komawari)是控制叙事节奏、情感表达和读者视线的核心工具。主要的布局类型可归纳为以下几类:

1. 基础分格布局 (Basic Panel Layouts)
  • 网格型 (Grid Layout): 规则的矩形排列。最典型的是“四格漫画” (Yonkoma),或者美式漫画中常见的 2x3、3x3 均匀布局。这种布局节奏平稳,适合日常或信息量大的叙事。
  • 阶梯型 (Staggered Layout): 格子大小不一、位置交错。通过改变格子的宽度和高度来强调特定瞬间,打破单调感,引导读者视线沿“S”形移动。
  • 竖长格 (Vertical Panels): 常用于表现人物全身像、同时发生的多个小细节,或在垂直滚动漫画(Webtoon)中拉长叙事时间感。
2. 动态与表现型布局 (Expressive Layouts)
  • 斜向分格 (Diagonal Panels): 格线以倾斜角度切割。常见于战斗、动作戏或心理剧变的瞬间,能产生强烈的视觉冲击力、不稳定性或动感。
  • 出血位/满版 (Bleed/Tachikiri): 画面延伸至纸张边缘,不留白边(Gutter)。这种布局能创造开阔感,让读者感觉身临其境。
  • 跨页 (Double-Page Spread): 两页合成一张大图,用于极具震撼力的视觉呈现(如宏大场景、关键角色登场)。
3. 特殊视觉技术 (Visual Techniques)
  • 嵌格 (Inset Panels): 在一个大格子内部嵌入一个小格子。常用于在表现大环境的同时,展示人物的特写表情或某个局部细节。
  • 破格 (Panel Breaks): 人物或物体(如武器、肢体)冲出格线,跨越到相邻格子或白边区域。这种方式极具立体感,能显著增强动作的爆发力。
  • 无边框分格 (Borderless Panels): 画面没有明确的线条框限。常用于表现回忆、梦境、内心独白,或者需要营造空灵、散漫的氛围。
4. 叙事流派特色
  • 少年向 (Shonen): 偏好不规则格、大跨页和强烈的动作破格,追求视觉上的“燃”与冲击力。
  • 少女向 (Shojo): 常使用复杂的重叠格、大量留白、花卉背景以及模糊的格线,侧重于表现细腻的情绪流动。
  • 条漫 (Webtoon): 以纵向排列为主,利用滚动间距控制阅读频率和悬念。

2.3 漫画分镜格式规范

每页提示词须包含以下要素(前三项必填,后两项在情感关键页必填):

### [页面序号]-[页面标题]

* **核心视觉意图**:[一句话:这格画面要让观众感受到什么]
* **分镜画面**:[单格 Splash / 基础分格 / 斜向分格 / 出血位 / 跨页 / 嵌格 / 破格 / 无边框分格等]
  * 第一格:[镜头类型] + [布局类型] + [角色姿态与表情] + [场景细节]
  * 第二格:[...]
* **视觉元素**:[关键道具、背景、光效、特效]
* **配色风格**:[主色调及其情感含义]
* **文字呈现**:[页面标题/关键词以何种方式融入画面,例:顶部横幅印刷体标题、全息屏幕显示数据、白板上的要点、漫画对话框中的关键词]
* **角色情感表达**:[主要角色的表情、肢体语言、眼神方向](情感关键页必填)
* **象征性元素**:[用具体物体隐喻抽象概念,例:破碎的盾牌=现有防护失效](抽象概念页必填)

象征性元素参考(抽象概念 → 可见物体)

抽象概念可视化物体
数据泄露 / 入侵锁链断裂、门缝中渗入的红色光雾
技术框架 / 架构发光的脚手架、积木塔、精密齿轮组
合规 / 法规发光法典、天平、印章特写
风险评估侦探白板上的红绳连接图
自动化流程流水线传送带、机械臂协作
信任 / 认证握手特写、徽章发光
威胁增长城市地图上蔓延的警报点
突破 / 创新暗室中射入的强光束、锁链瞬间炸开

2.4 典型分镜设计示例 (Storyboard Design Examples)

以下展示如何将枯燥的“技术内容”转化为极具视觉冲击力的3D动画电影分镜:

场景 A:展示“全方位立体安全防御体系” (技术架构页)
  • 核心视觉意图:传达防御体系的“不可逾越”与“精密协作”,让受众产生强烈的安全感。
  • 分镜画面:采用 斜向分格 (Diagonal Panels) 结合 破格 (Panel Breaks) 的复合布局。
    • 主大格:[仰角] 灰兔站在警署高科技塔台边缘,身后是巨大的金色盾牌状全息屏,光芒笼罩着下方的繁华都市。
    • 嵌格 (位于右下角):[特写] 红狐狸在操作台快速输入指令,眼神专注,手指在光标上飞动。
    • 破格效果:全息屏幕边缘的光流冲出格线,延伸至整个页面边缘(出血位)。
  • 视觉元素:半透明的几何力场护盾,飞速流动的蓝色数据链,背景是夕阳下的拟人化动物大都市。
  • 配色风格:深邃的警署蓝(#003366)与辉煌的防御金(#FFCC00),形成高对比度的专业感与成就感。
  • 文字呈现:标题“立体防御”以立体3D字效悬浮在全息盾牌中心;关键指标“Security Score: 100%”显示在嵌格的操作屏上。
场景 B:展示“多维协同作战” (流程/团队协作页)
  • 核心视觉意图:体现不同角色的默契配合与高效响应。
  • 分镜画面:采用 三格连环阶梯型 (Staggered Layout)
    • 第一格 (左上,窄长格):狮子市政官在办公室内,对着通讯器下达指令,表情威严。
    • 第二格 (中央,大方格):灰兔在繁华街头灵活跳跃,手持扫描设备追踪信号,动作极具动感(动作流线)。
    • 第三格 (右下,横长格):红狐狸在面包车内盯着多台监视器,向灰兔打手势比个“OK”。
  • 视觉元素:城市地标、全息通信投影、速度感线条。
  • 配色风格:明快的晨间自然光,冷暖色调在各格间交替,节奏感强。
  • 文字呈现:各格底部以漫画注释框形式标注步骤,如“Step 1: 指挥调度”、“Step 2: 现场响应”。

2.5 提升提示词创意:从文字描述到视觉隐喻 (Enhancing Creativity: From Text to Metaphor)

为了让演示文稿不仅是“图像的拼凑”,而是具有灵魂的视觉叙事,应通过以下方式提升创意:

1. 拒绝对内容的平铺直叙
  • 平庸设计:讲 AI 安全时画一个锁在电脑屏幕上。
  • 创意设计:将 AI 系统表现为一座由发光齿轮、全息时钟、不断自我重组的“积木塔”,而安全防护则是围绕这座塔旋转的金色力场,主角灰兔正在塔基位置进行精密的微调。
2. 使用极具动感和戏剧性的镜头
  • 利用 斜切视角 (Slanted Angle) 展现紧张局势;利用 广角特写 (Fisheye close-up) 展现角色的极度惊奇或自信;利用 极简背景下的强阴影 (High-Contrast Lighting) 塑造威严感。
3. 跨物种与场景的超常规联动
  • 让红狐狸在拟人化大都市最偏僻的“冰原区”调查热敏数据,或者狮子市政官在类似“罗马角斗场”的大厅中举行现代化的发布会。
4. 视觉隐喻 (Visual Metaphors)
  • 概念:脆弱性物体:正在开裂的巨型水坝,水花溅在角色的鞋尖上。
  • 概念:多维协同物体:由多条发光管道汇聚而成的复杂能量中枢,每个角色负责控制一根核心管道。
  • 概念:突破瓶颈物体:灰兔奋力拉开两扇沉重的生锈铁闸门,背后射入耀眼的晨光。

2.6 输出格式

严格按照以下 Markdown 格式输出,保存到 ppt/outline/{name}.md

markdown
---
name: {演讲标题(用作目录名)}
resolution: "16:9"
image_size: 2K
style: |
  {整体风格描述,2-4 句,注入到每页提示词最前面}
characters:
  - name: {简称}
    species: {物种描述}
    appearance: {外貌特征}
    outfit: {服装与饰品}
    personality: {性格气质}
    accessories: {装备/道具}
  - name: {简称2}
    ...
---

# {演讲标题}

## Page 1

{第 1 页图像提示词,包含分镜结构、角色简称、视觉元素、配色}

## Page 2

{第 2 页图像提示词}

...

规则:

  • ## 二级标题 即页面标题,作为图像文件名,须简洁(如 Page 1封面第三章
  • 提示词内容用中文,须足够具体,能直接输入给图像生成模型
  • 每页提示词长度建议 150-400 字
  • 提示词中须明确页面标题文字的呈现方式(如:「标题以漫画印刷体出现在画面顶部横幅」「数据显示在全息屏幕上」)
  • style 字段描述全局风格,不重复写入每页提示词
  • characters 字段描述全局角色设定,脚本自动注入每页提示词,不重复写入
  • 每页提示词中使用角色简称引用角色(如"灰兔操作控制台"),无需重复完整描述

2.6 页面连续性原则

  • 相邻页面之间须有叙事连接(如:上页灰兔发现问题 → 下页灰兔展开调查)
  • 配色基调变化应有意义(危机 → 解决方案时,从暗色调切换到明亮色调)
  • 主角角色在全稿中保持一致,避免第 3 页与第 7 页的同一角色形象割裂

Step 3:生成演示文稿图像

生成 outline 文件后,必须先询问用户

outline 文件已生成完毕,保存在 ppt/outline/{name}.md。 由于图像生成耗时较长(每页约 30-120 秒),您希望:

  1. 由我调用脚本为您生成图像
  2. 您自行运行以下命令生成(推荐,可实时查看进度)
bash
python -u skills/zootopia-ppt/scripts/image_gen_ppt.py workspace/docs/outline/{name}.md --output-dir workspace/docs/slides/{name}

Wait for user feedback before deciding whether to execute. The following is a complete command reference:

默认生图脚本 (TensorsLab API)
bash
cd {项目根目录}
python -u skills/zootopia-ppt/scripts/image_gen_ppt.py workspace/docs/outline/{name}.md --output-dir workspace/docs/slides/{name}
Google gemini-3.1-flash-image-preview 专用脚本 (Gemini API)

如果您有 GEMINI_API_KEY,可以使用专门针对 Google gemini-3.1-flash-image-preview 模型优化的版本:

bash
python -u skills/zootopia-ppt/scripts/image_gen_ppt_nb.py workspace/docs/outline/{name}.md --output-dir workspace/docs/slides/{name}

参数说明:

  • --output-dir workspace/docs/slides/{name}:图像保存目录
  • --pages 3 / --pages 3-7 / --pages 1,3,5:指定生成页面(单页/范围/多页),默认生成全部
  • --dry-run:仅预览计划不生图,用于检查提示词
  • --resolution:可覆盖 frontmatter 的分辨率设置

错误处理机制:

  • 任何一页生图失败后,脚本会自动重试最多 3 次(仅对网络超时等临时错误重试,不修改提示词)
  • 3 次重试均失败:立即中止并输出 JSON 格式的错误报告(含失败页码、错误原因、已完成页面、剩余页面),供 LLM 分析原因
  • LLM 收到错误报告后,应分析原因、调整对应页面的提示词,然后使用 --pages 参数从失败页面继续生成

关于生图耗时:

  • 每页图像生成通常需要 30-120 秒,整套演示文稿可能需要较长时间
  • 生成 outline 文件后,应询问用户:是由 LLM 调用脚本生成,还是用户自行运行脚本
  • 推荐用户自行运行,可以实时看到进度并随时中断

脚本位置{workspace}/skills/zootopia-ppt/scripts/image_gen_ppt.py


完整示例

输入讲稿摘要

主题:人工智能安全技术栈 受众:企业安全负责人 结构:封面 → 背景 → 政策法规 → 技术框架(4页)→ 总结

输出 outline 示例

markdown
---
name: 人工智能安全技术栈
resolution: "16:9"
style: |
  以顶级3D动画电影风格创作漫画分镜。画风精致,色彩饱满,具有强烈的视觉冲击力。
  拟人化动物世界(Anthropomorphic animal world),皮克斯/迪士尼风格渲染,电影级布光,丰富的毛发细节。
  画面中要图文结合,文字自然融入场景(如出现在全息屏或白板上)。
characters:
  - name: 灰兔
    species: 拟人化灰色兔子
    appearance: 体型娇小,身姿矫健,拥有紫色大眼睛与灰色短毛
    outfit: 深蓝色现代警署战术制服,佩戴金色警徽
    personality: 极致乐观、正义感强、行动果断且具备极高的职业使命感
    accessories: 腰间配有高科技通讯设备、战术腰带,以及录音笔

  - name: 红狐狸
    species: 拟人化红狐狸
    appearance: 橙红色毛发,吻部及腹部为白色,眼神狡黠
    outfit: 浅绿色夏威夷风格衬衫,搭配深蓝色斜纹领带与棕色长裤
    personality: 玩世不恭、思维敏捷、深谙城市生存法则,实则内心善良且忠诚
    accessories: 随身携带用于“行骗”的各类小道具
---

# 人工智能安全技术栈

## 1-封面

### 封面:人工智能安全技术栈

* **核心视觉意图**:让观众感受到「这是一场高技术含量的安全战,主角已蓄势待发」
* **分镜画面**:漫画单页大画幅(Splash Page),大远景建立城市环境后切至中景主角。
  * 画面中央:灰兔和红狐狸身穿充满未来科技感的都市警署装备,背靠背站立,姿态沉稳自信。
  * 他们之间悬浮着一个散发蓝色光芒的全息神经网络结构(象征 AI)。
* **视觉元素**:繁华的拟人化动物大都市夜景背景,轻微赛博朋克数据流光效,四角漫画速度线装饰。
* **配色风格**:科技蓝与警署金交织,深夜背景映衬亮色主角,充满力量感。
* **文字呈现**:画面顶部一条金色宽横幅,以粗体印刷漫画字体显示「人工智能安全技术栈」;副标题「AI Security」以细体出现在横幅下方。
* **角色情感表达**:灰兔眼神坚定望向画外,嘴角微扬;红狐狸侧目,一副胸有成竹的神情。

## 2-背景

### 背景:AI 安全威胁全景

* **核心视觉意图**:让观众感受到「危险已渗入城市每个角落,局势比想象的更严峻」
* **分镜画面**:三格横向漫画,从全景→特写→俯瞰的镜头递进制造压迫感。
  * 第一格(中景):灰兔站在高科技指挥中心的巨型全息地图前,地图上散落着城市各处的红色警报点,她单手指向其中一处密集区域。
  * 第二格(平视特写):红狐狸的面部特写,眉头深锁,眼中倒映出滚动的危险数据,背景是快速闪烁的警报界面。
  * 第三格(俯角大远景):俯瞰拟人化动物大都市全景,多个建筑物散发出不稳定的红色警戒光雾,蔓延感强烈。
* **视觉元素**:高科技指挥中心蓝紫色环境光,全息屏幕,断裂的锁链图标(象征现有防护失效)。
* **配色风格**:冷峻科技蓝紫为主,红色警戒光芒点缀,营造紧迫与忧虑并存的氛围。
* **文字呈现**:第一格全息地图顶部显示标题「AI 安全威胁全景」;第三格俯瞰图右下角有一个警报计数器「Threat Index: 94↑」以红色显示在界面边框上。
* **角色情感表达**:灰兔神情凝重但专注,不是恐惧而是分析性的警觉。
* **象征性元素**:地图上蔓延的红点代表威胁扩散速度;第二格背景的断裂锁链暗示传统安全手段已不够用。

常见错误与注意事项

错误正确做法
每页重复写相同的风格说明风格说明放在 style 字段,提示词聚焦构图与内容
提示词过于抽象("一幅美丽的城市图")必须具体:角色、动作、道具、分镜格数、配色
页面标题过长二级标题作为文件名,保持简洁(≤ 20 字)
忽略情节连续性相邻页面的角色状态与叙事须有逻辑衔接
文字孤立悬浮在画面中文字须融入场景:标题放入横幅/标牌,数据放入全息屏/白板,关键词嵌入漫画对话框或印章
跳过核心视觉意图,直接写构图必须先定「这页让观众感受到什么」,再选镜头和角色
所有页面用同一个镜头距离(总是中景)根据情感需要切换:高潮用特写,宏观用俯瞰
抽象概念只靠文字描述("展示风险")用具体可见物体象征抽象概念,参考象征性元素表
角色永远表情相同情感关键页必须明确角色表情和肢体语言

Bundled files

The model reads these on demand while the skill is loaded. They are exposed as readable files and are never executed.

Frequently asked questions

What does the Zootopia Ppt AI skill do?

将用户的演示讲稿转化为拟人化动物世界主题的演示文稿图像(顶级3D动画电影风格)。 分三步:① 理解演讲内容与受众 ② 生成每页的3D动画电影风格生图提示词(Markdown 格式,保存到 workspace/docs/outline/) ③ 调用 image_gen_ppt.py 批量生成图像(保存到 workspace/docs/slides/)。 触发条件:用户提供演示稿/PPT 内容,要求制作 疯狂动物城风格 / 拟人化动物 / 3D动画电影风格的图像或演示文稿。

Why use Zootopia Ppt on TypingMind?

Because you install it once and use it with any model. Zootopia Ppt is plain Markdown rather than provider-specific code, so the same skill runs on GPT-5, Claude, Gemini, Grok, or a local model — and you can switch model mid-chat without it breaking. TypingMind runs on your own API keys, so you pay providers directly instead of a per-seat subscription, and your skills and chats stay in your own storage.

How do I install Zootopia Ppt in TypingMind?

Open Plugins → Skills → Install from GitHub in TypingMind and paste https://github.com/jin-bo/agentao/tree/main/examples/skills/zootopia-ppt. TypingMind reads its SKILL.md and bundles its files and installs it as a skill you can enable per chat.

Which AI models can use Zootopia Ppt?

Any model you connect in TypingMind. AI skills are plain Markdown instructions rather than provider-specific code, so GPT, Claude, Gemini, Grok, and local models can all load this skill when a request matches it.

How many AI models can I use with Zootopia Ppt?

As many as you like. As long as a model supports skills, you can use Zootopia Ppt with it — GPT, Claude, Gemini, Grok, DeepSeek, Mistral, Llama and more — all on TypingMind with your own API keys.

Is the Zootopia Ppt AI skill free?

Yes. It is published on GitHub by jin-bo under the MIT license. You only pay your own AI provider for the tokens you use.

What are AI skills?

An AI skill is a reusable instruction bundle that teaches an AI model how to do one specific task. It follows the open Agent Skills format: a SKILL.md file with a name and description, plus any scripts, templates or reference files the model may need. The model reads the instructions only when your request matches the skill, so an installed skill costs nothing until it is used.

How are AI skills different from plugins or MCP servers?

A plugin or MCP server gives a model new tools to call — code that runs somewhere and returns a result. An AI skill gives the model knowledge and process instead: how to approach a task, which steps to follow, what good output looks like. Skills are plain Markdown, so they need no server, no API key and no runtime, and they work with any model.

View all

Set up your own AI workspace now

Get notified about new features and future giveaways by subscribing to our newsletter 👇