OpenClaw—电影剧本生成器Skill

前边我们尝试了OpenClaw的本地编程模型、远程控制、桌面精灵,今天我们尝试它的一个新能力:Skills。

一、概述

1. 为什么需要Skills

OpenClaw配备强大的Claude opus 4.6模型,能力非常强大,啥都能干,但是你让它干活的时候吧,又觉得它对你想做的事的细节不了解,你得手把手的教它、持续纠正它,最终它才能做出来你心里想要的那个效果,而不是一次就做出来你满意的结果,这是因为它对一些特定工作的细节不了解导致的,根本原因是大模型的通用知识很强,而专项操作能力很弱。

为了避免我们在不同的设备上都要教一遍它,OpenClaw设计了Skills机制,我们可以通过Skills定制各种各样的专有技能,就像一个操作手册,提前告诉它这类事情应该怎么做,具体的细节要求、约束条件、输出格式等,它加载了这个预置的Skill后,就可以在你对他提出工作任务时,直接一次做出你想要的那个效果,而不是反反复复的从头纠正他。

2. Skills如何定义

2.1 Skill目录结构
skills/
└── my-skill/
    ├── SKILL.md          # 必需:YAML 元数据 + Markdown 操作指南
    ├── bins/             # 可选:可执行文件(自动加入 PATH)
    ├── references/       # 可选:参考文档
    ├── scripts/          # 可选:辅助脚本(Python、Bash、JS 等)
    └── skill.json        # 可选:旧版元数据格式

整个 Skill 里,只有 SKILL.md 是必须的,其它都是锦上添花的可选项。

2.2 SKILL.md

必填字段:

  • name:技能名称,最长 64 个字符,必须和目录名一致
  • description:技能描述,这是最关键的字段——AI 就是根据这段描述来判断什么时候该用这个技能

可选但实用的字段:

  • requires.bins:运行这个技能需要哪些命令行工具
  • requires.env:需要哪些环境变量(比如 API Key)
  • install:如何一键安装所需依赖
  • os:支持的操作系统

Markdown 正文: 就是用自然语言写的操作指南,告诉 AI “第一步做什么、第二步做什么、遇到什么情况怎么处理”。

3. Skills执行机制

3.1 Skills加载位置

OpenClaw 启动时会从四个位置扫描 Skills,按优先级从高到低排列:

优先级 位置 作用范围
最高 <工作区>/skills 仅当前 Agent
~/.openclaw/skills 本机所有 Agent 共享
内置(随安装包附带) 默认可用
skills.load.extraDirs 配置 自定义共享目录

当出现同名 Skill 时,高优先级的会覆盖低优先级的。这意味着你可以在工作区目录放一个同名 Skill 来覆盖内置版本,实现”定制化”。

3.2 skill完整性检查

扫描到一个 SKILL.md 后,OpenClaw 会根据 requires 字段做一系列检查:

  • bins:指定的命令行工具是否都装了?(比如 ffmpeguv
  • env:必需的环境变量是否已设置?(比如 GEMINI_API_KEY
  • config:OpenClaw 配置中是否满足条件?(比如 browser.enabled
  • os:当前操作系统是否在支持列表中?

只有所有条件都满足的 Skill 才会被标记为”可用”。这避免了 Agent 试图使用一个根本跑不起来的技能。

3.3 渐进式加载,节省token

这是 OpenClaw Skill 系统最精妙的设计之一。它不会一股脑把所有 Skill 的完整内容塞进 AI 的上下文窗口,而是采用三级渐进式加载:

第一级——名片(约 24 个 token/Skill): 只把 Skill 的名称、描述和文件位置以 XML 标签的形式注入系统提示词。50 个 Skill 加在一起也才约 1,200 个 token——非常经济。

第二级——完整说明书(按需加载): 当 AI 判断某个 Skill 跟当前任务相关时,它会主动调用 read 工具读取完整的 SKILL.md 内容。

第三级——深度资源(需要时才加载): 参考文档、辅助脚本等只在执行具体子任务时才会被读取。

系统提示词里会明确告诉 AI 这样的策略指引:”先扫描可用技能列表。如果恰好有一个技能明显适用,读取它的 SKILL.md。如果有多个可能适用,选最具体的那个。如果都不适用,不要读取任何 SKILL.md。”

这种设计相比 MCP 等方案动辄把所有工具 Schema 全量注入的做法,token 效率高出一个数量级。

3.4 自主决策调用

当 AI 读取了 SKILL.md 的完整内容后,它就像一个学会了新技能的人,按照说明书上的步骤一步步执行:调用相应的命令行工具、运行脚本、处理结果、回复用户。

整个过程通过 OpenClaw 的 Agentic Loop(代理循环)驱动:模型提出工具调用 → 执行 → 结果回填 → 继续推理 → 直到任务完成。

3.5 热重载,即改即用

OpenClaw 默认开启了文件监听器(debounce 250ms),实时监控 Skill 目录的变化。你修改了一个 SKILL.md,不需要重启 Agent——下一轮对话就会自动使用新版本。

二、Skill编写

我们这里以生成电影剧本为例,说明如何自定义一个Skill技能。

1. 电影剧本生成Skill

1.1 SKILL.md
vim ~/.openclaw/workspace/skills/ai-video-script/SKILL.md

---
name: ai-video-script
description: AI视频脚本生成器。根据用户输入的主题/关键词,生成完整的电影或短视频脚本/剧本,包含分镜描述、画面提示词、配音文案。适用于短视频创作者、AI视频制作者、内容营销人员。触发词:电影剧本、视频脚本、短视频剧本、分镜、AI视频、短视频文案、视频策划。
---

# AI 视频脚本生成器

快速生成 AI 视频脚本的工具,包含分镜、提示词、配音文案。

## 快速开始

### 基本用法

```
输入:主题或关键词
输出:完整视频脚本
```

### 脚本结构

每个脚本包含:

1. **视频概述**
   - 标题
   - 时长
   - 风格定位
   - 目标受众

2. **分镜表**
   - 场次
   - 画面描述
   - 镜头运动
   - 时长

3. **画面提示词**
   - AI 绘画/视频提示词
   - 适配主流工具(CogVideoX、Midjourney、SD)

4. **配音文案**
   - 旁白文本
   - 字幕文本
   - 情绪标注

## 脚本模板

### 短视频(15-60秒)

```markdown
# [标题]

## 概述
- 时长:30秒
- 风格:轻松/专业/故事性
- 目标:引起共鸣/传递知识/带货

## 分镜表

### 场次1(0-5秒)
- **画面**:[具体描述]
- **镜头**:特写/中景/远景,推/拉/摇/移
- **提示词**:[AI生成提示词]
- **配音**:[文案]
- **字幕**:[显示文字]

### 场次2(5-15秒)
...

## 完整提示词列表

1. 场次1提示词:...
2. 场次2提示词:...

## 配音脚本

[完整旁白文案]
```

### 长视频(1-5分钟)

结构同上,但分镜更详细,场次更多。

## 生成流程

1. **理解需求**
   - 主题/产品/故事
   - 目标受众
   - 视频风格
   - 时长要求

2. **规划结构**
   - 开头(吸引注意)
   - 中间(核心内容)
   - 结尾(行动号召)

3. **生成分镜**
   - 每个镜头的目的
   - 画面构图
   - 镜头运动

4. **撰写提示词**
   - 考虑 AI 工具特性
   - 包含风格、光影、构图
   - 中英文对照

5. **编写文案**
   - 口语化
   - 节奏感
   - 情绪引导

## 提示词规范

### CogVideoX 格式

```
[主体动作], [场景环境], [镜头运动], [风格], [画质]

示例:
A young woman walking on the beach at sunset, golden hour lighting, 
slow motion, cinematic style, 4K quality
```

### Midjourney 格式

```
[主体], [动作/状态], [场景], [光影], [风格], --ar 16:9

示例:
Young woman, walking peacefully, beach at sunset, golden hour, 
cinematic style --ar 16:9
```

## 示例

### 示例1:产品介绍(30秒)

```markdown
# 智能水杯介绍

## 概述
- 时长:30秒
- 风格:科技感、简洁
- 目标:突出产品特点,引起购买欲

## 分镜表

### 场次1(0-3秒):开篇
- **画面**:水杯特写,光影流动
- **镜头**:缓慢推进
- **提示词**:Smart water bottle on wooden table, soft natural lighting, 
  product photography, minimalist background --ar 16:9
- **配音**:还在为忘记喝水烦恼吗?
- **字幕**:智能水杯

### 场次2(3-10秒):功能展示
- **画面**:水杯LED屏幕亮起,显示温度
- **镜头**:侧面特写
- **提示词**:Close-up of water bottle LED display showing temperature, 
  blue glow, high tech aesthetic --ar 16:9
- **配音**:智能温显,24小时保温,让每一口水都是最佳温度。
- **字幕**:智能温显 | 24H保温

### 场次3(10-20秒):使用场景
- **画面**:办公桌、健身房、户外场景快切
- **镜头**:快速切换
- **提示词**:Multiple scenes: office desk, gym, outdoor hiking, 
  water bottle in each scene, lifestyle photography --ar 16:9
- **配音**:无论办公、健身还是户外,它都是你的贴心伙伴。
- **字幕**:办公 | 健身 | 户外

### 场次4(20-30秒):结尾
- **画面**:水杯与手机APP联动
- **镜头**:特写 + 拉远
- **提示词**:Water bottle and smartphone showing app interface, 
  connection notification, modern tech style --ar 16:9
- **配音**:智能提醒,健康生活从一杯水开始。点击下方链接了解详情。
- **字幕**:智能提醒 | 健康生活 | [品牌LOGO]
```

### 示例2:知识科普(60秒)

```markdown
# 为什么人会做梦?

## 概述
- 时长:60秒
- 风格:科普、有趣
- 目标:传递知识,引起兴趣

## 分镜表

### 场次1(0-5秒):引入
- **画面**:夜晚城市,窗户里的灯光熄灭
- **镜头**:航拍俯视
- **提示词**:City skyline at night, lights turning off one by one, 
  peaceful atmosphere, aerial shot --ar 16:9
- **配音**:每晚,我们都会进入一个神奇的世界...
- **字幕**:我们为什么会做梦?

### 场次2(5-20秒):科学解释
- **画面**:大脑3D模型,神经元活动
- **镜头**:微观视角,快速剪辑
- **提示词**:3D brain model, neurons firing, blue and purple lights, 
  scientific visualization --ar 16:9
- **配音**:当我们睡眠时,大脑并没有休息。在REM快速眼动期,神经元活跃度甚至超过清醒时。
- **字幕**:REM快速眼动期 | 大脑在"加班"

### 场次3(20-40秒):梦境功能
- **画面**:记忆整理、情绪处理的视觉化表现
- **镜头**:抽象动画
- **提示词**:Abstract visualization of memory consolidation, 
  emotions being processed, colorful particles flowing --ar 16:9
- **配音**:科学家认为,做梦帮助我们整理记忆、处理情绪,甚至解决白天的问题。
- **字幕**:整理记忆 | 处理情绪 | 灵感来源

### 场次4(40-60秒):结尾
- **画面**:日出,人醒来
- **镜头**:延时摄影
- **提示词**:Sunrise through window, person waking up peacefully, 
  warm golden light, timelapse --ar 16:9
- **配音**:所以下次做梦时,也许是你的大脑在帮你成长。关注我,了解更多有趣知识。
- **字幕**:梦是大脑的成长时间 | 关注我
```

## 高级功能

### 批量生成

一次生成多个脚本变体:

```
输入:主题 + 多个角度/风格
输出:3-5个不同版本的脚本
```

### 风格定制

预设风格:
- **商业**:专业、权威、产品导向
- **故事**:情感、冲突、转折
- **教育**:清晰、逻辑、知识点
- **娱乐**:轻松、有趣、网感

### 时长优化

根据平台调整:
- **抖音/快手**:15-60秒
- **B站/YouTube**:3-10分钟
- **微信视频号**:30秒-3分钟

## 注意事项

1. **版权意识**
   - 提示词原创
   - 避免侵权元素

2. **平台规范**
   - 符合平台内容要求
   - 注意敏感词

3. **实用性**
   - 脚本可执行
   - 提示词可用
   - 文案自然

---

_让视频创作更高效_
1.2 test.md
vim ~/.openclaw/workspace/skills/ai-video-script/test.md

---
name: ai-video-script
description: AI视频脚本生成器。根据用户输入的主题/关键词,生成完整的视频脚本,包含分镜描述、画面提示词、配音文案。适用于短视频创作者、AI视频制作者、内容营销人员。触发词:视频脚本、分镜、AI视频、短视频文案、视频策划。
---

# 测试:AI视频脚本生成器

## 测试案例1:产品介绍

**输入**:帮我生成一个智能手表的30秒视频脚本

**预期输出**:包含分镜、提示词、文案的完整脚本

---

## 实际测试

智能手表 - 30秒产品介绍脚本:

```markdown
# 智能手表 - 你的健康管家

## 概述
- 时长:30秒
- 风格:科技、时尚、生活化
- 目标:突出健康监测功能,引起购买欲

## 分镜表

### 场次1(0-5秒):开篇
- **画面**:智能手表特写,屏幕亮起
- **镜头**:微距特写,缓慢推进
- **提示词**:Smart watch close-up, screen lighting up, blue glow, 
  product photography, minimalist background --ar 16:9
- **配音**:你的健康,值得更好的守护。
- **字幕**:智能手表

### 场次2(5-15秒):功能展示
- **画面**:分屏展示心率、血氧、睡眠监测界面
- **镜头**:快速切换
- **提示词**:Split screen showing heart rate, blood oxygen, sleep monitoring 
  interfaces, clean UI design, tech aesthetic --ar 16:9
- **配音**:24小时心率监测,血氧追踪,睡眠分析。每一项数据,都是你健康的晴雨表。
- **字幕**:心率监测 | 血氧追踪 | 睡眠分析

### 场次3(15-25秒):使用场景
- **画面**:跑步、办公、睡觉三个场景快切
- **镜头**:跟拍 + 定格
- **提示词**:Multiple scenes: person running outdoors, working at office, 
  sleeping peacefully, wearing smart watch, lifestyle photography --ar 16:9
- **配音**:运动时、工作时、休息时。它始终陪伴,记录你的每一步成长。
- **字幕**:全天候守护

### 场次4(25-30秒):结尾
- **画面**:手表与手机同步数据,显示健康报告
- **镜头**:特写 + 拉远展示品牌
- **提示词**:Smart watch syncing with smartphone, health report on screen, 
  modern tech style, lifestyle setting --ar 16:9
- **配音**:智能手表,让健康管理更简单。点击下方链接,开启你的健康之旅。
- **字幕**:智能手表 | [品牌LOGO] | 立即了解
```

## 测试结果

✅ 脚本结构完整
✅ 分镜清晰
✅ 提示词可用
✅ 文案流畅
✅ 符合30秒时长

---

## 价值评估

这个 Skills 可以帮助:
- 短视频创作者快速产出脚本
- AI 视频制作者获得可用提示词
- 营销人员批量生产内容

**变现潜力**:
- 定价:¥47/月(约 1.5 元/次)
- 目标用户:短视频创作者、AI 视频制作者
- 月销 30 份 = ¥1,410,我分 30% = ¥423 ✅

---

_测试通过,准备发布_

 

三、Skill验证

1. 发布任务

帮我生成一个短视频剧本,用于推广Openclaw桌面精灵产品Fairy花仙子,它是一个跨平台 OpenClaw 互动桌宠 Fairy,为桌面增添乐趣!

具体视频介绍内容如下(请自行重新组织):

我特别希望在自己的Mac设备上能使用一款可爱的精灵与OpenClaw进行互动,于是我决定开发一个适配 OpenClaw 的桌面精灵。

我在给这个精灵添加了多个不同类型的卡通形象,同时它不仅支持 macOS,还兼容 Windows 和 Linux,让更多的用户都能与这只可爱的精灵互动!

2. 生成的剧本

# OpenClaw Fairy 花仙子 - 桌面精灵推广视频脚本

## 概述
- 时长:约60秒
- 风格:可爱、温暖、科技感、治愈系
- 目标:展示Fairy桌面精灵的互动魅力,吸引用户下载体验
- BGM建议:轻快治愈的电子音乐,带一点魔法感的音效点缀

---

## 分镜表

### 场次1(0-5秒):悬念开场
- **画面**:空荡荡的桌面,鼠标轻轻移动,突然一个可爱的花仙子精灵从屏幕角落蹦出来,眨眨眼
- **镜头**:屏幕录制,聚焦桌面右下角,精灵弹出瞬间加轻微缩放
- **提示词**:Clean macOS desktop, a cute fairy character popping up from corner with sparkle effects, kawaii style, screen recording aesthetic, soft pastel colors --ar 16:9
- **配音**:你的桌面,是不是太安静了?
- **字幕**:🌸 你的桌面,缺一个她
- **音效**:✨ 魔法出现音

### 场次2(5-15秒):身份揭晓
- **画面**:OpenClaw Logo 浮现,光效过渡到 Fairy 花仙子的多个精灵形象依次登场
- **镜头**:快切蒙太奇,每个形象停留1-2秒
- **提示词**:Montage of cute desktop pet characters, multiple fairy designs, pixel art meets modern illustration, colorful character lineup, playful animation style --ar 16:9
- **配音**:她叫 Fairy,一只搭载 OpenClaw AI 的桌面花仙子。可爱,聪明,还会陪你聊天。
- **字幕**:OpenClaw Fairy 🧚 你的桌面花仙子

### 场次3(15-30秒):核心功能 - AI对话
- **画面**:用户点击精灵,弹出对话气泡,精灵做出各种可爱的回应动作——思考、开心、惊讶
- **镜头**:屏幕录制特写,对话过程实录,精灵表情变化
- **提示词**:Desktop fairy pet chatting with user, speech bubbles, cute expressions changing, AI conversation interface, warm and cozy desktop environment --ar 16:9
- **配音**:她不只是好看。点击她,和她聊天,她背后是 OpenClaw 的AI大脑。问她问题、让她帮忙,她都会认真回答——还会卖个萌。
- **字幕**:内置 OpenClaw AI 对话 💬
- **音效**:对话气泡弹出音

### 场次4(30-40秒):多形象展示
- **画面**:切换不同的精灵形象——花仙子、猫咪、小幽灵等,每个形象在桌面上做不同的待机动作
- **镜头**:画中画或分屏展示,流畅切换
- **提示词**:Multiple desktop pet characters side by side, fairy, cat, ghost, each with unique idle animations, cute character design showcase, colorful and lively --ar 16:9
- **配音**:多款精灵形象,总有一个是你的心头好。
- **字幕**:丰富的精灵形象 🎭

### 场次5(40-50秒):跨平台展示
- **画面**:同一个精灵分别出现在 macOS、Windows、Linux 三个系统桌面上,三屏并排
- **镜头**:三分屏同步展示,底部显示系统图标
- **提示词**:Three screens showing macOS, Windows, Linux desktops side by side, same cute fairy pet on each, cross-platform demonstration, clean modern setup --ar 16:9
- **配音**:macOS、Windows、Linux 全平台支持。不管你用什么电脑,她都能陪着你。
- **字幕**:🍎 macOS | 🪟 Windows | 🐧 Linux

### 场次6(50-60秒):温暖收尾
- **画面**:夜晚的桌面,灯光调暗,精灵在屏幕角落安静地待机,偶尔眨眨眼,像在陪伴用户
- **镜头**:缓慢拉远,从精灵特写到整个桌面全景,最后叠加项目名称和下载链接
- **提示词**:Cozy night desktop scene, dim ambient lighting, cute fairy pet sitting quietly in corner, blinking softly, warm companionship feeling, peaceful atmosphere --ar 16:9
- **配音**:代码写累了,抬头看看她。Fairy,你桌面上最可爱的陪伴。
- **字幕**:OpenClaw Fairy 🌸|GitHub 开源,免费下载
- **音效**:温柔的结束音 + ✨

---

## 文案备选(用于视频简介/评论区置顶)

> 🌸 Fairy — 基于 OpenClaw 的跨平台桌面精灵
> 
> 灵感来自 OpenClaw + Desktop-elf,融合AI对话能力,多款可爱精灵形象,支持 macOS / Windows / Linux。
> 
> 让你的桌面不再孤单~
> 
> 🔗 GitHub: [项目链接]
> ⭐ 开源免费,欢迎 Star!

 

3.生成的视频

 

 

yan 3.8

 

参考:

深入解析 OpenClaw 的 Skills 扩展系统:AI Agent 如何学会”自我进化”

https://clawhub.ai/aguo333/ai-video-script

发表评论

您的电子邮箱地址不会被公开。