Install
openclaw skills install @hyldmh/video-to-screenplayTurn video/audio transcripts into original screenplays. Faster-whisper → LLM story DNA → screenplay (.md + .fountain). Supports 6 LLM providers and CPU/GPU.
openclaw skills install @hyldmh/video-to-screenplayTurn video/audio/transcript files into original screenplays via a two-stage LLM pipeline.
transcribe_to_srt.pyweb_fetch + LLMpip install faster-whisper)openclaw.json (deepseek, kimi, zhipu, longcat, google, or agnes)# From existing SRT
python scripts/video_to_screenplay.py --srt input.srt --out-dir ./output
# From audio/video (auto-transcribe first)
python scripts/video_to_screenplay.py --audio input.mp3 --out-dir ./output
# Specify genre and length
python scripts/video_to_screenplay.py --srt input.srt --out-dir ./output --target-minutes 15 --genre "科幻"
# Use GPU for transcription
python scripts/video_to_screenplay.py --audio input.mp3 --out-dir ./output --device cuda --compute-type float16
# Use a different LLM provider
python scripts/video_to_screenplay.py --srt input.srt --out-dir ./output --provider kimi --model kimi-k3
# Extract story DNA only (no screenplay)
python scripts/video_to_screenplay.py --srt input.srt --out-dir ./output --extract-only
transcript.txt — plain text transcriptstory_dna.json — extracted story elements (themes, characters, conflicts, motifs)screenplay.md — human-readable screenplayscreenplay.fountain — Fountain format for screenwriting software import| Provider | Default Model | Notes |
|---|---|---|
| deepseek | deepseek-v4-flash | Default, fast |
| kimi | kimi-k3 | temperature auto-set to 1.0 |
| zhipu | glm-5.2 | 1M context |
| longcat | LongCat-2.0 | Reasoning model |
| gemini-2.0-flash | Multimodal | |
| agnes | agnes-2.0-flash | Free tier available |