GPT-only: озвучивает текст и документы выразительным голосом и собирает проверенный MP3; подходит для чтения вслух, аудиокниг и озвучки. Требует GPT browser control и FFmpeg/FFprobe, не нативен для OpenClaw; Android ChatGPT требует отдельного импорта ZIP.

Install

openclaw skills install @ciklopentan/text-to-audio-gpt

Озвучивание текста

Создавай готовый аудиофайл из текста пользователя и проверяй его перед выдачей. Сохраняй содержание, порядок, абзацы и пунктуацию; не пересказывай и не сокращай исходник.

Выбор способа и конфиденциальность

  1. Сначала проверь доступные встроенные средства синтеза речи. Если подходящего нет, найди текущие варианты TTS поиском, затем используй браузерный интерфейс. Перед браузерной работой прочитай навык control-browser и следуй его правилам.
  2. Текст из чата можно передавать выбранному сервису только в объёме, необходимом для озвучивания. Не отправляй пароли, ключи, личные данные или конфиденциальные материалы без явного разрешения; для них предпочти локальный синтез либо сначала уточни разрешение.
  3. Не обходи CAPTCHA, блокировки, гостевые квоты и платные ограничения. Не создавай аккаунты, не принимай юридически обязательные условия и не покупай тариф без разрешения пользователя. При сбое выясни причину и смени подход; не повторяй одинаковую неудачную попытку.
  4. В окне приватности выбирай минимальную обработку данных: не нажимай «Accept all», отключай необязательное согласие, если интерфейс позволяет, и не утверждай, что отключена обработка на основании legitimate interest, если это не проверено.

Подготовка и синтез

  1. Определи язык, желаемый голос, подачу, формат и наличие исходного файла. Если пользователь не уточнил стиль, выбери естественный нейтрально-выразительный голос и не задерживай работу необязательными вопросами. Для одного файла используй один голос и одинаковые настройки во всех сегментах.
  2. Проверь действующий лимит сервиса и способ подсчёта символов по текущему счётчику. Разбей текст ниже лимита на границах абзацев и законченных предложений; если это невозможно — на границе слов, затем на ближайшей безопасной позиции. Сохрани пробелы и переносы строк. Проверь, что конкатенация сегментов точно равна исходному тексту и каждый сегмент не превышает лимит.
  3. Генерируй сегменты по одному. Перед нажатием преобразования зафиксируй текущую ссылку/состояние результата. Дождись окончания обработки и проверь, что появился новый плеер или ссылка с новым аудио. Не нажимай повторно, пока не выяснено состояние предыдущей операции.
  4. Скачивай каждый готовый сегмент один раз, сразу переименовывай в part-01.mp3, part-02.mp3 и далее. Если событие скачивания не подтвердилось, сначала проверь папку загрузок и список файлов: провайдер мог сохранить результат несмотря на задержку браузера.
  5. Используй подходящий формат вывода. Для выразительности предпочитай качественный нейронный голос; скорость слегка снижай только если это улучшает разборчивость, и применяй настройку одинаково ко всем частям. Не переписывай текст ради интонации без просьбы пользователя.

Проверенный русский вариант

На 24.09.2026 страница TTSFree для русского показывала русские голоса AI-2 Dmitry и Svetlana, MP3-выгрузку и лимит 500 символов на конвертацию. На тексте длиной 4 757 символов 11 последовательных гостевых конвертаций успешно создали 11 файлов одним голосом. Это проверка интерфейса в конкретную дату, а не гарантия будущих лимитов или доступности: перед каждой работой перепроверь страницу и статус генерации.

Известные сбои из этой сессии: TTSVerse сообщил об отсутствующем Azure API key, TTSDesk не сгенерировал ни один из двух тестов, а Qwen исчерпал гостевую квоту после первого сегмента. Не используй эти маршруты повторно без подтверждения, что причина устранена. Короткая запись, явно не соответствующая объёму текста, может быть усечена: один тест TeraTTS дал около 25 секунд на текст длиной примерно 2 259 символов. Всегда сверяй длительность и число сегментов с ожидаемым объёмом.

Где навык доступен и что считать установкой

Публикация версии на ClawHub, установка в OpenClaw, доступность в Codex и импорт в ChatGPT — отдельные состояния. ClawHub — публичный реестр OpenClaw; публикация не добавляет навык автоматически в ChatGPT или Codex. Команда clawhub install устанавливает его в рабочую папку OpenClaw, а не в навыки ChatGPT.

Для ChatGPT подготовь ZIP с одной верхней папкой навыка и импортируй его через Plugins → Skills → Create → Upload from your computer. Дождись проверки загруженного пакета и проверь, что он отображается в каталоге навыков ChatGPT. Если нужен Android, отдельно проверь список Навыки в приложении под тем же аккаунтом: справка OpenAI предупреждает, что доступность, установка и синхронизация могут отличаться между продуктами и интерфейсами. Не называй навык установленным на платформе только потому, что он опубликован на ClawHub, виден в Codex или находится в ZIP.

При сообщении о результате называй каждую платформу отдельно и указывай, где установка действительно подтверждена. Если целевой список не проверен, говори «пакет подготовлен» или «версия опубликована», а не «установлено».

Сборка и контроль результата

  1. Для MP3-сегментов используй scripts/merge_audio.py. Передай файлы в исходном порядке; имена с нумерацией 01, 02 и т. д. упрощают сортировку:

    bash
    python3 scripts/merge_audio.py full-audio.mp3 part-01.mp3 part-02.mp3 part-03.mp3
    
  2. Скрипт проверяет, что входы являются читаемыми MP3 с совместимыми параметрами, объединяет их без перекодирования, проверяет длительность и полностью декодирует результат. Если параметры не совпадают, нормализуй фрагменты одним форматом через FFmpeg или выбери единый формат в TTS и собери заново.

  3. Убедись, что все сегменты на месте, порядок верный, суммарный текст сохранён, итоговые формат и длительность правдоподобны, а декодирование прошло без ошибок. При доступном распознавании речи используй его выборочно для контроля начала, стыков и конца; не называй проверку полной, если сравнивал только выборку.

  4. Сохрани итоговый файл в Library, если она доступна, и выдай прямую ссылку. Кратко укажи голос, формат, длительность и существенное ограничение, если оно осталось.