Subtitle StudioUser guide · 0.6.1 Alpha

0.6.1 Alpha · Windows

Subtitle Studio guide Инструкция Subtitle Studio

Install the local runtimes, configure models, process audio or video, and finish the result in the built-in SRT editor. Установите локальные среды, настройте модели, обработайте аудио или видео и доведите результат во встроенном редакторе SRT.

Before installation

Windows x64The application and local AI runtime are built for 64-bit Windows.
Internet requiredThe compact setup downloads pinned .NET, Python, PyTorch, and selected models.
Transcription modelsAllow about 6.5 GB for the recommended ASR and timing models.
Translation modelAllow about 8.1 GB when the optional local translator is selected.
Alpha release. Keep the original media and review generated timings and text before delivery.

Installation

  1. Run SubtitleStudio_Alpha_Setup_v0.6.1.exe.
  2. Choose one installation folder. The default is %LOCALAPPDATA%\Programs\FruitFake\Subtitle Studio.
  3. Select the optional Qwen model sets you need. Transcription requires an ASR model; accurate cue timing uses the Forced Aligner; translation also requires the text model.
  4. Wait for setup to download and verify all required components. Do not close the installer while runtime or model progress is active.
  5. Launch Subtitle Studio from the Start menu or desktop shortcut.
No global runtime changes. App-local .NET is stored in Runtime\dotnet, the AI environment in Runtime\qwen-env, and optional models in Models\Qwen. System PATH is not changed.

First launch

  1. Choose EN or RU in the top bar.
  2. Open Models and system and click Verify system.
  3. Select the ASR model and, when available, the Forced Aligner. Select a translation model only for translated output.
  4. Confirm the output folder. Generated SRT files will be written there.

The runtime chip at the top reports whether the local backend is ready. Raw diagnostics are available in Processing log.

Basic workflow

  1. Add audio or video with the button, or drag files into the window.
  2. Choose a source language for the queue or for each file. Use Auto-detect when the language is unknown.
  3. Choose Transcript SRT only, Translation SRT only, or Transcript + translation. Translation modes also require a target language and translator model.
  4. Optionally select a TXT context/glossary and set the subtitle limits for characters per line, maximum lines, and cue duration.
  5. Click Run queue to process all waiting files. To process only a timeline selection, set the range and click Transcribe range.
  6. Open the finished document in the editor, review it, and save the final SRT.
Different ranges of the same media can use different source languages. Their cues are merged into the same time-sorted subtitle document.

Subtitle editor

  • Edit Start, End, and Text directly in the cue table.
  • Use and to add or remove cues, and the arrow buttons to change their order.
  • Use ▶ Cue or press Space outside a text field to preview the selected range.
  • Press Delete outside a text field to remove selected cues.
  • Save writes the current document; Save as… creates a separate SRT.

The status line reports overlaps, invalid timecodes, empty cues, and unsaved changes. Resolve errors before the final save.

Models and contexts

Models

Open Models and system to select or register local ASR, Forced Aligner, and translation model folders. Verify system checks the Python worker and selected model paths.

Contexts and glossaries

Place UTF-8 .txt files in the application Contexts folder. Refresh the list, then select the context before starting a job. Use it for names, terminology, teams, products, or other spellings the model should prefer.

Update and uninstall

Run a newer setup over the same folder to update or repair the installation. Valid existing runtime files are verified and reused instead of being downloaded again.

Uninstall removes installer-owned application and runtime files. Models, settings, drafts, subtitle outputs, and other user data are preserved.

Troubleshooting

  • Runtime is not ready: open Models and system, run Verify system, then repair with the same setup if required.
  • A model is missing: install it with setup or add its existing folder through Manage models….
  • Download failed: check internet access, free disk space, and access to Microsoft, Python, PyPI, and Hugging Face, then rerun setup.
  • No subtitles were created: confirm the file has an audio stream, verify the selected range, and inspect Processing log.
  • Processing failed: expand Processing log and use Open logs for the complete diagnostic file.

Перед установкой

Windows x64Приложение и локальная AI-среда собраны для 64-битной Windows.
Нужен интернетКомпактный setup скачивает закреплённые версии .NET, Python, PyTorch и выбранных моделей.
Модели распознаванияДля рекомендуемых ASR и модели тайминга понадобится около 6,5 ГБ.
Модель переводаДля опционального локального переводчика понадобится около 8,1 ГБ.
Alpha-версия. Сохраняйте исходные медиа и проверяйте сгенерированные тайминги и текст перед публикацией.

Установка

  1. Запустите SubtitleStudio_Alpha_Setup_v0.6.1.exe.
  2. Выберите единую папку установки. Стандартный путь: %LOCALAPPDATA%\Programs\FruitFake\Subtitle Studio.
  3. Отметьте нужные наборы моделей Qwen. Для транскрибации нужна ASR-модель, для точного тайминга — Forced Aligner, а для перевода — ещё и текстовая модель.
  4. Дождитесь скачивания и проверки всех компонентов. Не закрывайте установщик, пока идёт прогресс runtime или моделей.
  5. Запустите Subtitle Studio из меню «Пуск» или с ярлыка на рабочем столе.
Без глобальных изменений. Локальный .NET хранится в Runtime\dotnet, AI-среда — в Runtime\qwen-env, а опциональные модели — в Models\Qwen. Системный PATH не меняется.

Первый запуск

  1. Выберите EN или RU в верхней панели.
  2. Откройте Модели и система и нажмите Проверить систему.
  3. Выберите ASR-модель и, если установлена, Forced Aligner. Модель перевода нужна только для переведённого результата.
  4. Проверьте папку результата: готовые SRT будут сохраняться туда.

Индикатор runtime сверху показывает готовность локального backend. Полная диагностика находится в разделе Журнал обработки.

Основной процесс

  1. Добавьте аудио или видео кнопкой либо перетащите файлы в окно.
  2. Выберите исходный язык для очереди или отдельно для каждого файла. Если язык неизвестен, используйте Автоопределение.
  3. Выберите Только транскрипт SRT, Только перевод SRT или Транскрипт + перевод. Для перевода также нужны целевой язык и модель переводчика.
  4. При необходимости выберите TXT-контекст/словарь и задайте лимиты символов в строке, количества строк и длительности реплики.
  5. Нажмите Запустить очередь для всех ожидающих файлов. Чтобы обработать только участок таймлайна, задайте диапазон и нажмите Распознать диапазон.
  6. Откройте готовый документ в редакторе, проверьте его и сохраните финальный SRT.
Разные диапазоны одного медиафайла могут иметь разные исходные языки. Все реплики объединяются в одном документе и сортируются по времени.

Редактор субтитров

  • Редактируйте Начало, Конец и Текст прямо в таблице реплик.
  • Кнопки и добавляют и удаляют реплики, стрелки меняют их порядок.
  • Кнопка ▶ Реплика или Пробел вне текстового поля воспроизводит выбранный диапазон.
  • Delete вне текстового поля удаляет выбранные реплики.
  • Сохранить записывает текущий документ, а Сохранить как… создаёт отдельный SRT.

Строка состояния показывает пересечения, неверные таймкоды, пустые реплики и несохранённые изменения. Перед финальным сохранением исправьте ошибки.

Модели и контексты

Модели

В разделе Модели и система можно выбирать и добавлять локальные папки ASR, Forced Aligner и модели перевода. Кнопка Проверить систему проверяет Python worker и пути выбранных моделей.

Контексты и словари

Поместите UTF-8-файлы .txt в папку Contexts приложения. Обновите список и выберите контекст до запуска задачи. Так можно подсказать модели имена, термины, команды, продукты и нужные варианты написания.

Обновление и удаление

Запустите более новый setup поверх той же папки для обновления или восстановления. Исправные файлы runtime проверяются и используются повторно без лишнего скачивания.

Удаление убирает файлы приложения и runtime, которыми управляет установщик. Модели, настройки, черновики, готовые субтитры и другие пользовательские данные сохраняются.

Решение проблем

  • Runtime не готов: откройте Модели и система, нажмите Проверить систему, затем при необходимости повторно запустите setup для восстановления.
  • Не найдена модель: установите её через setup или добавьте существующую папку через Управление моделями….
  • Ошибка скачивания: проверьте интернет, свободное место и доступ к Microsoft, Python, PyPI и Hugging Face, затем повторите установку.
  • Субтитры не созданы: убедитесь, что в файле есть аудиодорожка, проверьте выбранный диапазон и откройте Журнал обработки.
  • Ошибка обработки: раскройте Журнал обработки и нажмите Открыть логи для полного диагностического файла.