YORK
.
LAB
Личная лаборатория голоса, звука и изображений
Войти в студию
YORK
.
LAB
Голос
Картинки
Видео
Проекты
Выйти
Синтез
Распознавание
Аудио-генерация
Генерация речи
Модель
↻
Готовый голос
Из библиотеки
Разовый клон
Готовый голос
Список голосов подставляется из выбранной модели.
Голос из библиотеки
Клонирование stateless: сэмпл отправляется в модель при каждой генерации.
Референс-аудио
Транскрипт (что говорится в сэмпле)
Текст для озвучки
Интонация / стиль (опционально)
Instructions — для
openai/gpt-4o-mini-tts
Style — для
mai-voice-2
— нет —
cheerful
sad
angry
excited
calm
whispering
terrified
friendly
Интенсивность:
1.0
Применяется только той моделью, которой параметр родной — остальные его игнорируют.
Формат
mp3
pcm (не играет в браузере)
Скорость:
1.0
Сгенерировать
Библиотека голосов
● Запись
Добавить голос
История
Распознавание речи
Модель
↻
Аудио-файл
● Запись
Лучше загружать mp3 / wav. Запись с микрофона — webm, некоторые модели её могут не принять.
Распознать
Результат
Копировать
История
Генерация аудио · музыка
Модель
↻
Lyria — генерация музыки по описанию. gpt-audio — озвученная речь.
Промпт / описание
Формат
mp3
wav
Сгенерировать
История
Генерация изображений · CometAPI
Модель
↻
Список тянется из CometAPI.
Свои фото
— до 10, модель будет работать с ними
Очистить
Промпт
Размер
1024×1024 — квадрат
1536×1024 — альбом
1024×1536 — портрет
по умолчанию модели
Качество
по умолчанию
low
medium
high
Количество
1
2
3
4
Сгенерировать
Галерея
Генерация видео · OpenRouter
Модель
↻
Sora, Veo, Kling, Runway, Seedance и другие.
Первый кадр
— своё фото
✕
Последний кадр
— необязательно
✕
Можно задать оба кадра сразу — модель сделает переход между ними. Поддерживают не все модели.
Промпт
Длительность, сек
по умолчанию
4
5
8
10
12
Разрешение
по умолчанию
720p
1080p
Пропорции
по умолчанию
16:9
9:16
1:1
Сгенерировать
Генерация идёт минуты. Можно уйти на другую вкладку — задача продолжится, статус подтянется.
Видео
+ Добавить сцену