
Полная версия
ElevenLabs. Голос вашего дела. От первой кнопки до собственного голосового агента

Виктория К
ElevenLabs. Голос вашего дела. От первой кнопки до собственного голосового агента
Практическое руководство
ИЗДАНИЕ 2026
ElevenLabs. Голос вашего дела
От первой кнопки до собственного голосового агента: полный курс по синтезу речи, клонированию голоса, дубляжу, музыке и API — для тех, кто начинает с нуля.
12 глав · 148 готовых промтов · Задания и чек-листы · Справочник API
Все факты, цифры и ссылки сверены с официальной документацией ElevenLabs по состоянию на август 2026 года. Цены и лимиты компания периодически меняет — актуальные значения всегда на elevenlabs.io/pricing.
Введение. Почему голос — это ваш следующий инструмент
Ещё пять лет назад, чтобы озвучить пятиминутный ролик, нужно было найти диктора, согласовать ставку, дождаться записи, отслушать, попросить переделать одну фразу — и заплатить за неё как за полную смену. Сегодня та же задача решается за четыре минуты и стоит меньше чашки кофе. Это не преувеличение и не реклама: это арифметика, которую вы сами проверите в третьей главе.
ElevenLabs — платформа, которая превращает текст в человеческую речь, речь в текст, один голос в другой, видео на русском в видео на японском, а описание «тёплый низкий женский голос, рассказчица подкаста о путешествиях» — в готовый голос, которого не существует. Внутри неё живут ещё генератор музыки, генератор звуковых эффектов, редактор аудиокниг и конструктор голосовых роботов, которые отвечают на звонки вместо вас.
ЧТО ВЫ ПОЛУЧИТЕ, ДОЧИТАВ
- Уверенно озвучите любой текст так, чтобы слушатель не заподозрил синтез.
- Создадите свой голос — клон настоящего или придуманный с нуля.
- Переведёте своё видео на 30+ языков, сохранив собственный тембр.
- Соберёте голосового ассистента, который принимает звонки и записывает клиентов.
- Научитесь считать деньги: где кредиты утекают зря, а где экономия в 2 раза.
- Заберёте библиотеку из 148 промтов, которые работают сразу, без правок.
Как устроена эта книгаКаждая глава начинается с блока «Какие проблемы решаем»— чтобы вы сразу видели, зачем вам эти двадцать минут. Дальше идёт разбор: что нажать, какие настройки поставить, почему именно такие. Промты вынесены в отдельные жёлтые карточки — их можно копировать целиком. В конце главы вас ждут задания(короткие, на 5–15 минут), чек-листдля самопроверки и краткие итоги.
Читать подряд не обязательно. Главы 1–4 — фундамент, их лучше пройти по порядку. Дальше берите то, что нужно сейчас: дубляж — глава 7, боты — глава 10, автоматизация — глава 11.
ТРИ ЧЕСТНЫХ ПРЕДУПРЕЖДЕНИЯ
Первое.Интерфейс ElevenLabs англоязычный. Русского перевода нет, и в книге все кнопки названы по-английски — так вы найдёте их с первого раза. Понимать английский не нужно: все нужные слова разобраны.
Второе.Платформа меняется быстро. Названия моделей, цены и лимиты в книге актуальны на август 2026 года; логика работы меняется гораздо медленнее, и именно её вы усвоите.
Третье.Голос — чувствительная вещь. Клонировать чужой голос без разрешения нельзя ни юридически, ни по-человечески. Глава 12 объясняет, где проходит граница.
С чего начать прямо сейчасОткройте elevenlabs.io в соседней вкладке и заведите бесплатный аккаунт. Он даёт 10 000 кредитов в месяц — этого хватит примерно на 10 минут озвучки, то есть на всю первую половину книги. Карта не нужна.
Содержание
Двенадцать глав и шесть приложений. Рядом с каждой главой — что именно вы научитесь делать.
Глава 1. Знакомство: что такое ElevenLabsи что он умеет
Карта всей экосистемы за один присест: четыре больших продукта, четырнадцать инструментов и то, как они соединяются между собой. Разбираем, какая задача решается каким инструментом, чтобы дальше не блуждать по меню.
Глава 2. Старт: аккаунт, интерфейс, кредиты, тарифы и право
Регистрация, первый обход интерфейса и главное — экономика платформы: что такое кредиты, сколько их съедает минута речи и почему на бесплатном тарифе нельзя монетизировать контент. Учимся считать бюджет до того, как он кончится.
Глава 3. TexttoSpeech: первая профессиональная озвучка
Выбор модели (v3, Multilingual v2, Flash v2.5), четыре ползунка настроек и то, что они реально делают со звуком. Готовим текст к озвучке: числа, даты, аббревиатуры, ссылки — типичные места, где синтез спотыкается.
Глава 4. Язык аудиотегов: промт-инжиниринг для голоса
Самая практичная глава книги. Квадратные скобки, которые заставляют голос шептать, смеяться, вздыхать и говорить с акцентом. Пунктуация как режиссура, паузы, ударения и управление произношением через IPA и словари.
Глава 5. Голоса: библиотека, дизайн, клонирование, ремикс
Десять тысяч готовых голосов и как найти среди них нужный за минуту. Дизайн голоса по текстовому описанию, мгновенное и профессиональное клонирование, требования к записи и подводные камни с акцентом.
Глава 6. Длинные форматы: диалоги, Studio, аудиокниги и подкасты
Как озвучить не абзац, а книгу. Многоголосые диалоги, монтажная линейка Studio, импорт EPUB и DOCX с автоматической разбивкой на главы, генерация подкаста из документа и экспорт в MP3, WAV и MP4.
Глава 7. Дубляж и локализация: ваше видео на десятках языков
Автоматический дубляж с сохранением вашего тембра, разделение до 32 говорящих, сила клонирования и ручная доводка в Dubbing Studio. Считаем стоимость и выбираем между быстрой и дорогой моделью.
Глава 8. Речь в текст и обработка звука: Scribe, субтитры, VoiceChanger
Расшифровка интервью и совещаний с разделением по спикерам, тайм-коды до слова, автоматические субтитры. Плюс два инструмента-выручалочки: подмена голоса в готовой записи и очистка звука от шума.
Глава 9. Музыка и звуковые эффекты
Фоновая музыка под ролик по текстовому описанию — до пяти минут, с правами на коммерческое использование. Звуковые эффекты от шагов по гравию до брендового джингла, зацикливание и структура удачного промта.
Глава 10. Голосовые агенты: боты, которые говорят и звонят
Конструктор разговорных агентов: системный промт из шести блоков, база знаний, инструменты и интеграции, подключение телефонии и виджет на сайт. Собираем администратора салона, который записывает клиентов.
Глава 11. APIи автоматизация: когда мышки становится мало
Первый запрос за пять минут — даже если вы никогда не писали код. Ключ, SDK, потоковая генерация, пакетная озвучка сотни файлов и связка с Google Таблицами, Telegram и no-code сервисами.
Глава 12.Сценарии применения, этика, безопасность и деньги
Сорок сценариев для работы, учёбы, творчества и быта — с прикидкой времени и стоимости. Где заканчивается закон и начинается дипфейк, как защитить свой голос и на чём на этой платформе реально зарабатывают.
Приложение А. Библиотека из 128 промтов
Сто двадцать восемь готовых к вставке шаблонов по одиннадцати категориям: соцсети, бизнес, обучение, аудиокниги, дизайн голоса, дубляж, музыка, звуковые эффекты, агенты и API.
Приложение Б. Словарь терминов
Пятьдесят понятий — от «аудиотега» до «диаризации» — простым языком, с указанием, в какой главе это встречается.
Приложение В. Справочник моделей
Все актуальные модели с идентификаторами, лимитами символов, задержкой и числом языков — таблица для быстрого выбора.
Приложение Г. Справочник API
Основные эндпоинты REST API с методами, назначением и примерами вызовов, плюс коды ошибок и лимиты.
Приложение Д. Кредиты, тарифы и калькулятор
Сколько стоит каждая функция, как перевести кредиты в минуты и как посчитать бюджет проекта на салфетке.
Глава 1.
Знакомство: что такое ElevenLabs и что он умеет
Прежде чем нажимать кнопки, полезно понять, где вы находитесь. Эта глава — карта территории.
КАКИЕ ПРОБЛЕМЫ РЕШАЕМ В ЭТОЙ ГЛАВЕ
«Я зашёл на сайт и растерялся: там десяток разделов, и я не понимаю, что мне нужно».
«Мне сказали, что там можно озвучивать текст. А что ещё? Вдруг я плачу за одно, а мог бы использовать пять функций».
«Чем ElevenLabs отличается от встроенного голосового движка в телефоне и от бесплатных сайтов озвучки?»
Одно предложение о том, что это такоеElevenLabs — платформа для работы со звуком и голосом на основе искусственного интеллекта. Она умеет три базовые вещи и множество производных от них: превращать текст в речь, превращать речь в тексти превращать один голос в другой. Всё остальное — дубляж, аудиокниги, музыка, телефонные роботы — надстройки над этими тремя операциями.
Компания основана в 2022 году Петром Домбковским и Матеушем Станишевским. Показательна история появления: оба выросли в Польше, где иностранные фильмы традиционно шли с закадровым переводом одним голосом. Желание сделать локализацию, сохраняющую голос и эмоцию актёра, выросло из этого детского раздражения. Поэтому дубляж в ElevenLabs — не побочная функция, а одна из центральных.
Чем это отличается от «робота из навигатора»Старые синтезаторы речи склеивали заранее записанные кусочки или считали звук по формулам — отсюда механический тон. Современные модели устроены иначе: они предсказывают звучание фразы целиком, учитывая контекст. Модель «понимает», что после слова «увы» интонация падает, а перед вопросительным знаком — поднимается. Именно поэтому в ElevenLabs можно управлять не только словами, но и подачей: попросить голос вздохнуть, усмехнуться или произнести фразу шёпотом.
Практическое следствие: качество результата зависит от того, что вы пишете, а не только от того, какие ползунки двигаете. Текст для синтеза — это по сути сценарий для актёра. Отсюда и промты, которым посвящена вся четвёртая глава.
Карта экосистемы: четыре двериВ 2026 году платформа разделена на четыре продукта. Понимание этого деления экономит массу времени: вы сразу идёте в нужную дверь.

Рис. 1.1— Карта экосистемы ElevenLabs: четыре продукта, четырнадцать инструментов и общий слой моделей под ними.
ElevenCreative — там, где вы проведёте 90 % времениЭто веб-приложение, в котором ничего не нужно программировать. Открыли страницу, вставили текст, выбрали голос, нажали Generate — получили файл. Здесь же живут дубляж, монтажная линейка Studio, генератор музыки и все инструменты работы с голосами. Начинать нужно отсюда, независимо от того, кто вы по профессии.
ElevenAgents — голосовые собеседникиОтдельный конструктор, где вы описываете поведение ассистента словами, выбираете ему голос, даёте базу знаний и подключаете к телефону или сайту. Агент слушает, думает, отвечает голосом и умеет выполнять действия: записать на приём, найти заказ, перевести звонок на человека. Подробно — в главе 10.
ElevenAPI — тот же движок, но из вашей программыREST-интерфейс с официальными библиотеками для Python и TypeScript. Нужен, когда озвучить надо не один текст, а тысячу, или когда генерация должна происходить сама — по расписанию, по событию, внутри вашего сервиса. Глава 11 показывает, что первый рабочий запрос пишется за пять минут даже без опыта.
Reception.ai — готовый телефонный секретарьКоробочное решение для малого бизнеса: агент, который принимает входящие звонки, отвечает на типовые вопросы и записывает клиентов. По сути это ElevenAgents с преднастроенными сценариями — берут его, когда не хочется собирать логику самому.
Что можно сделать уже сегодня: восемь честных примеров
Табл. 1.1— Типовые задачи и подходящие инструменты. Время указано для человека, прошедшего первые четыре главы.
Границы: чего платформа не делаетЧестность экономит разочарования. ElevenLabs не пишет за вас текст— сценарий вы приносите свой (или берёте у языковой модели). Он не монтирует видеов полноценном смысле: Studio умеет базовую сборку, но это не Premiere. Он не гарантирует стопроцентную идентичностьклонированного голоса — сходство высокое, но чувствительное ухо близкого человека разницу заметит. И он не разрешает клонировать чужой голос: профессиональное клонирование требует голосовой верификации владельца.
СОВЕТ ИЗ ПРАКТИКИ
Не пытайтесь освоить все четырнадцать инструментов сразу. Возьмите одну реальную задачу — «озвучить мой следующий ролик» — и доведите её до конца. Один завершённый результат учит больше, чем три часа кликанья по вкладкам.
ЗАДАНИЯ ДЛЯ ЗАКРЕПЛЕНИЯ
1. Откройте elevenlabs.io и зарегистрируйтесь. Ничего не генерируйте — просто найдите в левом меню разделы Text to Speech, Voice Changer, Studio, Dubbing и Music. Убедитесь, что узнаёте их по рис. 1.1.
2. Выпишите на листе три свои реальные задачи, где нужен голос или звук. Напротив каждой поставьте инструмент из табл. 1.1. Если для какой-то задачи инструмента не нашлось — отметьте её вопросом и вернитесь к ней после главы 12.
3. Определите, к какой из четырёх «дверей» вы относитесь: только веб-интерфейс (Creative), нужен бот (Agents), нужна автоматизация (API). От этого зависит, какие главы читать в первую очередь.
ЧЕК-ЛИСТ ГЛАВЫ 1
Аккаунт создан, вход в личный кабинет выполнен
Я понимаю разницу между Creative, Agents, API и Reception.ai
Я могу назвать инструмент для каждой из трёх своих задач
Я знаю, что клонирование чужого голоса без разрешения недопустимо
Я не пытаюсь освоить всё сразу и выбрал одну стартовую задачу
ЧЕМУ ВЫ НАУЧИЛИСЬ В ГЛАВЕ 1
Вы получили карту платформы и больше не теряетесь в меню. Вы знаете, что в основе всего лежат три операции — текст в речь, речь в текст, голос в голос, — а четырнадцать инструментов лишь по-разному их комбинируют. Вы понимаете, чем нейросетевой синтез отличается от старых «роботов», и почему текст для озвучки — это сценарий, а не просто набор слов. И вы выбрали одну конкретную задачу, на которой будете тренироваться дальше.
Глава 2
Старт: аккаунт, интерфейс, кредиты, тарифы и право
Скучная, но самая денежная глава. Здесь вы научитесь считать — и перестанете удивляться, куда делся месячный лимит.
КАКИЕ ПРОБЛЕМЫ РЕШАЕМ В ЭТОЙ ГЛАВЕ
«Кредиты закончились на третий день, а я только пробовал».
«Не понимаю, какой тариф брать: разница между 6 и 99 долларами в чём?»
«Можно ли то, что я сгенерировал, выкладывать на YouTube и брать за это деньги?»
«Интерфейс на английском, я боюсь нажать не туда».
Регистрация: четыре шага
Регистрация: четыре шага1. Откройте elevenlabs.io и нажмите Signupв правом верхнем углу.
2. Зарегистрируйтесь через Google или по электронной почте. Банковская карта на бесплатном тарифе не нужна.
3. Подтвердите почту по ссылке из письма.
4. Ответьте на пару вводных вопросов о том, зачем вы пришли, — они влияют только на подсказки в интерфейсе.
Вы попадёте в личный кабинет по адресу elevenlabs.io/app. Слева — меню инструментов, сверху справа — ваш аватар и, что важнее, счётчик кредитов.
Обход интерфейса: где что лежитHome - Стартовый экран с недавними генерациями и подборкой сценариев. Отсюда удобно возвращаться к незаконченному.
Playground - Песочница: Text to Speech, Speech to Text, Voice Changer, Sound Effects, Image &Video. Быстрые одноразовые задачи.
Products - Крупные форматы: Studio, Dubbing, Music, Audiobooks, Transcripts, Subtitles. То, где проект живёт долго.
Voices - Ваша коллекция голосов, библиотека сообщества, Voice Design и клонирование.
Agents - Конструктор разговорных ассистентов, история звонков, аналитика.
SettingsUsage/ Billing/ APIKeys - Расход кредитов по дням, смена тарифа и создание ключа для API. Загляните сюда сразу — раздел Usage будет вашим главным индикатором.
АНГЛИЙСКИЙ ИНТЕРФЕЙС — НЕ ПРОБЛЕМА
Вам понадобится примерно двадцать слов: Generate— создать, Voice— голос, Model— модель, Settings— настройки, Download— скачать, Upload— загрузить, Credits— кредиты, Usage— расход, Stability— стабильность, Similarity— сходство, Speed— скорость, Addvoice— добавить голос, Clone— клонировать, Dub— дублировать, Project— проект, Chapter— глава, Export— экспорт, Preview— предпрослушка, Regenerate— перегенерировать, Save— сохранить. Всё остальное — производные.
Кредиты: единая валюта платформыВсе действия оплачиваются кредитами из общего месячного баланса. Логика простая: один символ озвученного текста — один кредитдля флагманских моделей. Пробелы и знаки препинания считаются. Абзац в 500 знаков — это 500 кредитов, и не важно, сколько раз вы его переслушали: списание происходит в момент генерации.

Рис. 2.1— Расход кредитов по основным операциям. Flashv2.5 стоит вдвое дешевле флагманских моделей — это главный рычаг экономии.
Переводим кредиты в минутыСредний темп речи — около 150 слов в минуту. В русском тексте слово вместе с пробелом занимает примерно 7 знаков. Отсюда: минута речи 1000 символов 1000 кредитовна модели v3. Значит, бесплатные 10 000 кредитов — это около десяти минут озвучки в месяц, а тариф Creator со 121 000 кредитов — примерно два часа.
ГДЕ КРЕДИТЫ УТЕКАЮТ НЕЗАМЕТНО
Перегенерации.Каждое повторное нажатие Generate списывает полную стоимость заново. Отслушивайте на коротком фрагменте, а не на всём тексте.
Длинные предпрослушки в VoiceDesign.Текст превью тоже тарифицируется.
Дубляж сразу на пять языков.Списывается за каждый язык отдельно.
Голоса с множителем.У части голосов из библиотеки владелец когда-то установил повышенную ставку — рядом с таким голосом висит отметка о множителе кредитов.
Тарифы: что за что
Табл. 2.1— Тарифные планы ElevenLabs. Актуальные цифры и возможные акции — на странице тарифов.
Отдельная тарификация для APIЕсли вы работаете через API, компания публикует стоимость не в кредитах, а в долларах за единицу — так проще считать себестоимость сервиса.

Табл. 2.2— Тарификация через API. Источник: elevenlabs.io/pricing/api.
Перенос и сгорание кредитовНеизрасходованные кредиты подписки переносятся на следующий месяц, но не бесконечно: накопить можно максимум объём двух месяцев. Отдельно докупленные кредиты Pay As You Go живут 12 месяцев с момента покупки.
Какой тариф выбрать: короткое дерево решений
Рис. 2.2— Дерево выбора тарифа. Главная развилка проходит не по объёму, а по вопросу о коммерческом использовании.
Право: что можно публиковатьЭто тот раздел, который экономит нервы и деньги.
Бесплатный тариф не даёт коммерческой лицензии.Любое использование ради заработка — реклама, платный курс, монетизированный канал — на нём запрещено.
Публикация с бесплатного тарифа требует указания источника.В названии материала должно быть упоминание elevenlabs.io или 11.ai. Для музыки указывается «Eleven Music».
Все платные тарифы, начиная со Starter, включают коммерческую лицензию.Сгенерированное можно использовать бессрочно, в том числе после окончания подписки, — при условии, что у вас есть права на исходный материал и вы соблюдаете правила платформы.
Бета-функции — исключение.Материалы, созданные в сервисах со статусом Beta, коммерчески использовать нельзя.
Контент, созданный вне периода платной подписки, коммерческим не становится задним числом.Сгенерировали на бесплатном, потом купили Starter — та старая генерация всё равно остаётся некоммерческой.
ПРАКТИЧЕСКИЙ ВЫВОД
Если результат пойдёт в дело — оформите Starter за $6 догенерации, а не после. Шесть долларов дешевле, чем перегенерировать весь проект.
Мини-практикум: первая генерация за 90 секунд1. Меню слева Playground Text to Speech.
2. В поле голоса оставьте предложенный по умолчанию.
3. Вставьте текст: «Проверка связи. Если вы слышите этот голос, значит, всё настроено правильно.»
4. Нажмите Generateи послушайте.
5. Зайдите в SettingsUsageи посмотрите, сколько кредитов ушло. Запомните это число — теперь у вас есть личный масштаб.
ЗАДАНИЯ ДЛЯ ЗАКРЕПЛЕНИЯ
1. Посчитайте на калькуляторе: сколько минут речи вы получите на выбранном тарифе, если считать 1000 кредитов за минуту. Сравните с реальной потребностью — сколько минут озвучки вам нужно в месяц?
2. Сгенерируйте один и тот же абзац на модели Eleven v3 и на Flash v2.5. Сравните расход кредитов в разделе Usage и качество звучания на слух. Решите, где для вас проходит граница «экономия против качества».
3. Найдите в интерфейсе раздел Settings Usage и настройте себе привычку заглядывать туда после каждой большой генерации.
4. Ответьте письменно на один вопрос: будет ли ваш контент коммерческим? Если да — оформите платный тариф до начала работы.
ЧЕК-ЛИСТ ГЛАВЫ 2
Аккаунт подтверждён, я знаю, где счётчик кредитов
Я понимаю, что 1 символ 1 кредит, а минута речи 1000 кредитов
Я знаю, что Flash v2.5 стоит вдвое дешевле
Я нашёл раздел Settings Usage и проверил свой расход
Я определился с тарифом и понимаю, что он мне даёт
Я знаю, что на бесплатном тарифе коммерческое использование запрещено
Я знаю про требование указывать elevenlabs.io при публикации с Free
ЧЕМУ ВЫ НАУЧИЛИСЬ В ГЛАВЕ 2
Вы создали аккаунт, прошлись по интерфейсу и, главное, освоили экономику платформы. Теперь вы переводите кредиты в минуты в уме, знаете четыре типичных места утечки бюджета и понимаете, за что именно доплачиваете на каждом тарифе. Вы также разобрались с юридической стороной: бесплатный тариф — только для учёбы и личных проектов, коммерция начинается со Starter. Дальше начинается собственно работа со звуком.
Глава 3
Text to Speech: перваяпрофессиональная озвучка
Три решения определяют 90 % качества: какой голос, какая модель, какой текст. Ползунки — только четвёртое.
КАКИЕ ПРОБЛЕМЫ РЕШАЕМ В ЭТОЙ ГЛАВЕ





