
Typecast — платформа ИИ-озвучивания корейской компании Neosapience, которая превращает текст в выразительную речь при помощи более чем 700 лицензированных голосовых моделей дикторов, контекстного анализа эмоций, клонирования голоса и многоязычного интерфейса синтеза речи для авторов, разработчиков и компаний.
Пользовались этим инструментом? Оцените его
Пользовались этим инструментом? Оцените его
Typecast — это платформа искусственного интеллекта, превращающая письменный текст в речь с управляемой эмоциональной подачей. Отличительный довод здесь не количество голосов и не цена, а выразительность: компания представляет себя как «самый выразительный в мире генератор ИИ-голоса» и описывает продукт как «генератор ИИ-голоса, который звучит естественно и полон эмоций — для авторов, разработчиков и компаний». На практике это три связанных продукта в рамках одной подписки: работающий в браузере голосовой редактор, система клонирования голоса и программный доступ к синтезу, к которым добавлены видеоредактор и функция говорящего аватара.
Оператором выступает Neosapience, Inc., южнокорейская компания. Этот факт весит куда больше сноски, и по двум причинам. Во-первых, он определяет правовую рамку: условия использования гласят, что они «образуют соглашение между вами и Neosapience, Inc.» и что они «регулируются и толкуются в соответствии с законодательством Республики Корея», а споры подпадают под корейское гражданское судопроизводство. Во-вторых, он объясняет языковой центр тяжести продукта: корейский, английский, японский и китайский здесь языки первого ряда, чего нельзя сказать о каждом западном конкуренте. Корейский сайт полностью раскрывает оператора, как того требует местное регулирование электронной торговли: 네오사피엔스 주식회사, регистрационный номер предприятия 883-86-00767, представитель Тхэсу Ким, с зарегистрированным адресом в районе Самсондон округа Каннамгу в Сеуле. То же лицо указано в политике конфиденциальности как ответственный за защиту персональных данных.
Что действительно отделяет голос Typecast от обычного синтезатора речи — это эмоциональный слой. Помимо привычных регуляторов темпа и высоты тона платформа предлагает то, что называет Smart Emotion: систему, которая читает окружающий текст, чтобы вывести, как следует произнести реплику, не требуя от вас размечать каждое предложение вручную. Компания описывает свою библиотеку как «эксклюзивные голоса настоящих актёров озвучивания», а политика использования излагает стоящую за этой формулировкой лицензионную конструкцию с редкой для данной категории определённостью. Поскольку лицензирование голосов и согласие чаще всего решают, можно ли безопасно строить бизнес на конкретном голосовом инструменте, эта страница рассматривает оба вопроса как центральные, а не как заключительную оговорку.
Главная способность — эмоциональный синтез речи, то есть синтез с регулируемой эмоциональной подачей. Сайт заявляет «более 700 ИИ-голосов с регулируемой эмоцией, скоростью и динамикой», а размещённые демонстрации прямо показывают доступные эмоциональные состояния: радость, печаль, гнев, шёпот и низкий тон предстают как режимы, применяемые к одной и той же реплике. Голоса организованы по назначению: диктор, рассказчик, подкаст, ведущий новостей, робот и персонажные голоса, плюс фильтры по возрасту и полу. Существенная оговорка в том, что это не синтетические конструкции, собранные с нуля: компания описывает их как «эксклюзивные голоса настоящих актёров озвучивания», и именно это придаёт вес обсуждаемым далее лицензионным условиям.
Smart Emotion — функция, с которой компания выходит вперёд, и она действительно отходит от эмоционального управления через метки. Вместо того чтобы помечать каждое предложение настроением, система анализирует текст вокруг реплики, чтобы решить, как её произнести. Собственное описание лежащего в основе исследования гласит, что технология «построчно анализирует сценарии, автоматически создавая соответствующий контексту тон». Интерфейс раскрывает этот механизм напрямую: запрос может нести предыдущую и следующую реплику вместе с синтезируемой строкой, так что фраза вроде «всё будет хорошо» звучит по-разному в зависимости от того, следует ли она за хорошей новостью или за плохой. Для повествовательной работы это существенное проектное решение, поскольку одни и те же слова весят по-разному в зависимости от предшествующего.
Платформа предлагает клонирование голоса на двух уровнях качества. Мгновенное клонирование создаёт собственный голос из короткого аудиообразца и открывается на начальном платном уровне; профессиональное клонирование как более точный путь появляется со среднего уровня. Слоты клонирования считаны, а не безграничны: один на начальном и среднем уровнях, два на самом популярном и десять на бизнес-уровне. Компания сообщает, что клонированный голос затем может «говорить на нескольких языках», то есть голос, записанный на одном языке, годится для порождения речи на других — практическая приманка для авторов, публикующихся на разных рынках.
Интерфейс синтеза речи, предлагаемый разработчикам, не является тонкой оболочкой вокруг веб-редактора. Документация описывает интерфейс, дающий речь на 37 языках через модель ssfm-v30 и доступ более чем к 500 голосам, с четырьмя различимыми режимами порождения: стандартный синтез, выдающий целые файлы WAV или MP3; потоковый синтез, воспроизводящий звук по мере поступления фрагментов и нацеленный на голосовых агентов и приложения с низкой задержкой; синтез с метками времени, возвращающий данные выравнивания на уровне слова или символа для субтитров, караоке-подсветки и синхронизации артикуляции; и мгновенное клонирование, открытое программно. Официальные примеры набора разработчика охватывают Python и JavaScript как самые распространённые языки, а также C# и Java, затем Kotlin и Rust. Документация дополнительно публикует файл llms.txt, прямо предназначенный для ИИ-агентов, пишущих код.
Помимо звука подписка включает видеоредактор, качество вывода в котором ступенчато: 720p на бесплатном уровне, 1080p на начальном и 4K начиная со среднего, причём вывод без водяного знака требует любого платного уровня. Отдельная функция говорящего аватара порождает появляющегося на экране ведущего и считается по числу порождений, а не по длительности: до шести на начальном уровне и до сорока на бизнес-уровне, ноль на бесплатном. Отметим, что для аватаров действует более строгое возрастное ограничение, чем для остальной платформы, о чём сказано ниже.
Typecast выпускает мобильные приложения для iOS и Android, которые порождают закадровый голос прямо с телефона и синхронизируют проекты между устройствами. Версия для iOS зарегистрирована на компанию Neosapience, загружается бесплатно, требует iOS 16.4 или новее, имеет возрастную маркировку 12+ и обновлялась в августе 2026 года — активно сопровождаемая сборка, а не заброшенное приложение-спутник.
Компания публикует родословную моделей вместо того, чтобы держать синтезатор чёрным ящиком: первая модель синтеза речи на основе глубокого обучения в 2018 году, модель CATS с улучшенным произношением и естественностью в 2021-м, SSFM 1.0 в 2024-м с новой архитектурой, обученной на больших наборах данных, SSFM 2.0 в 2025-м с многоязычностью и продвинутым управлением, и SSFM 3.0 в том же году с порождением эмоции с учётом контекста. При сравнении с новичками эта линия заслуживает внимания, но всё это утверждения самой компании, не прошедшие независимой проверки.
Лучше всего подходит содержание, которое ровная подача погубила бы: радиоспектакль, анимация, игровые диалоги, художественные аудиокниги и видео, движимое сюжетом. Отзыв на сайте, оставленный кинорежиссёром, схватывает задуманный ход работы — возможность пробовать разные голоса, править тайминг и играть эмоцией, пока сцена не оживёт, что он описал как «кастинг, режиссуру и продюсирование одновременно». Именно сочетание обширного каталога персонажных голосов с построчным эмоциональным управлением делает эту категорию по-настоящему рабочей, а не просто возможной.
Для авторов, публикующих одно и то же содержание на нескольких рынках, связка клонирования и многоязычности и есть суть привлекательности: записать голос один раз, а затем заставить его говорить на других языках. С 37 языками через интерфейс и прямым упоминанием корейского, английского, японского, китайского, испанского и вьетнамского в документации охват действительно широк — и заметно силён на восточноазиатских языках, где часть западных конкурентов слабее.
Потоковый синтез существует именно для случаев, когда ждать завершения полного расчёта недопустимо. Компания заявляет, что движется «от простого порождения голоса к настоящему разговорному ИИ, который слушает, думает и говорит в реальном времени», а корпоративный уровень прямо упоминает разговорных агентов реального времени. Для разработчика, строящего помощника или интерактивный голосовой продукт, значимой поверхностью служит потоковая конечная точка вместе с воспроизведением при малой задержке, а не веб-редактор.
Синтез с метками времени возвращает данные выравнивания на уровне слова или символа, отчего вывод превращается в то, что производственный конвейер может потребить напрямую, а не в голый аудиофайл. Именно это делает практичными автоматическое создание субтитров, караоке-подсветку и анимацию под артикуляцию без отдельного шага принудительного выравнивания.
Компания описывает аудиторию, охватывающую вещание, связь, электронную торговлю и образование, и структура уровней отражает институциональное применение: бизнес-уровень добавляет участников команды, десять слотов клонирования и покупку дополнительных кредитов. Здесь действует крайне весомая и легко упускаемая лицензионная деталь: политика использования устанавливает, что «отдельные филиалы или компании должны каждая иметь собственную подписку для обеспечения соответствия», так что одно место юридически не покрывает целую группу компаний.
Поскольку порождение и воспроизведение безграничны на каждом уровне, включая бесплатный, а кредиты расходуются лишь при загрузке, Typecast поддерживает ход работы, которого нет у большинства конкурентов: прогнать целый сценарий множеством голосов и эмоциональных прочтений без затрат и заплатить только за оставленные дубли. При осознанном применении это инструмент кастинга и предварительной прикидки не в меньшей степени, чем производства.
Сначала разберитесь с моделью кредитов, потому что она определяет всё остальное. Страница цен указывает, что «порождение и воспроизведение голоса бесплатны на каждом уровне» и что «кредиты расходуются, когда вы загружаете аудио». Пока вы экспериментируете в редакторе, ничего не списывается. Порождайте одну и ту же реплику десятком голосов, пробуйте каждый эмоциональный режим, правьте темп — ничто из этого не тратит кредиты до экспорта. Большинство тех, кому бесплатный уровень кажется скупым, попросту не усвоили, что предел стоит на загрузках, а не на попытках.
Уровни не образуют простую лестницу качества; каждый открывает конкретное управление. Бесплатный уровень даёт 3 000 пожизненных кредитов на загрузку (около пяти минут), но ограничивает вас пробными голосами, звуком 16 кГц и тремя проектами. Начальный уровень за 5 долларов в месяц открывает все голоса, звук 44,1 кГц, один слот мгновенного клонирования и коммерческую лицензию. Следующий уровень за 19 долларов добавляет управление скоростью и профессиональное клонирование. На уровне за 29 долларов находятся эмоциональные регуляторы, включая Smart Emotion, собственную эмоцию, интонацию и высоту тона — если именно эмоциональная подача привела вас сюда, ваш входной билет стоит 29 долларов, а не 5. Бизнес-уровень за 69 долларов добавляет десять слотов клонирования, участников команды и покупку кредитов. Годовая оплата экономит десять процентов.
Если ваш уровень включает эту функцию, дайте ей контекст. Раз система выводит подачу из окружающего текста, дробление сцены на одиночные однострочные запросы выбрасывает тот самый сигнал, на который она опирается. В интерфейсе это выражено прямо — передавайте предыдущую и следующую реплику, — но тот же принцип действует и в редакторе: держите повествовательные отрывки цельными, чтобы модель читала дугу, а не обращалась с каждой репликой как с сиротой.
Этот шаг пропускают и потом жалеют. Коммерческое лицензирование неодинаково по уровням. На бесплатном плане таблица помечает коммерческую лицензию как «требуется указание авторства», а описание плана гласит, что «указание авторства требуется для всего содержания, загруженного на бесплатном плане». С начального уровня указание становится «необязательным». Если вы распространяете монетизируемое содержание, выясните, на каком уровне были сделаны загрузки, до распространения, а не после.
Правило хранения — самая весомая эксплуатационная деталь на этой странице. Результаты остаются на серверах Typecast год с момента создания, после чего «автоматически удаляются с наших серверов без дополнительного уведомления». Условия указывают, что «вы несёте ответственность за загрузку и сохранение любых результатов, которые желаете сохранить, до истечения срока хранения», и что у компании «нет обязанности восстанавливать» удалённое. Принципиально: это правило «применяется одинаково ко всем пользователям независимо от того, находитесь ли вы на платном или бесплатном плане». Относитесь к платформе как к службе порождения, а не как к своему архиву.
Политика использования проводит границу, которая застаёт врасплох уже после отмены: «Порождённое аудио можно загружать и использовать в личных или коммерческих целях исключительно в период вашей подписки. После истечения вы можете продолжать использовать ранее загруженное аудио, однако новые изменения или загрузки невозможны, если подписка не продлена». Уже загруженное аудио остаётся пригодным, но возможность повторно загрузить или создать новое производное прекращается вместе с подпиской.
Для программного применения получите ключ доступа и выберите режим под задачу: стандартный синтез для готовых файлов, потоковый — для интерактивной чувствительности к задержке, синтез с метками времени — когда нужны данные выравнивания. Официальный набор разработчика охватывает шесть языков: Python и JavaScript, а также C# и Java, плюс Kotlin и Rust. Учтите, что политика использования требует отдельных соглашений для служб интерфейса, создания собственных голосов и встраивания в автоматизированные системы: развёртывание через интерфейс — это не просто увеличенная потребительская подписка.
Стройте рабочие привычки вокруг модели кредитов. Раз воспроизведение ничего не стоит, всё сравнение, режиссуру и правку делайте в редакторе, а экспортируйте лишь окончательные дубли. Помогает грубый перевод величин: 30 000 кредитов соответствуют примерно 35 минутам звука, 75 000 — примерно 90 минутам, 200 000 — примерно 250 минутам. То есть кредиты отмеряют длину готового результата, а не усилия, потраченные на его получение.
Поскольку каждый уровень запирает своё управление, самый дешёвый достаточный план редко оказывается самым дешёвым планом. Управление скоростью появляется лишь при 19 долларах, эмоциональные регуляторы вместе со Smart Emotion — лишь при 29. Кто подписывается за 5 долларов, ожидая заявленной выразительности, будет разочарован — не потому, что функции нет, а потому, что она двумя уровнями выше.
На странице цен есть предупреждение, к которому стоит прислушаться: «Цены в App Store и Google Play могут отличаться от указанной выше суммы в зависимости от ценовой политики каждого магазина», а также «подписки, приобретённые через мобильное приложение (iOS/Android), нельзя изменить в вебе. Управляйте своим планом через соответствующий магазин приложений». Оформление на мобильном привязывает управление планом к этому магазину.
Условия возврата довольно строги и напрямую связаны с использованием. Для месячных планов «полный возврат возможен только при отсутствии истории использования кредитов, истории создания Premium-клона и незавершённых задач в течение 7 дней с даты выставления счёта». Годовые планы подчиняются тем же условиям в течение семи дней после оплаты, а далее возврат уменьшается на плату за использованные месяцы и комиссию за обработку. По сути первая загрузка или первый клон закрывают путь к чистому возврату. У пользователей Европейского союза есть дополнительное законное право отказа в течение четырнадцати дней, которое, впрочем, условия объявляют утраченным, как только услуга частично исполнена.
Политика использования прямо запрещает «несанкционированное использование личности, голоса или образа человека в несатирических, злонамеренных или коммерческих целях без его согласия», а равно и несанкционированное подражание политическим деятелям. Помимо собственных правил платформы условия требуют от вас заверения, что вы обладаете «всеми правами, лицензиями, согласиями, разрешениями и полномочиями» в отношении загружаемого. Юридическая ответственность за согласие на клонирование лежит на вас, а не на платформе.
Политическая реклама запрещена, «если не предоставлено прямое письменное разрешение», а предвыборная дезинформация и подражание политикам или их родственникам запрещены полностью. Материалы для взрослых, равно как и применение ИИ-голосов в связи с порнографией или услугами для взрослых, запрещены. Если ваша работа касается этих областей, добивайтесь письменного одобрения заранее, а не обнаруживайте ограничение после публикации.
Раз «отдельные филиалы или компании должны каждая иметь собственную подписку», агентство, обслуживающее несколько клиентских юридических лиц, или группа с несколькими дочерними компаниями не может законно свести использование к одному месту. Разберитесь с лицензионной структурой при закупке, а не при проверке.
Typecast подходит авторам, чьё содержание опирается не только на разборчивость, но и на эмоциональную подачу — аудиопроза, анимация, характерная работа, повествовательное видео, — поскольку именно туда вложены силы продукта. Он подходит командам, публикующимся одновременно в Восточной Азии и на Западе, ведь корейский, японский и китайский здесь основные, а не побочные. Он подходит разработчикам, строящим голосовых агентов или конвейеры субтитров, благодаря потоковым конечным точкам, меткам времени и набору для шести языков. Он подходит всякому, кто хочет вдоволь испытать продукт до оплаты, так как порождение и воспроизведение безграничны и бесплатны. И он подходит тем, кому нужен ясный ответ о лицензировании голосов, поскольку позиция о согласии актёров опубликована, а не подразумевается.
Он не подходит тем, кому платформа нужна как долговременное хранилище: автоматическое удаление через год действует независимо от уровня. Он не подходит организациям, желающим покрыть одной лицензией несколько юридических лиц, из-за требования раздельных подписок. Он не подходит для содержания для взрослых и политического — оба ограничены. Он не подходит пользователям младше 13 лет где бы то ни было и младше 17 лет для говорящего аватара. Он не подходит покупателям, которым до решения нужен обширный корпус независимых отзывов, поскольку след сторонних оценок тонок в сравнении с заявленной аудиторией. И он может не подойти тем, кого не устраивают корейское право и отказ от коллективного иска, о чём сказано в ограничениях.
Для большинства потенциальных пользователей настоящий вопрос уже, чем «хорош ли Typecast». Он в том, стоит ли эмоциональное управление надбавки за уровень. Если достаточно ровной и внятной дикторской начитки, более дешёвых вариантов предостаточно, а начальный уровень на фоне конкурентов можно счесть даже дорогим. Но если сама подача и есть продукт — если разница между шёпотом и криком держит ваше содержание, — то честной точкой сравнения выступает уровень за 29 долларов, а Smart Emotion оказывается действительно отличающейся способностью, а не переименованным регулятором высоты тона.
Typecast работает преимущественно в браузере: голосовой редактор, видеоредактор и интерфейс клонирования целиком веб-основаны, настольного приложения нет. Мобильные приложения существуют для iOS и Android и предназначены для создания закадрового голоса в дороге с синхронизацией проектов между устройствами. Приложение для iOS зарегистрировано на компанию Neosapience, загружается бесплатно, требует iOS 16.4 или новее, имеет маркировку 12+, отнесено к категориям «Фото и видео» и «Развлечения» и поддерживает английский и корейский языки интерфейса. Последняя версия выпущена в августе 2026 года, что говорит об активном сопровождении.
Для разработчиков поверхностью платформы служит интерфейс, а не устанавливаемый клиент: официальный набор охватывает шесть языков — Python и JavaScript, C# и Java, Kotlin и Rust, — к нему прилагаются инструмент командной строки и документация, рассчитанная на потребление ИИ-агентами, пишущими код. Сам сайт двуязычен, с раздельными английской и корейской версиями, причём корейская несёт полное юридическое раскрытие, требуемое корейским регулированием электронной торговли.
Одна платформенная оговорка заслуживает нажима: поскольку подписками, купленными через мобильные магазины, нельзя управлять в вебе, платформа оформления определяет, где вам впоследствии придётся отменять подписку или менять план.
Typecast берёт плату помесячной подпиской со скидкой в десять процентов при годовой оплате, а структура опирается на кредиты загрузки, а не на время порождения. Каждый уровень, включая бесплатный, даёт безграничное порождение и воспроизведение; кредиты расходуются только при загрузке аудио.
Бесплатный уровень ничего не стоит и предоставляет 3 000 пожизненных кредитов загрузки, что соответствует примерно пяти минутам звука. Он ограничивает загрузки пробными голосами, ставит потолок звука на 16 кГц, разрешает три проекта, даёт вывод видео в 720p с 1 ГБ хранилища, хранит историю загрузок семь дней и требует указания авторства для всего загруженного. Слоты клонирования и порождения аватара не включены.
Уровень Basic за 5 долларов в месяц или 54 доллара в год даёт 30 000 кредитов ежемесячно (около 35 минут), открывает все ИИ-голоса, поднимает звук до 44,1 кГц, добавляет один слот мгновенного клонирования, позволяет вывод видео 1080p без водяного знака с 5 ГБ хранилища и делает указание авторства необязательным по коммерческой лицензии.
Уровень Plus за 19 долларов в месяц или 204 доллара в год даёт 40 000 кредитов (около 50 минут), добавляет управление скоростью и профессиональное клонирование и поднимает вывод видео до 4K при 30 ГБ хранилища.
Уровень Pro за 29 долларов в месяц или 312 долларов в год вмещает фирменную способность платформы. Он даёт 75 000 кредитов (около 90 минут) и добавляет эмоциональные регуляторы, включая настройку Smart Emotion в один щелчок, собственную эмоцию, интонацию и высоту тона, а также второй слот клонирования и 50 ГБ хранилища.
Уровень Business за 69 долларов в месяц или 744 доллара в год даёт 200 000 кредитов (около 250 минут), позволяет докупать кредиты и добавляет десять слотов клонирования, участников команды и 100 ГБ хранилища. Выше расположен корпоративный уровень по запросу, охватывающий выделенный интерфейс и пакет безопасности, разговорных агентов реального времени и персонального менеджера.
Таблицу сопровождают два практических замечания. Цены в мобильных магазинах могут отличаться от веб-значений, а мобильными подписками нужно управлять через магазин оформления. Возвраты обусловлены: полный возврат предполагает отсутствие использования кредитов, создания Premium-клона и незавершённых задач в течение семи дней после выставления счёта, а годовые планы за пределами этого окна возвращаются за вычетом использованных месяцев и комиссии за обработку.
ElevenLabs — наиболее часто привлекаемая альтернатива и сильнейший конкурент по чистой достоверности голоса и широте экосистемы: как ИИ-генератор голоса он состязается прежде всего масштабом. Честное различие в акцентах: вложения Typecast сосредоточены на выведенной из контекста эмоциональной подаче и на явно задокументированной позиции по лицензированию голосов актёров, тогда как ElevenLabs состязается качеством модели, масштабом и более широким окружающим инструментарием. Сравнивайте по той оси, которая важна именно вам, а не по общей репутации.
Murf и WellSaid Labs целятся в корпоративную и учебную озвучку, где постоянство и управление произношением значат больше драматического размаха. Для продуктовых объяснений, обучающих модулей и внутренних коммуникаций они чаще оказываются экономичнее, а та эмоциональная тонкость, за которую Typecast берёт деньги, там почти не используется.
Play.ht и Speechify занимают край объёма и цены, привлекая издателей, переводящих обширные тексты в звук. Их преимущество — экономика пропускной способности; ответ Typecast — построчная режиссура, ценность которой, впрочем, невелика, когда задача сводится к массовому преобразованию.
Крупные облачные поставщики — Google, Amazon и Microsoft — предлагают синтез, глубоко встроенный в инфраструктуру, и корпоративные каналы закупки. Они выступают выбором по умолчанию, когда требуется встроить высокопроизводительный синтез в уже существующее облачное хозяйство. Чего они обычно не дают, так это отобранного каталога голосов настоящих актёров с опубликованными обязательствами о согласии, и именно в этом отличие Typecast.
Для содержания на корейском, японском и китайском региональное происхождение продукта — настоящее преимущество, которое стоит проверить напрямую. Вместо того чтобы принимать любое сравнение на веру, породите один и тот же сценарий на целевом языке на двух платформах и послушайте: на восточноазиатских языках разрыв нередко направлен противоположно общему англоязычному рейтингу репутации.
Самое весомое ограничение — не пробел в возможностях, а правило хранения. Порождённые через службу результаты хранятся год с момента создания, после чего «автоматически удаляются с наших серверов без дополнительного уведомления». Условия проговаривают три вещи: вы отвечаете за загрузку того, что хотите сохранить; у компании нет обязанности восстанавливать удалённое; и правило «применяется одинаково ко всем пользователям независимо от платного или бесплатного плана». Повторная загрузка прежних результатов возможна лишь пока они остаются на серверах и пока у вас действует подписка.
Уже загруженное аудио остаётся пригодным после отмены, но политика использования устанавливает, что коммерческое применение допустимо «исключительно в период вашей подписки», а после истечения «новые изменения или загрузки невозможны, если подписка не продлена». Вместе с правилом хранения обрыв подписки способен навсегда заморозить работу, которую вы ещё не выгрузили.
Результаты бесплатного уровня нельзя использовать безусловно: для всего загруженного там требуется указание авторства, загрузки ограничены пробными голосами, а качество упирается в 16 кГц. Бесплатный уровень — настоящая среда для оценки, а не бесплатный производственный инструмент.
Маркетинг открывает выразительностью, однако базовые эмоциональные регуляторы, Smart Emotion, собственная эмоция, интонация и высота тона появляются лишь начиная с уровня Pro, а управление скоростью требует по меньшей мере уровня за 19 долларов. Покупатель, привлечённый эмоциональными демонстрациями и подписавшийся за 5 долларов, не получит именно той способности, которая его привлекла.
Хотя условия подтверждают, что «вы сохраняете права собственности на ваше содержание и владеете результатом», загрузка содержания предоставляет Neosapience «неисключительную, безотзывную, всемирную, полностью оплаченную лицензию без роялти на хранение, воспроизведение, изменение, передачу, отображение, публикацию и распространение вашего содержания для эксплуатации, улучшения, продвижения и предоставления служб». Внимательно прочтите этот объём, прежде чем загружать чувствительные голосовые образцы: он включает продвижение и он безотзывен.
Споры подчинены законодательству Республики Корея и корейскому гражданскому судопроизводству. Условия добавляют, что любой спор «РАЗРЕШАЕТСЯ ИНДИВИДУАЛЬНО, БЕЗ ОБРАЩЕНИЯ К КАКОЙ-ЛИБО ФОРМЕ КОЛЛЕКТИВНОГО ИСКА», и что любое основание иска «ДОЛЖНО БЫТЬ ЗАЯВЛЕНО В ТЕЧЕНИЕ ОДНОГО (1) ГОДА ПОСЛЕ ЕГО ВОЗНИКНОВЕНИЯ». Для делового пользователя за пределами Кореи это существенные условия, а не формальность.
Поскольку полный возврат требует отсутствия использования кредитов, создания Premium-клона и незавершённых задач, загрузка единственного файла или создание одного премиального клона закрывают этот путь. Так как порождение и воспроизведение и без того бесплатны, ловушки можно избежать — но лишь при условии, что оценку вы завершаете до загрузки.
Требование, чтобы «отдельные филиалы или компании имели каждая собственную подписку», ограничивает развёртывание у агентств и групп компаний; дополнительно отдельные соглашения требуются для служб интерфейса, создания собственных голосов и встраивания в автоматизированные системы.
Пользователям должно быть не менее 13 лет, а где местный закон требует большего — соответственно больше; функция говорящего аватара ограничена лицами от 17 лет. Запрещённое содержание охватывает сексуальные материалы, насилие и разжигание ненависти, политическую рекламу и предвыборную дезинформацию, мошенничество и подражание, посягательства на безопасность детей, а также нарушения прав интеллектуальной собственности и неприкосновенности частной жизни. Компания оставляет за собой право удалять порождённое содержание «по любой причине (или без причины)» и прекращать доступ без предварительного уведомления.
Это пробел в доказательствах, а не упрёк продукту. Профиль домена на Trustpilot на момент проверки был не востребован компанией и содержал единственный отзыв с оценкой 3,2 — выборка слишком мала для любого вывода о качестве, причём сам Trustpilot отмечает, что компания «не приглашала своих клиентов, поэтому отзывы могут быть непредставительны». Приложение для iOS показывало среднюю оценку 3,33 всего по трём оценкам, что также ниже любого осмысленного порога. Попытки проверить оценки на G2 и Capterra были заблокированы по всем доступным каналам, поэтому цифры, ходящие об этом во вторичных источниках, здесь не воспроизводятся. Тому, кто оценивает Typecast, следует испытать его напрямую, а не полагаться на сводные баллы.
Более 700 голосов, заявленные на маркетинговой странице более чем 35 языков (против 37 в документации) и приводимые в прессе числа пользователей — всё это сведения самой компании. Обратите внимание, насколько сильно число пользователей менялось в её же сообщениях: публикации о раунде B 2022 года называли «более миллиона пользователей», а материалы о предбиржевом раунде декабря 2025 года — «более двух миллионов зарегистрированных пользователей по всему миру». Зарегистрированные пользователи не равны активным, и ни одна из цифр не проверена независимо.
В качестве ориентира по устойчивости, а не одобрения: компания закрыла раунд B на 21,5 миллиона долларов в феврале 2022 года под предводительством BRV Capital Management, доведя общий объём привлечённого к тому моменту примерно до 26,7 миллиона, и предбиржевой раунд на 11,5 миллиона долларов, объявленный в декабре 2025 года, с участием HB Investment и K2 Investment Partners. Основана она в 2017 году бывшими инженерами Qualcomm. Предбиржевой раунд обозначает намерение выйти на биржу, что обычно приносит больше раскрытия, но также и стратегические перемены; ни то ни другое не гарантировано.
Действительно пригодный бесплатный уровень существует, но его предел лежит в определённом месте. Порождение и воспроизведение голоса безграничны на каждом уровне, включая бесплатный, — экспериментировать можно бесконечно и без затрат. Ограничена загрузка: бесплатный уровень даёт 3 000 пожизненных кредитов, около пяти минут звука, причём пожизненных, а не ежемесячных. Бесплатные загрузки ограничены пробными голосами, упираются в 16 кГц, ограничены тремя проектами и видео 720p с 1 ГБ хранилища и требуют указания авторства для всего загруженного. Это уровень для оценки, а не бесплатный производственный уровень.
Это самая ясная часть политики платформы и подлинное отличие. Политика использования гласит, что «актёры озвучивания сохраняют право собственности на свои голосовые модели» и что «несанкционированное воспроизведение, распространение или изменение голоса без разрешения строго запрещено». О согласии сказано, что компания обеспечивает, чтобы «каждый актёр озвучивания, чья голосовая модель доступна на платформе, явно согласился на случаи использования своего голоса». Далее устанавливается, что порождённое аудио «не может быть изменено так, чтобы искажать образ актёра, и не может использоваться для содержания, которое он не одобрил», а злоупотребления влекут удаление и возможные правовые действия. Компания продвигает эти голоса как «эксклюзивные голоса настоящих актёров озвучивания». Оговорка: это публичные обязательства компании; фактические договоры с отдельными актёрами не обнародованы, и ни в одном из изученных источников не раскрыты условия вознаграждения.
Можно, но условия меняются в зависимости от уровня и состояния подписки. С уровня Basic коммерческая лицензия включена, а указание авторства необязательно; на бесплатном плане указание требуется для всего загруженного. Политика предоставляет «неисключительное, непередаваемое право использовать порождённое нашими службами аудиосодержание в личных или коммерческих целях», но привязывает его ко времени: использование допустимо «исключительно в период вашей подписки», после чего вы сохраняете уже загруженное аудио, но новые загрузки и изменения невозможны. Отдельные филиалы или компании должны каждая иметь собственную подписку.
Оно удаляется. Результаты хранятся на серверах год с момента создания, а затем «автоматически удаляются с наших серверов без дополнительного уведомления». Это одинаково для платных и бесплатных пользователей. Удаление затрагивает лишь серверные копии — уже загруженные файлы остаются вашими, — но условия ясно указывают, что за сохранение нужного отвечаете вы, а у компании нет обязанности что-либо восстанавливать. Повторная загрузка возможна, только пока результат ещё хранится и пока подписка активна.
Планы простираются от бесплатного до 69 долларов в месяц со скидкой десять процентов при годовой оплате: Basic 5 долларов (30 000 кредитов, все голоса, один слот мгновенного клонирования, коммерческая лицензия), Plus 19 долларов (40 000 кредитов, управление скоростью, профессиональное клонирование, видео 4K), Pro 29 долларов (75 000 кредитов, эмоциональные регуляторы вместе со Smart Emotion, интонация и высота тона, два слота клонирования), Business 69 долларов (200 000 кредитов, десять слотов, участники команды, докупка кредитов), плюс корпоративный уровень по запросу. Нужный уровень зависит от желаемого управления: эмоциональные регуляторы начинаются с 29 долларов, управление скоростью — с 19, то есть заявляемая выразительность относится к уровню Pro.
Smart Emotion выводит подачу из контекста вместо того, чтобы требовать разметки каждой строки. Система читает окружающий текст — через интерфейс вы явно передаёте предыдущую и следующую реплики — и порождает чтение, отвечающее этому контексту, так что одинаковые слова звучат по-разному в зависимости от окружения. Компания описывает подход как построчный анализ сценария для получения соответствующего контексту тона. Привычные построчные эмоциональные метки сохраняются в виде собственной эмоции наряду с управлением интонацией и высотой тона, начиная с уровня Pro.
Маркетинговый сайт заявляет более 700 ИИ-голосов и более 35 языков; документация интерфейса указывает 37 языков через модель ssfm-v30 и более 500 голосов, доступных программно. Расхождение лучше всего объясняется тем, что веб-каталог и каталог интерфейса не совпадают полностью, поэтому проверяйте доступность нужного языка и голоса через тот уровень и ту оболочку, которыми собираетесь пользоваться. В документации прямо названы корейский, английский, японский, китайский, испанский и вьетнамский.
Да в обоих случаях, начиная с платных уровней. Мгновенное клонирование создаёт голос из короткого образца и открывается с Basic одним слотом; более точное профессиональное клонирование появляется с Plus. Число слотов растёт до двух на Pro и десяти на Business. Компания сообщает, что клонированный голос способен говорить на нескольких языках, и это главная практическая причина клонировать, а не выбирать из каталога. Права на клонируемый голос должны принадлежать вам: условия требуют заверения, что вы располагаете всеми необходимыми правами, лицензиями и согласиями, а клонирование чужого голоса без разрешения запрещено.
Typecast управляется компанией Neosapience, Inc., южнокорейской, основанной в 2017 году бывшими инженерами Qualcomm. Корейский сайт раскрывает лицо как 네오사피엔스 주식회사 с регистрационным номером 883-86-00767, представителем Тхэсу Кимом и адресом в Каннамгу, Сеул; то же лицо названо ответственным за защиту персональных данных. Условия подчинены законодательству Республики Корея, споры — корейскому гражданскому судопроизводству, и включают отказ от коллективного иска и годичный срок предъявления требований. Политика конфиденциальности заявляет соблюдение корейского закона о защите персональных данных наряду с режимами Европейского союза и Соединённого Королевства, калифорнийским законодательством о приватности и американскими правилами о приватности детей в сети.
Есть, и некоторые шире ожидаемого. Сексуальное и взрослое содержание запрещено, включая применение ИИ-голосов в услугах для взрослых. Политическая реклама запрещена без прямого письменного разрешения, равно как предвыборная дезинформация и подражание политикам или их родственникам. Мошенничество, введение в заблуждение, несанкционированное подражание любому лицу, разжигание ненависти, преследование, а также нарушения прав интеллектуальной собственности и приватности — всё это под запретом. Пользователям должно быть не менее 13 лет, а функция говорящего аватара требует 17 лет. Компания оставляет за собой право по своему усмотрению проверять и удалять порождённое содержание и закрывать учётные записи без предварительного уведомления.