Resemble AI
Сервис · разбор собран по официальным страницам самой площадки и сервисов-помощников.
Обзор
Resemble AI — платформа безопасности генеративного ИИ плюс голосовые модели. Состав продуктов снят с машиночитаемого индекса сайта — файла llms.txt, объявленного в robots.txt самого Resemble.
Три части относятся к безопасности. Detect — распознавание дипфейков в аудио, видео и изображениях, в том числе в звонках и во встречах. Verify — провенанс-водяные знаки: PerTh для аудио, VideoSeal для изображений и видео. Identity — регистрация и сверка говорящего по образцу от четырёх секунд.
Голосовая часть вынесена в открытые модели: Chatterbox — синтез речи с клонированием голоса без предварительного обучения (zero-shot), а также Chatterbox Turbo, Chatterbox Multilingual и DramaBox. В подвале сайта отдельно перечислены Resemble TTS, Resemble Voice Creation, Resemble Audio и Resemble STS.
Про язык ввода источник говорит прямо. Chatterbox Multilingual заявлена как «20+ languages», и список назван поимённо: Arabic, Chinese, Czech, Dutch, English, Finnish, French, German, Hebrew, Hindi, Italian, Japanese, Korean, Norwegian, Polish, Portuguese, Russian, Spanish, Swedish, Turkish, Vietnamese. Русский, арабский, хинди и китайский в списке есть. Модель выложена под лицензией MIT, и доступ к ней от тарифа не зависит. Для распознавания дипфейков заявлена валидация на 51 языке.
С какими площадками работает
Ответ известен наполовину. Прямой выгрузки готового аудио на публикационные площадки в прочитанном нет: раздела про выгрузку результата в социальные сети или на стриминговые службы на сайте не нашлось.
Что документировано — интеграции рабочих процессов и безопасности. Для Resemble Meetings названы Zoom, Microsoft Teams, Google Meet и Webex. Отдельно перечислены расширение для Chrome, протоколы SIP и SIPREC для телеком-операторов, SDK для Python, Node.js и JavaScript и отдельная страница Integrations and environments. Развёртывание заявлено в трёх видах: в облаке, на своей площадке и в изолированном контуре. Это места, откуда сервис берёт звук на проверку, а не места, куда он выкладывает готовое.
Сколько стоит
Цены — со страницы цен, валюта — доллары США.
TEAM — 350 долларов в месяц при помесячной оплате и 280 долларов в месяц при годовой; экономия за год названа как 840 долларов. В тариф входят 5 мест, пониженные тарифы обработки, Intelligence для встреч, крупные и пакетные загрузки.
BUSINESS — 1000 долларов в месяц помесячно и 800 долларов в месяц при годовой оплате, экономия 2400 долларов в год. Входят 20 мест, общекорпоративная интеграция календаря, уведомления безопасности для встреч и SSO.
ENTERPRISE — цена по договору: объёмные скидки, SLA, дообучение модели, установка на своей площадке.
Минимальная платная ступень — 280 долларов в месяц, это TEAM при годовой оплате. Бесплатная ступень FLEX стоит 0 долларов и тарифицируется поштучно.
Оговорка важна: тарифная таблица покрывает Detect, Intelligence, Meetings, Identity и Watermarker. Отдельного прайса на синтез речи и клонирование голоса на странице цен нет.
Что бесплатно
FLEX — 0 долларов в месяц: без абонентской платы и без карты, оплата по факту из заранее купленных кредитов.
В FLEX входят распознавание дипфейков в аудио, изображениях и видео, аналитика Intelligence, регистрация личности, распознавание в реальном времени для встреч, проверка SynthID и подпись записей C2PA, доступ к платформе и API. Мест в команде — одно.
Про кредиты страница отвечает дословно: «No, credits on the Flex Plan never expire» — они не сгорают никогда.
Ноль в графе абонентской платы не означает бесплатной работы: платить придётся за фактически обработанные секунды и вызовы, а не за месяц.
Ограничения
Лимитов в минутах у сервиса нет: тарификация посекундная и повызовная, а ставка зависит от тарифа. Ставки — из блока «Processing rates» на странице цен.
Detect для аудио и изображений — 0,03500 доллара за секунду на FLEX и 0,01500 доллара на TEAM и BUSINESS. Detect для видео — 0,07000 и 0,03000 доллара за секунду соответственно. Intelligence — 0,02500 и 0,01500 доллара за секунду. Identity search — 0,00050 доллара за вызов. Watermarker: encode — 0,00050 доллара, decode — 0,00020 доллара за вызов. Для ENTERPRISE заявлено объёмное ценообразование.
Места считаются по тарифам: 1 на FLEX, 5 на TEAM, 20 на BUSINESS. Кредиты FLEX бессрочные, минимальных обязательств нет.
Ограничение устроено не как потолок, а как ставка: разница между FLEX и платными тарифами — это разница в цене секунды.
Права на результат
Ответ известен частично. Условия пользования прямой передачи прав на сгенерированное аудио не содержат: формулировки о владении выдачей (Output) в тексте нет. Различий по тарифам условия здесь тоже не описывают.
Что в условиях есть: Resemble оставляет за собой права на Aggregated Data — обезличенные производные и метаданные. И есть прямой запрет применять выдачу «to train, improve, or otherwise further develop your own or any third party's product» — обучать на ней, улучшать ею и развивать свой продукт или продукт третьей стороны нельзя.
Отдельная ветка — открытые модели. Для Chatterbox Multilingual заявлено «Full model weights on Hugging Face … No vendor lock-in, no commercial restrictions» под лицензией MIT: полные веса выложены, привязки к поставщику и коммерческих ограничений нет. Оговорка важна: это относится к самостоятельно размещённой открытой модели, а не к работе через платформу.
Чего не хватило: кому принадлежит аудио, созданное через платформу, из прочитанного не следует.
Учат ли на ваших данных
Ответ известен частично: условия разграничивают два понятия.
Content — то, что вы загрузили, — используется «for the purposes of having Resemble AI synthesizing and generating an AI voice model»: чтобы Resemble синтезировала и создала голосовую модель.
Aggregated Data — обезличенные производные и метаданные — «may be used for … internal learning and training», то есть могут идти на внутреннее обучение, а также на отладку, исправление ошибок и развитие продукта.
Чего не хватило: прямого утверждения, что исходные пользовательские записи идут в обучение продуктовых моделей, в тексте нет, и объём обучения на сыром аудио не раскрыт.
Отказ не описан вовсе. Механизма отказа от использования контента и агрегированных данных для внутреннего обучения условия не дают — ни настройкой, ни тарифом. Но это не заявление о том, что отказаться можно.
Заработок на нём
Коммерческое использование прямо разрешено в одной ветке — открытой: для Chatterbox Multilingual заявлено «No vendor lock-in, no commercial restrictions» под лицензией MIT, и от тарифа это не зависит.
По результату, созданному через саму платформу, ответа нет: передачи прав на выдачу условия не описывают, различий по тарифам не проводят. Отсутствие ответа — не разрешение и не запрет.
Один запрет действует поверх всего: выдачу нельзя применять, чтобы обучать, улучшать или развивать свой продукт или продукт третьей стороны.
Чего он не сделает
Самое острое здесь — чей голос можно загружать.
Согласие человека, чей голос клонируют, требуется. Условия пользования говорят дословно, с орфографией источника: «Resemble may require consent form the individual or third party whose voice is being cloned. Consent needs to be verbal, unless otherwise stated by Resemble». Согласие по умолчанию — устное, а не письменное; иная форма может потребоваться, только если Resemble прямо укажет другое. Пользователь, кроме того, заявляет, что владеет контентом либо имеет «the necessary licenses, rights, consents and permissions» — необходимые лицензии, права, согласия и разрешения.
Страница этики формулирует то же жёстче: «voice cloning only occurs with the explicit consent of the individual» — клонирование голоса происходит только с явного согласия человека.
Согласие проверяется: личность при его получении сверяется технологией распознавания говорящего Resemblyzer.
А вот отдельного прямого запрета клонировать голос публичной персоны в прочитанном нет — такой нормы не встречается. Ближайшее к ней — общий запрет на «impersonation without authorization», выдачу себя за другого без разрешения. Читать это как разрешение на голоса публичных лиц нельзя: требование согласия человека, чей голос клонируют, никаких исключений в источнике не имеет. Не хватает лишь отдельно объявленной нормы именно про публичных лиц.
Запрещённые темы названы списком: язык вражды и дискриминация, терроризм и насилие, эксплуатация детей, неатрибутированный контент и искажение источника, нежелательные массовые рассылки, вводящие в заблуждение сообщения. В условиях к этому добавлены ложные заявления об аффилиации и фишинг ради получения финансовых сведений.
Опубликовать готовое аудио за вас не сможет: прямой выгрузки на публикационные площадки в прочитанном нет.
Назвать цену синтеза речи и клонирования голоса тоже не сможет: отдельного прайса на голосовую часть на странице цен нет.
Дать отказаться от внутреннего обучения не готов: механизма отказа условия не описывают.
С маркировкой картина неровная. Для открытых моделей она заявлена обязательной и автоматической: «Every clip is watermarked with PerTh at generation, before it leaves the model» — это про Chatterbox Multilingual, и «Every output watermarked with PerTh at generation» — про DramaBox. Знак заявлен неслышимым и устойчивым к перекодированию. А в условиях Resemble Watermarker упомянут только как продукт: обязательности маркировки всех выходов платформы и различий по тарифам там не описано. Обязательность подтверждена для конкретных моделей; общеплатформенного правила в прочитанном нет.
Проверенные факты из базы
Краткие проверенные данные, на которые опирается разбор.
Что это за площадка
Платформа безопасности генеративного ИИ плюс голосовые модели. Detect — распознавание дипфейков в аудио, видео и изображениях, в том числе в звонках и в Zoom, Teams, Meet, Webex. Verify — провенанс-водяные знаки: PerTh для аудио, VideoSeal для изображений и видео. Identity — регистрация и сверка говорящего по образцу от четырёх секунд. Голосовая часть вынесена в открытые модели: Chatterbox (TTS с zero-shot клонированием голоса), Chatterbox Turbo, Chatterbox Multilingual, DramaBox; в футере сайта отдельно перечислены Resemble TTS, Resemble Voice Creation, Resemble Audio и Resemble STS
llms.txt — официальный машиночитаемый индекс сайта, объявленный в самом robots.txt Resemble; состав продуктов сверен с футером https://www.resemble.ai/pricing
Chatterbox Multilingual: «20+ languages» (дословно) — Arabic, Chinese, Czech, Dutch, English, Finnish, French, German, Hebrew, Hindi, Italian, Japanese, Korean, Norwegian, Polish, Portuguese, Russian, Spanish, Swedish, Turkish, Vietnamese. Русский, арабский, хинди и китайский есть в списке. Модель под лицензией MIT, от тарифа не зависит. Для распознавания дипфейков заявлена валидация на 51 языке
Цифра 51 язык для Detect взята из https://www.resemble.ai/llms.txt
Платформы
Прямой выгрузки готового аудио на публикационные площадки в прочитанном нет. Документированы интеграции рабочих процессов и безопасности: Zoom, Microsoft Teams, Google Meet и Webex для Resemble Meetings, расширение для Chrome, SIP и SIPREC для телеком-операторов, SDK для Python, Node.js и JavaScript, отдельная страница Integrations and environments. Развёртывание заявлено в облаке, на своей площадке и в изолированном контуре
Раздела про выгрузку результата в соцсети или на стриминг на сайте нет; перечислены только интеграции рабочих процессов
Сколько стоит
FLEX — $0 в месяц, без абонентской платы и без карты, оплата по факту из заранее купленных кредитов. Входит: распознавание дипфейков в аудио, изображениях и видео, аналитика Intelligence, регистрация личности, распознавание в реальном времени для встреч, проверка SynthID и подпись записей C2PA, доступ к платформе и API; 1 место в команде. «No, credits on the Flex Plan never expire» (дословно)
Состав FLEX и ответ про кредиты взяты из тарифной таблицы и блока FAQ той же страницы
TEAM — $350 в месяц при помесячной оплате и $280 в месяц при годовой (экономия $840 в год), 5 мест, пониженные тарифы обработки, Intelligence для встреч, крупные и пакетные загрузки. BUSINESS — $1,000 в месяц помесячно и $800 в месяц при годовой (экономия $2,400 в год), 20 мест, общекорпоративная интеграция календаря, уведомления безопасности для встреч, SSO. ENTERPRISE — цена по договору (объёмные скидки, SLA, дообучение модели, установка на своей площадке). ВАЖНО: тарифная таблица покрывает Detect, Intelligence, Meetings, Identity и Watermarker; отдельного прайса на синтез речи и клонирование голоса на странице цен нет
Заголовок страницы — «Deepfake Detection & AI Security Pricing | Resemble AI», что подтверждает текущее позиционирование прайса
280 USD в месяц — тариф TEAM при годовой оплате; при помесячной оплате 350 USD в месяц. Бесплатная ступень FLEX стоит 0 USD и тарифицируется поштучно
Суммы взяты из тарифной таблицы и из сводной таблицы «Transparent flexible pricing» на той же странице
Ограничения и лимиты
Лимитов в минутах нет, тарификация посекундная и повызовная. Detect для аудио и изображений: $0.03500 за секунду на FLEX и $0.01500 на TEAM и BUSINESS. Detect для видео: $0.07000 и $0.03000 за секунду. Intelligence: $0.02500 и $0.01500 за секунду. Identity search: $0.00050 за вызов. Watermarker encode — $0.00050, decode — $0.00020 за вызов. Для ENTERPRISE заявлено volume pricing. Места: 1 на FLEX, 5 на TEAM, 20 на BUSINESS. Кредиты FLEX бессрочные, минимальных обязательств нет
Ставки взяты из блока «Processing rates» сводной таблицы
Ограничения
ЧЕЙ ГОЛОС: требуется согласие человека, чей голос клонируют. Terms of Service: «Resemble may require consent form the individual or third party whose voice is being cloned. Consent needs to be verbal, unless otherwise stated by Resemble» (дословно, орфография источника сохранена) — то есть согласие по умолчанию УСТНОЕ, а не письменное. Пользователь также заявляет, что владеет контентом либо имеет «the necessary licenses, rights, consents and permissions». Страница этики: «voice cloning only occurs with the explicit consent of the individual» (дословно). ПРОВЕРКА: личность при получении согласия сверяется технологией распознавания говорящего Resemblyzer. Отдельного прямого запрета клонировать голос публичной персоны НЕТ — в прочитанном такой нормы не встречается, ближайшее — общий запрет на «impersonation without authorization». ЗАПРЕЩЁННЫЕ ТЕМЫ: язык вражды и дискриминация, терроризм и насилие, эксплуатация детей, неатрибутированный контент и искажение источника, нежелательные массовые рассылки, вводящие в заблуждение сообщения; в условиях дополнительно — ложные заявления об аффилиации и фишинг ради получения финансовых сведений
Формулировки о явном согласии и проверке через Resemblyzer и перечень запрещённых применений — со страницы https://www.resemble.ai/company/ethics
Правовое
Условия НЕ содержат прямой передачи пользователю прав на сгенерированное аудио: формулировки о владении Output в тексте нет. Resemble оставляет за собой права на Aggregated Data — обезличенные производные и метаданные. Пользователю запрещено применять выдачу «to train, improve, or otherwise further develop your own or any third party's product» (дословно). Различий по тарифам в условиях не описано. Отдельная ветка — открытые модели: для Chatterbox Multilingual заявлено «Full model weights on Hugging Face ... No vendor lock-in, no commercial restrictions» под лицензией MIT
Оговорка про MIT и отсутствие коммерческих ограничений относится только к самостоятельно размещаемой открытой модели, источник — https://www.resemble.ai/learn/models/chatterbox-multilingual
Условия допускают внутреннее обучение на производных данных: Content используется «for the purposes of having Resemble AI synthesizing and generating an AI voice model» (дословно), а Aggregated Data «may be used for ... internal learning and training» (дословно), а также для отладки, исправления ошибок и развития продукта. Прямого утверждения, что исходные пользовательские записи идут в обучение продуктовых моделей, в тексте нет
Разграничение между Content и Aggregated Data в условиях есть, но объём обучения на сыром аудио не раскрыт
Водяной знак PerTh — собственная технология Resemble; для открытых моделей маркировка заявлена как обязательная и автоматическая: «Every clip is watermarked with PerTh at generation, before it leaves the model» (дословно, Chatterbox Multilingual); для DramaBox — «Every output watermarked with PerTh at generation». Знак заявлен как неслышимый и устойчивый к перекодированию. В Terms of Service Resemble Watermarker упомянут только как продукт: обязательность маркировки всех выходов платформы и различия по тарифам там не описаны. Платно тарифицируются вызовы Watermarker encode и decode
Утверждение об обязательной маркировке относится к конкретным моделям; общеплатформенного правила в условиях не найдено
Раздел каталога: все похожие Смотрите также: указатель каталога · сравнение планировщиков · подбор по ситуации · ограничения площадок