-
Публикаций
93 -
Зарегистрирован
-
Посещение
-
Победитель дней
1
Warlock700 стал победителем дня 24 сентября 2025
Warlock700 имел наиболее популярный контент!
Репутация
167 ХорошаяИнформация о Warlock700
-
Звание
Новичок
- День рождения 07.10.1992
Дополнительная информация
-
Пол
Мужчина
-
Город
Саратов
Посетители профиля
Блок последних пользователей отключён и не показывается другим пользователям.
-
Многое зависит от того, как использовать модель. Если через TTS, но да - нормальными будут по большей части монолитовцы. Дополнено 23 минуты спустя Вам бы их выложить в общий доступ выложить для других энтузиастов, на тот же Hugging-Face, чтобы желающие их могли пощупать лично. Так же насколько помню, не у всех моделей, что Вы назвали, будет много материала. Обычно модели с дата-сетом менее, чем 2 минуты, вносят искажения в конечный результат. Как раз из-за этого застрял с моделями по RVC Warcraft IIi Voices. Дополнено 27 минуты спустя Мои поздравления и удачи - процесс моддинга и записи аудио для преобразования требует много времени и моральных сил, особенно когда RVC начинает "брыкать" и даже полностью чистый материал коверкать. Попутно явно стоит дополнительно изучить и обработку аудио, чтобы чистить дата-сеты перед обучением и материал для преобразования. По поводу сортировки - мои соболезнования, далеко не все имеет в серии игр корректные обозначения говорящего и приходится часто только на слух определять, кто говорит. Можно подписаться на тему, как это сделал я, чтобы получать уведомления в виде писем на электронную почту.
-
Olexa007 подписался на Warlock700
-
Пока что - личная жизнь, а так же редкий выпуск моделей по RVC Warcraft III Voices. Далее - либо подготовка материала по TTS`кам, либо продолжение выпуска патчей для RVC Jokes Pack, либо же модели по тем дата-сетам, что приложил ниже. Со временем забыл о них, а здесь и сейчас они могут кому-нибудь пригодиться - как для моделей, так и в чистом виде. Неотсортированный материал по Метро Исход, Таркову. Дата-сет Таркова был получен давно - еще в 2024-ом, как и по Сталкрафту, и может отличаться от того, что сейчас в релизной версии Таркова, а так же от Stalzone: https://drive.google.com/file/d/1GLhm7HzNtZ0K0TvuVwLuyBqqEl504XAJ/view?usp=sharing Примечание: как и в случае с дата-сетами - архив со временем может быть удален:
-
Я так же залью все свое, что может потенциально пригодиться желающим обучить свои модели. Сам я пока отставил в сторону модели по Сталкеру, поскольку если я начну заниматься тем, что было описано - это займет очень много времени. Одна сортировка материала, а так же распаковка билдов, чего будет стоять. Здесь оригинальные и отсортированные по условным обозначениям фразы из Сталкера и Метро 2033 1-2 частей. Где-то, конечно, мог спутать один голос с другим, но в основной своей массе сортировка верная: https://disk.yandex.ru/d/FQ7M9EP9rFwlzQ Здесь же подготовленные к обучению дата-сеты для этих же моделей: https://drive.google.com/file/d/1VLQr_dcK8YWY1Jt6tyL5O4LLwyx2T8LX/view?usp=sharing Примечание: Из-за объема данных есть вероятность, что могу удалить архив с дата-сетами со временем.
-
Похвальный список - постарались!) Причем сделали все то, чего не было в моем исполнении, значительно расширяя пласт для обработки под нужды мододелов. Как я успел заметить - большинство использует либо как раз TTS, либо же для использования при преобразовании в реальном времени. Это может быть просто совпадение, что обращаются чаще именно такие пользователи, а остальные скачивают модели и особо о себе не заявляют. Да и TTS сейчас стало гораздо больше. Да, не все из них дотягивают до 11labs, но результат так же достойный, причем бесплатно, локально и менее затратно, чем обучать RVC модели. FishSpeech, Qwen3-TTS, Voicebox. SO-VITS и др., причем только последний требует непосредственно обучить модель, поскольку RVC`шные не подойдут. И вроде с последним рассматривается вариант расширить преобразование до аудио-в-аудио - референс, и очень хотелось бы его пощупать, а так же сравнить с RVC. По сути, для повышения качества по моему мнению не хватает только реплик: Зорина и Яценко, если рассматривать отдельные модели, то Ноя и Бороды. Те, что запрашивали у меня, создать не получится: Воронин - мало реплик, проще использовать модель долговца Вилкова; Стрелок - тоже самое; Волк - аналогично, но с моделью сталкеров в озвучке Розина; Петруха - тоже самое. А если особенно сильно заморачиваться, распределяя голоса по интонациям, то можно попросту зависнуть - билды, из которых можно добыть много черновой озвучки, как для того же Прохорова, так и других. В Метро 2033 можно набрать много разного материала, в том числе из разных типов изданий, а так же из билдов. Ранее упомянутая украинская озвучка тоже. Еще советовали Chernobylite распаковать и оттуда голос Вихрова набрать. А после всего этого обучать модели под каждого актера, как делал с моделями Прохорова и Череватенко. Где бы найти столько свободного времени и мощностей, чтобы все это дело сортировать, очищать от шумов, а особенно - обучать модели?) Тем более, что я еще не переобучил все для RVC Warcraft III Voices, а так же почти совершенно не притрагивался к переозвучке анекдотов RVC Jokes Pack и даже не вышел из стадии "в планах" по проекту расширения озвучки штатный NPC и голосов для них. Так что задач хватает.) И я рад, что делитесь своими работами и помогаете мододелам. Значит мой проект понемногу, но делает свое дело - продвигает RVC и нейросети для Сталкера в массы.)
-
Приветствую. Я делаю модели исключительно из русской озвучки, украинскую не распаковывал и не слушал. Модель Бармена я не делал, поскольку там было очень мало материала, а для рядовых NPC его достаточно. Не делал модели с эффектом рации, а до недавнего времени и с эффектом одетого шлема тоже, поскольку все это можно сделать с помощью пост-обработки. Да и как показала практика - моделей итак в изобилии и пользуются сбросом те, по которым они уже есть качественные, то есть обученные на fp32 и contentvec. А другие модели, которые запрашивают, наоборот - имеют очень мало материала и даже если добавить туда украинские аудиофайлы, то это не сделает особой погоды. Для примера: Воронин, Стрелок, Борода, Ной и прочие. И в случае с этими персонажами можно использовать другие модели: Воронин и Стрелок - долговская; Ной и Борода - Череватенко; (полная) И другие... С эффектом рации, конечно, тоже можно модели сделать со временем, но только на те голоса, где их наберется достаточно. А поскольку при сортировке я такой материал удалял - все придется распаковывать заново, а так же прослушивал и распределять по актерам/ролям. Так что пока такой цел не стоит, чтобы набрать как можно больше материала - где-то его итак достаточно, а где-то лишних 40 секунд ситуацию не спасут. Дополнено 1 минуту спустя Если необходимо - я могу залить свои дата-сеты, включая обработанные варианты. Послушаете, выберите, дополните свои дата-сеты, поскольку у меня там есть и от Метро 2033 реплики, отсортированные по ролям и/или актерам.
-
Добавлены новые модели - все они были обучены на сложности fp32, очищены de_noise от шумов и нормализованы штатным для Applio способом предобработки дата-сета: Зиновенко - Москвин; (Метро 2033: Last Light) Зиновенко - Корбут; (Метро 2033: Last Light) Плахов - Лесницкий; (Метро 2033: Last Light) Прохоров - Сидорович; Герман - Бурбон. (Метро 2033) Добавлена пробная модель Сидоровича в исполнении Подубинского с теми же настройками, но на претрейне Snowie3.1, который улучшает речь на русском и японском.
-
Тут скорее дело не в знании языка, а в том, что паттерны произношения остаются и даже усиливаются из-за connentvec, если преобразовывать англоговорящую речь в русскоговорящую. В обратную сторону это работает, но меньше бросается в уши. Поэтому, чтобы не возникали проблемы с акцентом - для англоговорящих голосов нужна такая же речь. Но можно использовать TTS в таких задачах, если нужен хороший результат. Мне для работы речь-в-речь такой вариант не подходит. Благодарю за предложение. У меня итак довольно много моделей и столько же планов по ним, но не хватает мощностей, чтобы обучать все и в короткие сроки и не испытывать дискомфорт от невозможности использовать ПК в иных задачах.
-
Очень хорошо, что с Апплио разобрались - на текущий момент это один из самых перспективных проектов по RVC, к тому же они часто вводят экспериментальные методы, которые не перечеркивают текущую успешную генерацию. Увы, spin алгоритм не оказывает хорошего влияния на дата-сет, как и новый энкодер, поэтому все еще стабильными остаются стандартные настройки на contentvec. Увы, дата-сеты на английском языке будут иметь характерный языку акцент при преобразовании русской речи, поэтому такой вариант обучения нежелателен. От него можно избавиться, но костыльным способом - преобразовать какой-то материал моделью с акцентом, а потом полученным материал отправить обучаться вновь для получения уже русскоговорящей модели. В этом случае эмоциональность выходной модели будет оставлять желать лучшего, а так же голос приобретет те характерные свойства речи, что были у голоса донора на русском. Сейчас я занялся обучением моделей по Warcraft III, поскольку все мои модели по этой вселенной лежали на weight-gg. Просто выложить старые модели - это не совсем вариант, поскольку произошло много изменений с того времени, поэтому обучаю их уже с учетом того опыта, что у меня уже есть. Несколько моделей уже успел залить на hugging-face. Благодарю, хоть и не праздную. Вас тоже поздравляю.
-
Увы, но с RVC не всегда все проходит гладко, тем более, что эмоциональная подача не совсем мне свойственна. Доработка будет, просто не назову сроки. Свободу уже переделал - ее уже можно оценивать на твердую четверку по моей субъективной оценке.
-
Из того, что посоветовал Грок, доступно должно быть все: - Сам Hugging Face, где размещены модели https://huggingface.co/Warlock700 - MimicPC - https://www.mimicpc.com/demo/RVC - Voice.aI - https://voice.ai/ - FineVoice - https://finevoice.ai/ - Kaggle/Colab форки RVC других энтузиастов. Я не занимаюсь преобразованием и обучением онлайн, поэтому никогда не стояло задачи пользоваться моделям через сайты, коллабы или каглы других пользователей. Даже Weight.gg использовался исключительно для размещения моделей, всем остальным занимался локально.
-
Согласен с комментаторами на Реддит - сайт выглядит просто вырвиглазно... Но преобразование моделями работает, пришлось зарегистрироваться, чтобы проверить этот момент. Не вижу необходимости переносить туда модели. Тут сразу несколько причин: - Hugging-face удобнее, бесплатен и не требует регистрации; - Удобная категоризация, а у некоторых моделей есть несколько вариантов обучения; - Easyvoice поддерживает импорт моделей, то есть скопировав и вставив ссылку - он сам подцепит модель.
-
На Hugging-face. Данные ресурсы нужны для использования RVC онлайн теми, кто не может преобразовывать материал локально на своем ПК, а не для хранения моделей. Все модели уже лежат там, ссылки в теме тоже переделаны на него.
-
Есть информация, которую не размещал тут, но она не до конца проверена - сервисы, которые предложил Грок в качестве онлайн генераторов для работы с RVC моделям. Имеются свои нюансы, часть которых проверить не представляется возможным, если не регистрироваться: - MimicPC точно дает возможность работы с RVC моделями, но бесплатно, либо в ограниченном режиме - не сообщу, поскольку нужна регистрация. - Voice.AI требует скачать их софт для того, чтобы начать преобразование, а его я скачивать точно не буду. - FineVoice точно имеет возможность загрузки RVC моделей, но неизвестно, платное, либо бесплатное преобразование; - TopMediaAI требует регистрацию, чтобы начать работу с клонированием голоса. - (не попало на скрин) - поднятие Kaggle/Colab WebUI версии RVC. Есть энтузиасты, которые в общем доступе выкладывали свои форки. Будут ли они столько же качественными, как Weight.gg и Applio - однозначного ответа у меня нет, поскольку в моем случае используется только локальный вариант преобразования и не иначе.
-
Ролик с новостями о закрытии Weight-GG. Для завсегдатаев данной темы новой информации в нем не будет:
