Fish-Speech 1.5
Brak oszacowania
Brak wymagań sprzętowych dla tego modelu
Wagi tego modelu są OPEN, ale nie opublikowano liczby parametrów. Każda figura dotycząca MEMORY i prędkości zaczyna się od tej liczby, więc wolelibyśmy nic nie pokazywać niż wymyśloną estymację..
Na nagranie
Pełna specyfikacja
Wszystko na rekord dla tego modelu. Większość z tego opisuje, jak był trenowany, a nie jak działa — użyteczny kontekst do oceny, ile pracy włożono w to, i jak wypada w porównaniu z modelami budowanymi w innym skali..
Pochodzenie
Kto zbudował ten model, gdzie i kiedy został opublikowany.
- Organizacja
- Fish Audio
- Typ organizacji
- Industry
- Kraj
- United States of America
- Opublikowany
- 24 November 2024
Co to robi
Obszary problemowe, dla których stworzono model. Model może mieć kilka z każdego.
- Domena
- Speech
- Zadanie
- Speech synthesis, Text-to-speech (TTS)
Rozmiar
Jak duży jest model i na ile danych był trenowany. Parametry to liczba, która decyduje, czy mieści się na danej karcie graficznej.
- Dane treningowe
- 700,000,000,000 tokens
[tokens] Their previous model was trained on 720000 hours of audio data that was equal to 5*10^11 tokens -> 1M hours ~ 7*10^11 tokens model trained on more than 1 million hours of audio data in multiple languages.
Obliczenia treningowe
Arytmetyka wykonywana w celu wytrenowania modelu, mierzona w operacjach zmiennoprzecinkowych. Jest to miara kosztów przeprowadzenia treningu, a nie tego, jak szybko gotowy model odpowiada na twoje pytania.
- Obliczenia treningowe
- 2.7 × 10²¹ FLOP
- Jak to zostało ustalone
- Comparison with other models
Previous model Fish-Speech 1.4 used 1.9151355e+21 FLOP for training (see model card) and was trained on 720000 hours of audio, while this model is similar but trained on 1M hours of audio -> its training compute couldbe estimated as 1.9151355e+21 * 10^6 / 720000 = 2.6599104e+21 FLOP
Dostępność
Czy możesz zdobyć model i uruchomić go na swoim sprzęcie, co decyduje o tym, czy którakolwiek z cyfr karty graficznej na tej stronie ma zastosowanie.
- Wagi
- Open — downloadable
- Dostęp do modelu
- Open weights (non-commercial)
- Kod treningowy
- Open source
- Hugging Face
- fishaudio
weights are released under CC-BY-NC-SA-4.0 License https://huggingface.co/fishaudio/fish-speech-1.5 This codebase is released under Apache License https://github.com/fishaudio/fish-speech/tree/main/fish_speech
Jak jest klasyfikowane
Etykiety, które źródłowy zbiór danych stosuje podczas śledzenia znaczących modeli oraz jak pewny jest tego wpisu.
- Zapisz pewność
- Likely
Źródła
Skąd pochodzi ten rekord i kiedy był ostatnio sprawdzany.
- Referencja
- Fish Speech V1.5 is a leading text-to-speech (TTS) model trained on more than 1 million hours of audio data in multiple languages.
- Ostatnio zaktualizowane
- 28 November 2025
Co oznaczają liczby
Skąd to pochodzi
Fish-Speech 1.5 został opublikowany przez Fish Audio, w kraju zapisanym jako United States of America, podczas November 2024. Kategoria, do której należy wydawca, to industry.
Działa w dziedzinie Speech, i jest zapisany jako wykonujący zadanie speech synthesis, Text-to-speech (TTS).
Wagi są publikowane, więc można je pobrać i uruchomić na własnym sprzęcie bezterminowo, offline, bez przypisanego konta. Na Hugging Face jest opublikowane pod organizacją fishaudio.
Jak to zostało wytrenowane
Wytworzenie tego wymagało arytmetyki sumującej około 2.7 × 10²¹ FLOP. Ta liczba mierzy, ile kosztowało wyprodukowanie modelu i nie ma wpływu na to, jak szybko odpowiada.
Trening zużył korpus około 700,000,000,000 Tokeny tekstu.
Odpowiedzi
Fish-Speech 1.5 — częste pytania
Fish-Speech 1.5— ile mocy obliczeniowej użyto do jego trenowania?
Szkolenie zajęło około 2.7 × 10²¹ FLOP. To mierzy, ile kosztowało wyprodukowanie modelu i nie mówi nic o tym, jak szybko odpowiada po wytrenowaniu — prędkość wnioskowania pochodzi z SZEROKOŚCI PASMA, a nie z budżetu treningowego.
Fish-Speech 1.5— Jaką GPU potrzebuję, aby ją uruchomić?
Nie możemy powiedzieć. Ma otwarte wagi, ale nie opublikowano liczby parametrów, a wszelkie obliczenia pamięci i prędkości zaczynają się od tej liczby. Wolimy nie pokazywać niczego niż fałszywą szacunkową wartość.
Fish-Speech 1.5— czy jest open weight?
Jego wagi są opublikowane, więc można je pobrać i uruchomić na własnym sprzęcie. Zauważ, że OPEN WEIGHTS nie są tym samym co OPEN SOURCE w pełnym sensie — nie mówi nic o danych treningowych, kodzie treningowym, ani warunkach komercyjnych.
Fish-Speech 1.5— ile ma parametrów?
Nie opublikowano liczby parametrów, dlatego na tej stronie nie pojawia się żaden wskaźnik pamięci ani prędkości.
Fish-Speech 1.5— kto to stworzył?
Zostało opublikowane przez Fish Audio, oparty na United States of America, organizacja sklasyfikowana jako industry.
Fish-Speech 1.5— kiedy to zostało wydane?
Zostało opublikowane w November 2024. Możliwość na parametr znacznie się poprawiła, więc nowszy model tej samej wielkości często lepiej wykorzystuje ten sam sprzęt.
Fish-Speech 1.5— do czego to służy?
Działa w dziedzinie Speech, i jest zarejestrowany jako realizujący zadanie speech synthesis, Text-to-speech (TTS). To są obszary, wokół których został zaprojektowany; opisują zamiar, a nie twardą granicę.
Fish-Speech 1.5— Gdzie mogę to pobrać?
Jego wagi są publikowane na Hugging Face, pod organizacją fishaudio. Nie hostujemy plików modelu — ta strona oblicza, jaki sprzęt jest potrzebny do ich uruchomienia.
Druga strona
Patrząc na to z drugiej strony?
Ta strona zaczyna się od modelu. Jeśli już posiadasz kartę i chcesz wiedzieć, co wszystko będzie działać., Zacznij od sprzętu zamiast.