Fish-Speech 1.5
Žádný odhad
Žádné hardwarové požadavky pro tento model
Hmotnosti tohoto modelu jsou otevřené, ale žádný počet parametrů pro něj nebyl zveřejněn. Každé číslo týkající se paměti a rychlosti vychází z této hodnoty, takže bychom raději nic neukázali, než fabrikaovaný odhad..
Na záznamu
Plná specifikace
Všechno o tomto modelu v záznamech. Většina z toho popisuje, jak byl trénován, spíše než jak funguje — užitečný kontext pro posouzení, kolik práce do něj bylo vynaloženo, a jak se srovnává s modely postavenými na jiné úrovni..
Původ
Kdo vytvořil tento model, kde a kdy byl publikován.
- Organizace
- Fish Audio
- Typ organizace
- Industry
- Země
- United States of America
- Publikováno
- 24 November 2024
Co to dělá
Problémové oblasti, pro které byl model vytvořen. Model může obsahovat několik z každého.
- Doména
- Speech
- Úkol
- Speech synthesis, Text-to-speech (TTS)
Velikost
Jak velký je model a kolik dat byl trénován. Parametry jsou číslo, které rozhoduje, zda se vejde na danou grafickou kartu.
- Výcviková data
- 700,000,000,000 tokens
[tokens] Their previous model was trained on 720000 hours of audio data that was equal to 5*10^11 tokens -> 1M hours ~ 7*10^11 tokens model trained on more than 1 million hours of audio data in multiple languages.
Výpočty pro trénink
Aritmetika prováděná k trénování modelu, měřená v operacích s plovoucí desetinnou čárkou. Je to měřítko toho, kolik stál tréninkový běh, ne jak rychle hotový model na vás odpovídá.
- Výpočty pro trénink
- 2.7 × 10²¹ FLOP
- Jak bylo ustanoveno
- Comparison with other models
Previous model Fish-Speech 1.4 used 1.9151355e+21 FLOP for training (see model card) and was trained on 720000 hours of audio, while this model is similar but trained on 1M hours of audio -> its training compute couldbe estimated as 1.9151355e+21 * 10^6 / 720000 = 2.6599104e+21 FLOP
Dostupnost
Zda můžete získat model a spustit ho na svém vlastním hardwaru, což rozhoduje o tom, zda se některé z čísel grafických karet na této stránce vztahují.
- Hmotnosti
- Open — downloadable
- Přístup k modelu
- Open weights (non-commercial)
- Tréninkový kód
- Open source
- Hugging Face
- fishaudio
weights are released under CC-BY-NC-SA-4.0 License https://huggingface.co/fishaudio/fish-speech-1.5 This codebase is released under Apache License https://github.com/fishaudio/fish-speech/tree/main/fish_speech
Jak je to klasifikováno
Štítky aplikačních datových sad, které se používají při sledování významných modelů, a jak jistý je ve záznamu.
- Záznam důvěry
- Likely
Žrovy
Odkud tento záznam pochází a kdy byl naposledy zkontrolován.
- Reference
- Fish Speech V1.5 is a leading text-to-speech (TTS) model trained on more than 1 million hours of audio data in multiple languages.
- Nap poslední aktualizace
- 28 November 2025
Co čísla znamenají
Odkud to přišlo
Fish-Speech 1.5 byl zveřejněn Fish Audio, v zemi zaznamenané jako United States of America, během November 2024. Kategorie, do které vydavatel spadá, je industry.
funguje v oblasti Speech, a je zaznamenán jako vykonávající úkol speech synthesis, Text-to-speech (TTS).
Váhy jsou zveřejněny, takže si je můžete stáhnout a spustit na své vlastní hardwaru neomezeně, offline, bez připojeného účtu. Na Hugging Face je publikováno pod organizací fishaudio.
Jak bylo trénováno
Produkce toho vyžadovala aritmetiku v celkové výši přibližně 2.7 × 10²¹ FLOP. Tato částka měří, kolik stál výroba modelu, a nemá žádný vliv na to, jak rychle odpovídá.
Trénink spotřeboval korpus kolem 700,000,000,000 tokeny textu
Odpovědi
Fish-Speech 1.5 — běžné otázky
Fish-Speech 1.5— kolik výpočetního výkonu bylo použito k jeho trénování?
Trénink spotřeboval kolem 2.7 × 10²¹ FLOP. To měří, co stálo výrobu modelu, a neříká nic o tom, jak rychle odpovídá po natrénování — rychlost inferencí závisí na šířce pásma paměti, nikoli na rozpočtu na trénink.
Fish-Speech 1.5— Jakou GPU potřebuji k jejímu spuštění?
Nemůžeme říct. Má otevřené váhy, ale žádný počet parametrů pro něj nebyl zveřejněn a každý výpočet paměti a rychlosti začíná od toho čísla. Raději bychom ukázali nic než vykonstruovaný odhad.
Fish-Speech 1.5— Je to OPEN SOURCE?
Jeho váhy jsou zveřejněny, takže si je lze stáhnout a spustit na vlastním hardwaru. Všimněte si, že open WEIGHTS není totéž co open SOURCE v plném smyslu — neříká nic o tréninkových datech, tréninkovém kódu nebo obchodních podmínkách připojených.
Fish-Speech 1.5— kolik má parametrů?
Pro něj nebyl zveřejněn žádný počet parametrů, a proto se na této stránce neobjevují žádné údaje o paměti nebo rychlosti.
Fish-Speech 1.5— Kdo to vytvořil?
Bylo to publikováno společností Fish Audio, zakládající se na United States of America, organizace zařazená jako industry.
Fish-Speech 1.5— Kdy byl vydán?
Bylo to zveřejněno v November 2024. Schopnost na parametr se od té doby výrazně zlepšila, takže novější model stejné velikosti je často lepším využitím stejného hardwaru.
Fish-Speech 1.5— K čemu se to používá?
funguje v oblasti Speech, a je zaznamenáno jako zpracovávající úkol speech synthesis, Text-to-speech (TTS). Toto jsou oblasti, kolem nichž byl navržen; popisují záměr spíše než tvrdou hranici.
Fish-Speech 1.5— kde si to mohu stáhnout?
Jeho váhy jsou publikovány na Hugging Face, pod organizací fishaudio. Na našem webu nenabízíme soubory modelů — tento web vypočítává, jaký hardware je potřebný pro jejich spuštění.
Druhý směr
Díváte se na to z druhé strany?
Tato stránka začíná od modelu. Pokud již vlastníte kartu a chcete vědět všechno, co bude spuštěno, začněte raději od hardwaru.