Fish-Speech 1.5

Otevřít váhy Fish Audio November 2024

Žádný odhad

Žádné hardwarové požadavky pro tento model

Hmotnosti tohoto modelu jsou otevřené, ale žádný počet parametrů pro něj nebyl zveřejněn. Každé číslo týkající se paměti a rychlosti vychází z této hodnoty, takže bychom raději nic neukázali, než fabrikaovaný odhad..

Na záznamu

Plná specifikace

Všechno o tomto modelu v záznamech. Většina z toho popisuje, jak byl trénován, spíše než jak funguje — užitečný kontext pro posouzení, kolik práce do něj bylo vynaloženo, a jak se srovnává s modely postavenými na jiné úrovni..

Původ

Kdo vytvořil tento model, kde a kdy byl publikován.

Organizace
Fish Audio
Typ organizace
Industry
Země
United States of America
Publikováno
24 November 2024

Co to dělá

Problémové oblasti, pro které byl model vytvořen. Model může obsahovat několik z každého.

Doména
Speech
Úkol
Speech synthesis, Text-to-speech (TTS)

Velikost

Jak velký je model a kolik dat byl trénován. Parametry jsou číslo, které rozhoduje, zda se vejde na danou grafickou kartu.

Výcviková data
700,000,000,000 tokens

[tokens] Their previous model was trained on 720000 hours of audio data that was equal to 5*10^11 tokens -> 1M hours ~ 7*10^11 tokens model trained on more than 1 million hours of audio data in multiple languages.

Výpočty pro trénink

Aritmetika prováděná k trénování modelu, měřená v operacích s plovoucí desetinnou čárkou. Je to měřítko toho, kolik stál tréninkový běh, ne jak rychle hotový model na vás odpovídá.

Výpočty pro trénink
2.7 × 10²¹ FLOP

Previous model Fish-Speech 1.4 used 1.9151355e+21 FLOP for training (see model card) and was trained on 720000 hours of audio, while this model is similar but trained on 1M hours of audio -> its training compute couldbe estimated as 1.9151355e+21 * 10^6 / 720000 = 2.6599104e+21 FLOP

Jak bylo ustanoveno
Comparison with other models

Dostupnost

Zda můžete získat model a spustit ho na svém vlastním hardwaru, což rozhoduje o tom, zda se některé z čísel grafických karet na této stránce vztahují.

Hmotnosti
Open — downloadable
Přístup k modelu
Open weights (non-commercial)
Tréninkový kód
Open source

weights are released under CC-BY-NC-SA-4.0 License https://huggingface.co/fishaudio/fish-speech-1.5 This codebase is released under Apache License https://github.com/fishaudio/fish-speech/tree/main/fish_speech

Hugging Face
fishaudio

Jak je to klasifikováno

Štítky aplikačních datových sad, které se používají při sledování významných modelů, a jak jistý je ve záznamu.

Záznam důvěry
Likely

Žrovy

Odkud tento záznam pochází a kdy byl naposledy zkontrolován.

Reference
Fish Speech V1.5 is a leading text-to-speech (TTS) model trained on more than 1 million hours of audio data in multiple languages.
Nap poslední aktualizace
28 November 2025

Co čísla znamenají

Odkud to přišlo

Fish-Speech 1.5 byl zveřejněn Fish Audio, v zemi zaznamenané jako United States of America, během November 2024. Kategorie, do které vydavatel spadá, je industry.

funguje v oblasti Speech, a je zaznamenán jako vykonávající úkol speech synthesis, Text-to-speech (TTS).

Váhy jsou zveřejněny, takže si je můžete stáhnout a spustit na své vlastní hardwaru neomezeně, offline, bez připojeného účtu. Na Hugging Face je publikováno pod organizací fishaudio.

Jak bylo trénováno

Produkce toho vyžadovala aritmetiku v celkové výši přibližně 2.7 × 10²¹ FLOP. Tato částka měří, kolik stál výroba modelu, a nemá žádný vliv na to, jak rychle odpovídá.

Trénink spotřeboval korpus kolem 700,000,000,000 tokeny textu

Odpovědi

Fish-Speech 1.5 — běžné otázky

01

Fish-Speech 1.5— kolik výpočetního výkonu bylo použito k jeho trénování?

Trénink spotřeboval kolem 2.7 × 10²¹ FLOP. To měří, co stálo výrobu modelu, a neříká nic o tom, jak rychle odpovídá po natrénování — rychlost inferencí závisí na šířce pásma paměti, nikoli na rozpočtu na trénink.

02

Fish-Speech 1.5— Jakou GPU potřebuji k jejímu spuštění?

Nemůžeme říct. Má otevřené váhy, ale žádný počet parametrů pro něj nebyl zveřejněn a každý výpočet paměti a rychlosti začíná od toho čísla. Raději bychom ukázali nic než vykonstruovaný odhad.

03

Fish-Speech 1.5— Je to OPEN SOURCE?

Jeho váhy jsou zveřejněny, takže si je lze stáhnout a spustit na vlastním hardwaru. Všimněte si, že open WEIGHTS není totéž co open SOURCE v plném smyslu — neříká nic o tréninkových datech, tréninkovém kódu nebo obchodních podmínkách připojených.

04

Fish-Speech 1.5— kolik má parametrů?

Pro něj nebyl zveřejněn žádný počet parametrů, a proto se na této stránce neobjevují žádné údaje o paměti nebo rychlosti.

05

Fish-Speech 1.5— Kdo to vytvořil?

Bylo to publikováno společností Fish Audio, zakládající se na United States of America, organizace zařazená jako industry.

06

Fish-Speech 1.5— Kdy byl vydán?

Bylo to zveřejněno v November 2024. Schopnost na parametr se od té doby výrazně zlepšila, takže novější model stejné velikosti je často lepším využitím stejného hardwaru.

07

Fish-Speech 1.5— K čemu se to používá?

funguje v oblasti Speech, a je zaznamenáno jako zpracovávající úkol speech synthesis, Text-to-speech (TTS). Toto jsou oblasti, kolem nichž byl navržen; popisují záměr spíše než tvrdou hranici.

08

Fish-Speech 1.5— kde si to mohu stáhnout?

Jeho váhy jsou publikovány na Hugging Face, pod organizací fishaudio. Na našem webu nenabízíme soubory modelů — tento web vypočítává, jaký hardware je potřebný pro jejich spuštění.

Zdroj

Původní publikace

Nahrávka naposledy aktualizována 28 November 2025

Druhý směr

Díváte se na to z druhé strany?

Tato stránka začíná od modelu. Pokud již vlastníte kartu a chcete vědět všechno, co bude spuštěno, začněte raději od hardwaru.