VQGAN + CLIP

Nyitott súlyok Heidelberg University December 2020

Nincs becslés

Nincs hardver követelmény ennek a modellnek

Ez a modell súlyai nyilvánosak, de a paraméterszámokat nem tették közzé. Minden memória- és sebességszám ebből a számból indul, ezért inkább nem mutatunk semmit, mint egy hamisított becslést..

Nyilvántartásban

Teljes specifikáció

Minden feljegyzett ezzel a modellel kapcsolatban. A legtöbbje azt írja le, hogyan képezték ki, nem pedig azt, hogyan fut — hasznos kontextus annak megítéléséhez, hogy mennyi munka ment bele, és hogyan viszonyul a más méretben épített modellekhez..

Eredet

Ki építette ezt a modellt, hol, és mikor publikálták.

Szervezet
Heidelberg University
Szervezet típusa
Academia
Ország
Germany
Közölt
17 December 2020
Szerzők
Patrick Esser, Robin Rombach, Björn Ommer

Mit csinál

A probléma területek, amelyekre a modell készült. Egy modell több mindegyikből hordozhat.

Tartomány
Image generation
Feladat
Text-to-image

Méret

Mekkora a modell, és mennyi adatot használtak a betanításához. A paraméterek azok a számok, amelyek eldöntik, hogy az adott grafikus kártyára illeszkedik-e.

Képzési adatok
251,988,480,000 tokens

I'm confused - I guess they pretrained on several different datasets? I think the model is also able to do zero-shot learning

Elérhetőség

Hogy meg tudja-e szerezni a modellt és futtatni a saját hardverén, ez dönt arról, hogy alkalmazhatóak-e a lap ezen oldalán feltüntetett grafikus kártya adatok.

Súlyok
Open — downloadable
Modell hozzáférés
Open weights (unrestricted)
Képzés kód
Open source

MIT license https://github.com/CompVis/taming-transformers

Hogyan van besorolva

Címkék a forráshalmazra, amelyeket a figyelemre méltó modellek nyomon követésekor alkalmaznak, és hogy mennyire biztos az adatbevitelben.

Miért követik nyomon
Highly cited,SOTA improvement

"The results shows that the transformer consistently outperforms PixelSNAIL across all tasks when trained for the same amount of time and the gap increases even further when trained for the same number of steps." "obtain the state of the art among autoregressive models on class-conditional ImageNet"

Nyilvántartási bizalom
Unknown
Hivatkozások
4,226

Források

Honnan származik ez a felvétel és mikor ellenőrizték utoljára.

Referencia
Taming Transformers for High-Resolution Image Synthesis
Utoljára frissítve
25 May 2026

Mit jelentenek a számok

Háttér

VQGAN + CLIP ki lett adva által Heidelberg University, az országban rögzítve mint Germany, alatt December 2020. A kiadó kategóriája alá tartozik academia.

Működik a területen a Image generation, és úgy van rögzítve, mint a feladat végrehajtása text-to-image.

A közzétett súlyok azt jelentik, hogy a modell a te gépeden fut, nem pedig valaki másén, ami lehetővé teszi az alábbi hardverkérdés megválaszolását.

Mi került a felépítésébe

A tanító készlet kb. futott 251,988,480,000 szöveg tokenjei

Az oka, hogy egyáltalán megjelenik ebben a katalógusban: highly cited,SOTA improvement.

Válaszok

VQGAN + CLIP — gyakori kérdések

01

VQGAN + CLIP— Hány paramétere van?

Nincs közzétéve paraméterszám, ezért ez az oldal nem tartalmaz memóriával vagy sebességgel kapcsolatos adatokat.

02

VQGAN + CLIP— Ki készítette ezt?

Kiadta Heidelberg University, alapján Germany, egy szervezet, amelyet kategorizáltak mint academia.

03

VQGAN + CLIP— Mikor adták ki?

Kibocsátották a December 2020. A paraméterenkénti képesség lényegesen javult azóta, így egy újabb, azonos méretű modell gyakran jobb felhasználása a same hardvernek.

04

VQGAN + CLIP— Mire használják?

Működik a területen a Image generation, és rögzítve van, hogy kezeli a feladatot text-to-image. A modell több mindenből is képes cipelni, így ezek azok a területek, amelyekre épült, nem pedig egy korlát arra, amit meg fog próbálni.

05

VQGAN + CLIP— Hol tudom letölteni?

A súlyok közzététele megtörtént, bár nem rendelkezünk tárolólinkkel erre. Ez az oldal a hardverkövetelményeket számítja ki, nem pedig modellfájlokat tárol.

06

VQGAN + CLIP— Milyen GPU-ra van szükségem, hogy futtathassam?

Nem tudjuk megmondani. Nyílt súlyai vannak, de a paraméterek számát nem tették közzé, és minden memória- és sebességszámítás ebből a számból indul. Inkább nem mutatunk semmit, mint egy hamisított becslést.

07

VQGAN + CLIP— Nyílt forráskódú?

Súlyai közzétételre kerültek, így letölthető és futtatható a saját hardvereden. Ne feledd, hogy az open weight nem azonos az open source teljes értelmében — nem mond semmit a tanulási adatokkal, a tanulási kóddal vagy a kereskedelmi feltételekkel kapcsolatban.

Forrás

Eredeti kiadvány

Az utolsó frissítés időpontja 25 May 2026

A másik irány

Másik oldalról nézve?

Ez az oldal a modellel kezdődik. Ha már van kártyád, és szeretnéd tudni, hogy mindent futtat-e, Kezdj a hardverből..