Over ons
Over gputps.com
Specificaties vertellen je wat een GPU is. Ze vertellen je niet wat het doet met een taalmodel. Dat is de kloof die we deze site hebben gebouwd om te dichten..
Wat dit is
Wat we doen
Voor elke GPU schatten we hoeveel tokens per seconde het kan genereren bij het draaien van een gegeven OPEN WEIGHT-taalmodel, of dat model daadwerkelijk in zijn MEMORY past, en bij welke KWANTISERING. We publiceren deze naast de specificatietabellen, zodat een aankoopbeslissing is gebaseerd op een daadwerkelijk antwoord in plaats van ruwe VRAM en FLOPS-nummers die op zichzelf niets zeggen over de inferentiesnelheid..
Waarom een schatting, en niet een enkel getal
Een token genereren betekent de gewichten van een model één keer uit het geheugen te lezen, zodat de decodeersnelheid begrensd is door de geheugensbandbreedte gedeeld door de modelgrootte — dat is de berekening achter elk cijfer op deze site. Maar dezelfde kaart en model variëren 20–40% tussen inferentie-engines, engineversies en kwantisatieformaten, en geen specificatielijst voorspelt dat. Het publiceren van één zelfverzekerd uitziend getal zou oneerlijk zijn over hoe nauwkeurig deze schatting eigenlijk kan zijn. Dus elk cijfer op deze site wordt verzonden als een bereik, met de methode en input erachter, in plaats van een kale puntwaarde..
De verkopersmarkt
Naast de schattingen kunnen verkopers GPU's rechtstreeks op de pagina van de kaart verkopen - naast het antwoord op "wat draait dit eigenlijk", wat is waar die beslissing wordt genomen..
Begin hier
Beide richtingen, één berekening
Begin met een kaart die je bezit of waar je over nadenkt, of van het model dat je wilt draaien..
Neem contact op
Iets fout gevonden?
Heeft u een verkeerd cijfer gevonden, ontbreekt er een GPU of heeft u een suggestie? We horen het graag..
Bediend door
GPU AI Benchmark LLC 1209 Mountain Road Pl NE, Ste RAlbuquerque, NM 87110
USA