Over ons

Over gputps.com

Specificaties vertellen je wat een GPU is. Ze vertellen je niet wat het doet met een taalmodel. Dat is de kloof die we deze site hebben gebouwd om te dichten..

Wat dit is

Wat we doen

Voor elke GPU schatten we hoeveel tokens per seconde het kan genereren bij het draaien van een gegeven OPEN WEIGHT-taalmodel, of dat model daadwerkelijk in zijn MEMORY past, en bij welke KWANTISERING. We publiceren deze naast de specificatietabellen, zodat een aankoopbeslissing is gebaseerd op een daadwerkelijk antwoord in plaats van ruwe VRAM en FLOPS-nummers die op zichzelf niets zeggen over de inferentiesnelheid..

Waarom een schatting, en niet een enkel getal

Een token genereren betekent de gewichten van een model één keer uit het geheugen te lezen, zodat de decodeersnelheid begrensd is door de geheugensbandbreedte gedeeld door de modelgrootte — dat is de berekening achter elk cijfer op deze site. Maar dezelfde kaart en model variëren 20–40% tussen inferentie-engines, engineversies en kwantisatieformaten, en geen specificatielijst voorspelt dat. Het publiceren van één zelfverzekerd uitziend getal zou oneerlijk zijn over hoe nauwkeurig deze schatting eigenlijk kan zijn. Dus elk cijfer op deze site wordt verzonden als een bereik, met de methode en input erachter, in plaats van een kale puntwaarde..

De verkopersmarkt

Naast de schattingen kunnen verkopers GPU's rechtstreeks op de pagina van de kaart verkopen - naast het antwoord op "wat draait dit eigenlijk", wat is waar die beslissing wordt genomen..

Leer over het worden van een verkoper.

Begin hier

Beide richtingen, één berekening

Begin met een kaart die je bezit of waar je over nadenkt, of van het model dat je wilt draaien..

Neem contact op

Iets fout gevonden?

Heeft u een verkeerd cijfer gevonden, ontbreekt er een GPU of heeft u een suggestie? We horen het graag..

Bediend door

GPU AI Benchmark LLC 1209 Mountain Road Pl NE, Ste R
Albuquerque, NM 87110
USA