Protllm
Keine Schätzung
Keine Hardwareanforderungen für dieses Modell
Die Gewichte für dieses Modell wurden nicht veröffentlicht, daher kann es nicht heruntergeladen oder auf Ihrer eigenen Hardware in beliebiger Größe betrieben werden. Es ist nur über seinen Anbieter erreichbar, und keine Grafikkarte ändert das..
Aufgezeichnet
Volle Spezifikation
Alles, was in unserer Datenbank für dieses Modell aufgezeichnet ist. Der Großteil beschreibt, wie es trainiert wurde, anstatt wie es läuft — nützlicher Kontext zur Beurteilung, wie viel Arbeit darin steckt und wie es sich mit Modellen vergleicht, die in einem anderen Maßstab erstellt wurden..
Ursprung
Wer hat dieses Modell gebaut, wo und wann es veröffentlicht wurde.
- Organisation
- Beijing Institute of Technology,Beihang University,Peking University,Smart Grid Research Institute,Shanghai AI Lab
- Organisationsart
- Academia,Academia,Academia,Academia
- Land
- China
- Veröffentlicht
- 28 February 2024
- Autoren
- Le Zhuo, Zewen Chi, Minghao Xu, Heyan Huang, Heqi Zheng, Conghui He, Xian-Ling Mao, Wentao Zhang
Was es tut
Die Problemfelder, für die das Modell entwickelt wurde. Ein Modell kann mehrere davon tragen.
- Domain
- Biology
- Aufgabe
- Protein or nucleotide language model (pLM/nLM)
- Basis-Modell
- LLaMA-7B
Größe
Wie groß das Modell ist und wie viele Daten damit trainiert wurden. Parameter sind die Zahl, die entscheidet, ob es auf einer bestimmten GPU-Karte passt.
- Trainingsdaten
- tokens
Summary of calculations: PubMed Articles: 165,206 × 10,000 = 1.65206 × 10^9 UniProt Annotations: 64,634 × 100 = 6.4634 × 10^6 STRING Annotations: 25,682 × 100 = 2.5682 × 10^6 Mol-Instructions: 173,973 × 500 = 86.9865 × 10^6 Dataset total: 1.65206 × 10^9 + 6.4634 × 10^6 + 2.5682 × 10^6 + 86.9865 × 10^6 = 1.7475 × 10^9 Training tokens: 10,000 × 256 × 512 = 1.31072 × 10^9 Final estimate: 1.31 × 10^9 data points Training step based estimate: 10000 steps with batch size 256 and length 512 (Tabl…
Training-Compute
Die Berechnung, die durchgeführt wird, um das Modell zu trainieren, gemessen in Gleitpunktoperationen. Es ist ein Maß dafür, was der Trainingslauf gekostet hat, nicht dafür, wie schnell das fertige Modell Ihnen antwortet.
- Wie es etabliert wurde
- Operation counting
Der Trainingslauf
Was es physisch gekostet hat, um zu trainieren: welche Chips, wie viele, wie lange und was das aus der Wand gezogen hat.
- Trainingshardware
- NVIDIA A100
- Verwendete Chips
- 4
- Stromverbrauch
- 3.2 kW
Verfügbarkeit
Ob Sie das Modell beziehen und es auf Ihrer eigenen Hardware ausführen können, bestimmt, ob eine der Grafikkarten-Zahlen auf dieser Seite zutrifft.
- Gewichte
- Closed — provider access only
- Modellzugang
- Unreleased
- Training-Code
- Open (non-commercial)
no clear license for training and inference code https://github.com/ProtLLM/ProtLLM/tree/main weights are announced but not released https://huggingface.co/ProtLLM
Wie es klassifiziert ist
Labels, die das Quell-Datenset anwendet, wenn bemerkenswerte Modelle verfolgt werden, und wie zuversichtlich es in den Eintrag ist.
- Aufzeichnungsgenauigkeit
- Confident
- Zitationen
- 29
Quellen
Woher dieser Datensatz stammt und wann er zuletzt überprüft wurde.
- Referenz
- ProtLLM: An Interleaved Protein-Language LLM with Protein-as-Word Pre-Training
- Zuletzt aktualisiert
- 25 May 2026
Was die Zahlen bedeuten
Woher es kam
Protllm wurde veröffentlicht von Beijing Institute of Technology,Beihang University,Peking University,Smart Grid Research Institute,Shanghai AI Lab, im Land aufgezeichnet als China, während February 2024. Es stammt aus einer Organisation, die kategorisiert ist als academia,Academia,Academia,Academia.
Es funktioniert im Bereich von Biology, und wird als die Aufgabe von aufgezeichnet protein or nucleotide language model (pLM/nLM).
Es basiert auf LLaMA-7B. Das ist der übliche Weg, wie ein spezialisiertes Modell hergestellt wird.
Da die Gewichte nicht verfügbar sind, gelten keine der Hardwareangaben an anderer Stelle auf dieser Seite für sie.
Antworten
Protllm — Häufige Fragen
Protllm— Welche GPU benötige ich, um es auszuführen?
Dieses ist ein geschlossenes Modell — seine Gewichte wurden nie veröffentlicht, sodass es zu keinem Preis heruntergeladen oder auf Ihrer eigenen Hardware ausgeführt werden kann. Es ist nur über seinen Anbieter erreichbar.
Protllm— Ist es Open-Source?
Nein. Seine Gewichte wurden nicht veröffentlicht, daher existiert es nur als ein Dienst, der von seinem Eigentümer kontrolliert wird.
Protllm— Wie viele Parameter hat es?
Es wurden keine Parameteranzahlen veröffentlicht, weshalb keine Speicher- oder Geschwindigkeitsangaben auf dieser Seite erscheinen.
Protllm— Wer hat es erstellt?
Es wurde veröffentlicht von Beijing Institute of Technology,Beihang University,Peking University,Smart Grid Research Institute,Shanghai AI Lab, basiert auf China, eine als kategorisierte Organisation academia,Academia,Academia,Academia.
Protllm— Wann wurde es veröffentlicht?
Es wurde veröffentlicht in February 2024. Die Fähigkeit pro Parameter hat sich erheblich verbessert, sodass ein neueres Modell derselben Größe oft die bessere Nutzung derselben Hardware darstellt.
Protllm— Wofür wird es verwendet?
Es funktioniert im Bereich von Biology, und wird als Bewältigung der Aufgabe von protein or nucleotide language model (pLM/nLM). Ein Modell kann mehrere von jedem tragen, daher sind dies die Bereiche, für die es gebaut wurde, anstatt eine Begrenzung dafür, was es versuchen wird.
Die andere Richtung
Von der anderen Seite aus betrachten?
Diese Seite beginnt mit dem Modell. Wenn Sie bereits eine Karte besitzen und alles wissen möchten, was sie ausführen wird, Starte stattdessen von der Hardware.