Med-PaLM

Zamknięte wagi Google Research,National Library of Medicine,DeepMind 540B parametry July 2023

Brak oszacowania

Brak wymagań sprzętowych dla tego modelu

Wagi dla tego modelu nie zostały opublikowane, więc nie można ich pobrać ani uruchomić na własnym sprzęcie w żadnym rozmiarze. Jest dostępny tylko za pośrednictwem swojego dostawcy, a zmiana karty graficznej tego nie zmienia..

Na nagranie

Pełna specyfikacja

Wszystko na rekord dla tego modelu. Większość z tego opisuje, jak był trenowany, a nie jak działa — użyteczny kontekst do oceny, ile pracy włożono w to, i jak wypada w porównaniu z modelami budowanymi w innym skali..

Pochodzenie

Kto zbudował ten model, gdzie i kiedy został opublikowany.

Organizacja
Google Research,National Library of Medicine,DeepMind
Typ organizacji
Industry,Government,Industry
Kraj
United States of America, United Kingdom of Great Britain and Northern Ireland
Opublikowany
12 July 2023
Autorzy
Karan Singhal, Shekoofeh Azizi, Tao Tu, S. Sara Mahdavi, Jason Wei, Hyung Won Chung, Nathan Scales, Ajay Tanwani, Heather Cole-Lewis, Stephen Pfohl, Perry Payne, Martin Seneviratne, Paul Gamble, Chris Kelly, Abubakr Babiker, Nathanael Schärli, Aakanksha Chowdhery, Philip Mansfield, Dina Demner-Fushman, Blaise Agüera y Arcas, Dale Webster, Greg S. Corrado, Yossi Matias, Katherine Chou, Juraj Gottwe…

Co to robi

Obszary problemowe, dla których stworzono model. Model może mieć kilka z każdego.

Domena
Medicine, Language
Zadanie
Question answering
Model bazowy
Flan-PaLM 540B

Rozmiar

Jak duży jest model i na ile danych był trenowany. Parametry to liczba, która decyduje, czy mieści się na danej karcie graficznej.

parametry
540B

"We performed instruction prompt tuning on Flan-PaLM 540B with a soft prompt length of 100 to produce Med-PaLM. We froze the rest of the model, and used an embedding dimension of 18432 as in PaLM [1], which resulted in 1.84M trainable parameters." (from supplementary materials)

Dane treningowe
tokens

from supplementary materials "We used a batch size of 32 across all runs and ran training for 200 steps." they also mention average question length of 25 words, but I am not sure if that applies to all datapoints MedMCQA (https://proceedings.mlr.press/v174/pal22a/pal22a.pdf, Table 2) has on average 12.77+ 2.69+67.52 = 82.98 tokens per datapoint

Dostępność

Czy możesz zdobyć model i uruchomić go na swoim sprzęcie, co decyduje o tym, czy którakolwiek z cyfr karty graficznej na tej stronie ma zastosowanie.

Wagi
Closed — provider access only
Dostęp do modelu
Unreleased
Kod treningowy
Unreleased

Jak jest klasyfikowane

Etykiety, które źródłowy zbiór danych stosuje podczas śledzenia znaczących modeli oraz jak pewny jest tego wpisu.

Zapisz pewność
Confident

Źródła

Skąd pochodzi ten rekord i kiedy był ostatnio sprawdzany.

Referencja
Large language models encode clinical knowledge
Ostatnio zaktualizowane
28 November 2025

Co oznaczają liczby

Co to jest model?

Med-PaLM został opublikowany przez Google Research,National Library of Medicine,DeepMind, w kraju zapisanym jako United States of America, podczas July 2023. Organizacja publikująca jest klasyfikowana jako industry,Government,Industry.

Działa w dziedzinie Medicine, Language, i jest zapisany jako wykonujący zadanie question answering.

Jego punktem wyjścia był istniejący model podstawowy, Flan-PaLM 540B. Dlatego dzieli ogólny kształt i rozmiar modelu bazowego.

Ponieważ wagi nie są dostępne, żadne z danych dotyczących sprzętu gdzie indziej na tej stronie się do niego nie odnoszą.

Odpowiedzi

Med-PaLM — częste pytania

01

Med-PaLM— czy jest open weight?

Nie. Jego wagi nie zostały opublikowane, więc istnieje tylko jako usługa kontrolowana przez jego właściciela.

02

Med-PaLM— ile ma parametrów?

Ma liczbę parametrów równą 540B. "We performed instruction prompt tuning on Flan-PaLM 540B with a soft prompt length of 100 to produce Med-PaLM. We froze the rest of the model, and used an embedding dimension of 18432 as in PaLM [1], which resulted in 1.84M trainable parameters." (from supplementary materials). Ta liczba to całkowita, i to ona decyduje o tym, ile pamięci potrzebuje model — mniej więcej pół gigabajta na miliard przy kompresji, którą używa większość ludzi.

03

Med-PaLM— kto to stworzył?

Zostało opublikowane przez Google Research,National Library of Medicine,DeepMind, oparty na United States of America, organizacja sklasyfikowana jako industry,Government,Industry.

04

Med-PaLM— kiedy to zostało wydane?

Zostało opublikowane w July 2023. Możliwość na parametr znacznie się poprawiła, więc nowszy model tej samej wielkości często lepiej wykorzystuje ten sam sprzęt.

05

Med-PaLM— do czego to służy?

Działa w dziedzinie Medicine, Language, i jest zarejestrowany jako realizujący zadanie question answering. Modele często mają więcej niż jeden z każdego, a etykiety opisują cel, a nie ograniczenia możliwości.

06

Med-PaLM— Jaką GPU potrzebuję, aby ją uruchomić?

Żaden. To jest zamknięty model — jego wagi nigdy nie zostały opublikowane, więc nie można go pobrać ani uruchomić na własnym sprzęcie za żadną cenę. Jest dostępny tylko przez jego dostawcę.

Źródło

Oryginalna publikacja

Ostatnia aktualizacja rekordu 28 November 2025

Druga strona

Patrząc na to z drugiej strony?

Ta strona zaczyna się od modelu. Jeśli już posiadasz kartę i chcesz wiedzieć, co wszystko będzie działać., Zacznij od sprzętu zamiast.