Step-1

Geschlossene Gewichte StepFun 130B Parameter February 2025

Keine Schätzung

Keine Hardwareanforderungen für dieses Modell

Die Gewichte für dieses Modell wurden nicht veröffentlicht, sodass es weder heruntergeladen noch auf Ihrer eigenen Hardware in irgendeiner Größe ausgeführt werden kann. Es ist nur über seinen Anbieter zugänglich, und keine Grafikkarte ändert daran etwas.

Aufzeichnung

Vollständige Spezifikation

Alles aufzeichnungsfähig für dieses Modell. Die meisten Informationen beschreiben, wie es trainiert wurde, anstatt wie es läuft — ein nützlicher Kontext, um zu beurteilen, wie viel Arbeit investiert wurde und wie es im Vergleich zu auf einer anderen Skala entwickelten Modellen abschneidet..

Ursprung

Wer hat dieses Modell gebaut, wo und wann es veröffentlicht wurde.

Organisation
StepFun
Organisationstyp
Industry
Land
China
Veröffentlicht
18 February 2025
Autoren
Ailin Huang, Boyong Wu, Bruce Wang, Chao Yan, Chen Hu, Chengli Feng, Fei Tian, Feiyu Shen, Jingbei Li, Mingrui Chen, Peng Liu, Ruihang Miao, Wang You, Xi Chen, Xuerui Yang, Yechang Huang, Yuxiang Zhang, Zheng Gong, Zixin Zhang, Hongyu Zhou, Jianjian Sun, Brian Li, Chengting Feng, Changyi Wan, Hanpeng Hu, Jianchang Wu, Jiangjie Zhen, Ranchen Ming, Song Yuan, Xuelin Zhang, Yu Zhou, Bingxin Li, Buyun…

Was es tut

Die Problemfelder, für die das Modell entwickelt wurde. Ein Modell kann mehrere von jedem tragen.

Domäne
Language
Aufgabe
Language modeling/generation, Question answering

Größe

Wie groß das Modell ist und wie viele Daten es trainiert wurde. Die Parameter sind die Größe, die entscheidet, ob es auf eine bestimmte Grafikkarte passt.

Parameter
130B

130B

Trainingsdaten
800,000,000,000 tokens

. The text data, amounting to 800 billion tokens, encompasses web documents, books, code, and proprietary materials.

Training-Computing

Die zur Ausbildung des Modells durchgeführte Arithmetik, gemessen in Gleitkommaoperationen. Es ist ein Maß dafür, was der Trainingslauf gekostet hat, nicht wie schnell das fertige Modell Ihnen antwortet.

Training-Computing
6.2 × 10²³ FLOP

6 FLOP / token / parameter * 130 * 10^9 parameters * 800 * 10^9 tokens = 6.24e+23 FLOP [1 epoch assumed]

Wie es etabliert wurde
Operation counting

Verfügbarkeit

Ob Sie das Modell erhalten und es auf Ihrer eigenen Hardware ausführen können, entscheidet darüber, ob eine der Grafikkartenfiguren auf dieser Seite zutrifft.

Gewichte
Closed — provider access only
Modellzugang
Unreleased
Trainingscode
Unreleased

Wie es klassifiziert ist

Labels der Quelldatenbank, die beim Verfolgen bemerkenswerter Modelle angewendet werden, und wie zuversichtlich sie in den Eintrag ist.

Aufzeichnungszuversicht
Confident

Quellen

Woher diese Aufzeichnung stammt und wann sie zuletzt überprüft wurde.

Referenz
Step-Audio: Unified Understanding and Generation in Intelligent Speech Interaction
Zuletzt aktualisiert
28 November 2025

Was die Zahlen bedeuten

Über dieses Modell

Step-1 was published by StepFun, in China, in February 2025. industry is the category the publisher falls under.

Es funktioniert in Sprache und wird als Sprachmodellierung/Generierung, Beantwortung von Fragen aufgezeichnet.

Dies ist ein geschlossenes Modell: die trainierten Werte blieben bei demjenigen, der sie produziert hat, und es gibt keine lokale Version, die ausgeführt werden kann.

Wie es trainiert wurde

Producing it required around 6.2 × 10²³ FLOP of arithmetic, which is a statement about the training budget rather than about inference.

The training set ran to roughly 800,000,000,000 tokens.

Antworten

Step-1 — Häufig gestellte Fragen

01

Is Step-1 open source?

No. Step-1 has not had its weights published, so it exists only as a service controlled by its owner.

02

How many parameters does Step-1 have?

Step-1 has 130B parameters. 130B. That figure is the total, and it is what decides how much memory the model needs — roughly half a gigabyte per billion at the compression most people use.

03

Who created Step-1?

Step-1 was published by StepFun, based in China, categorised as industry.

04

When was Step-1 released?

Step-1 was published in February 2025.

05

What is Step-1 used for?

Step-1 works in Language, and is recorded as handling language modeling/generation, Question answering. A model can carry several of each, so these are the areas it was built for rather than a limit on what it will attempt.

06

How much compute was used to train Step-1?

Around 6.2 × 10²³ FLOP. That measures what producing the model cost and says nothing about how quickly it answers once trained — inference speed comes from memory bandwidth, not from the training budget.

07

What GPU do I need to run Step-1?

None. Step-1 is a closed model — its weights were never published, so it cannot be downloaded or run on your own hardware at any price. It is reachable only through its provider.

Quelle

Originalveröffentlichung

Letzte Aktualisierung des Datensatzes 28 November 2025

Die andere Richtung

Wenn Sie es von der anderen Seite betrachten?

Diese Seite beginnt beim Modell. Wenn Sie bereits eine Karte besitzen und alles erfahren möchten, was es ausführen kann, Beginnen Sie stattdessen mit der Hardware.