Künstliche Intelligenz

StepFuns 600B-Modell Step 5 erreicht 44 – für 1 Dollar

Veröffentlicht am 2 min readVon NewUJ Editorial Desk

Aktualisiert am neue Informationen ergänzt

StepFuns 600B-Modell Step 5 erreicht 44 – für 1 Dollar
0 0
XWhatsAppTelegramLinkedIn

Das in Schanghai ansässige Unternehmen StepFun hat Step 5 Preview am 20. September 2026 vorgestellt und den Zugang über API und Studio am selben Tag geöffnet. Es handelt sich um ein Sparse-Mixture-of-Experts-System mit rund 600 Milliarden Parametern insgesamt, von denen je Token etwa 27 Milliarden aktiv sind. Die Benchmark-Firma Artificial Analysis, die das Modell inzwischen durch ihre eigene Testreihe geschickt hat, führt es mit einem Kontextfenster von einer Million Token und Unterstützung für Text- und Bildeingaben. Eine Kurzmeldung im Nachrichtenticker von KuCoin nannte in der Überschrift 100.000 Token, die Zusammenfassung derselben Meldung nennt jedoch — wie alle anderen Quellen — eine Million.

Auffällig ist vor allem der Preis. Artificial Analysis listet Step 5 Preview mit 1,00 US-Dollar je Million Eingabe-Token und 2,70 US-Dollar je Million Ausgabe-Token, dazu 95 Prozent Rabatt auf zwischengespeicherte Eingaben. Auf derselben Seite steht OpenAIs GPT-5.6 Sol (max) mit 4,00 und 20,00 US-Dollar — StepFun verlangt für die Ausgabe also etwa ein Siebtel.

Bei der Leistung kommt Step 5 Preview im Intelligence Index von Artificial Analysis auf 43,7 Punkte, auf der Modellseite auf 44 gerundet; der Median vergleichbarer Modelle liegt bei 24. Damit liegt das Modell gleichauf mit Kimi K3 (max) bei 43,6 und unter GPT-5.6 Sol (max) mit 47,0. Der komplette Indexdurchlauf kostete bei Step 5 Preview 922,84 US-Dollar, bei GPT-5.6 Sol 3.464,84 US-Dollar, also 0,71 gegenüber 1,99 US-Dollar je Indexaufgabe. Artificial Analysis maß zudem rund 100 Token pro Sekunde gegenüber einem Median von 70 — mit einer Einschränkung: Das Modell sei sehr wortreich und habe im Indexdurchlauf 160 Millionen Token erzeugt, gegenüber einem Median von 92 Millionen. Geschwätzige Modelle zehren einen Teil des Preisvorteils auf, denn für die Ausgabe zahlen Nutzer am meisten.

Zur Architektur berichtet Pandaily von einem schmalen, tiefen Transformer-Stapel mit 92 Schichten; StepFun argumentiert, das ergebe längere Informationspfade für implizites mehrstufiges Schlussfolgern, während ein Agent Werkzeugausgaben liest. Derselbe Bericht beschreibt Sparse Grouped-Query Attention mit blockweisem Token-Merging, das die Kosten für Indexer und Top-k-Auswahl laut Unternehmen auf etwa ein Achtel einer dichteren Basislinie senkt. Gedacht ist das Modell für langwierige Agentenaufgaben: Programmieren, Software-Engineering, Finanzanalyse und professionelle Wissensarbeit.

Offen ist die Freigabe der Gewichte. StepFun nennt den 15. Oktober 2026 — ein angekündigter Plan, keine Lieferung. Pandaily berichtete, im Hugging-Face-Repository des Modells habe zum Zeitpunkt der Ankündigung nur eine Platzhalterdatei .gitattributes gelegen. Die Effizienzangaben von StepFun sind bislang nicht unabhängig reproduziert. Kommen die Gewichte tatsächlich, wäre ein Modell, das nur vier Punkte hinter der Spitze liegt, für jeden herunterladbar.

Offenlegung: Der redaktionelle Prozess von NewUJ nutzt die Claude-Modelle von Anthropic.

Quellen

Report / request removal

Verwandt

Comments

No comments yet. Be the first.