AIO APEX

ByteDance trainiert ein Modell mit 10 Billionen Parametern, um die Frontier-KI herauszufordern

The Decoder / Financial Times
Teilen:
ByteDance trainiert ein Modell mit 10 Billionen Parametern, um die Frontier-KI herauszufordern

ByteDance trainiert ein KI-Modell mit bis zu 10 Billionen Parametern, wie der Financial Times unter Berufung auf drei Personen berichtet, die mit dem Projekt vertraut sind. Die Größenordnung würde das Mutterunternehmen von TikTok in Schlagdistanz zu den leistungsfähigsten KI-Systemen der Welt bringen und weit vor jedem bekannten chinesischen Modell liegen.

Das Modell wäre etwa dreimal so groß wie Kimi K3 von Moonshot AI mit 2,8 Billionen Parametern — derzeit das größte bekannte chinesische Modell. Es liegt auch in derselben Größenordnung wie Anthropics Mythos 5, das Branchenschätzungen auf etwa 8 Billionen Parameter beziffern. Anthropic hat diese Zahl offiziell nie bestätigt.

Vortraining läuft bereits

Das Modell befindet sich derzeit in der Vortrainingsphase, ein Prozess, der in dieser Größenordnung typischerweise drei bis sechs Monate dauert. ByteDance hat weder einen Namen noch einen Veröffentlichungsplan öffentlich bekannt gegeben. Die Größe allein signalisiert, dass es sich um eine langfristige Frontier-Wette handelt, nicht um ein inkrementelles Produktupdate.

Ein bemerkenswertes Detail: ByteDance hat die Destillation — das Training auf Ausgaben von Modellen anderer Unternehmen — seit über einem Jahr vermieden. Destillation ist ein üblicher Shortcut, um schnell aufzuholen, schränkt aber die Originalität ein und schafft Risiken beim geistigen Eigentum. Das Vermeiden impliziert, dass ByteDance in vollständiges, originäres Vortraining von Grund auf investiert — deutlich teurer, aber mit leistungsfähigeren und verteidigbareren Ergebnissen.

CEO gesteht Rückstand ein

Der Ehrgeiz der Trainingsrunde steht im Kontrast zu einem offenen internen Eingeständnis. Bei einer Jahreshälfte-Versammlung am 6. August 2026 sagte ByteDance-CEO Liang Rubo den Mitarbeitern, dass die großen Sprachmodelle des Unternehmens derzeit hinter führenden ausländischen Konkurrenten zurückliegen, und betonte das langfristige Engagement für interne F&E.

ByteDance-Gründer Zhang Yiming soll dem 2.000-köpfigen Seed-Team — die für dieses Modell verantwortliche Abteilung — gesagt haben, langfristig auf weltweit führende Fähigkeiten abzuzielen. Das Unternehmen erhöht seine KI-Investitionen 2026 erheblich, mit einem wesentlichen Anteil für Halbleiterausgaben zur Unterstützung des Modelltrainings.

Nicht die Einzige in dieser Größenordnung

ByteDance ist nicht allein dabei, die Billion-Parameter-Skala anzustreben. Elon Musks xAI soll Grok-Varianten mit 6 und 10 Billionen Parametern auf seinem Colossus-2-Cluster trainieren. OpenAI und Google haben keine Parameteranzahlen für ihre aktuellen Systeme veröffentlicht, aber der Wettbewerb auf Multi-Billionen-Parameter-Ebene ist zur stillen Benchmark der nächsten Generation von KI-Laboren geworden.

Die Parameteranzahl ist nicht die einzige Variable — Datenqualität, Trainingsmethoden und Architektur sind genauso wichtig — aber das Signal aus dem FT-Bericht ist klar: ByteDance ist nicht mehr damit zufrieden, der Frontier aus der Ferne zu folgen.

Ursprünglich berichtet von The Decoder / Financial Times. Lesen Sie den Originalartikel für weitere Details.

Originalquelle ansehen
Teilen: