Large Language Models sind das Herz der KI-Revolution. Aber wie viele gibt es eigentlich? Wer baut sie? Was kosten sie? Und welches Modell ist wirklich das beste?
Die Antwort:
Es ist unübersichtlich geworden. Im Jahr 2026 erscheint im Schnitt jeden Monat ein neues Spitzenmodell, die Preise schwanken um den Faktor 600, und ausgerechnet die wichtigste Kennzahl der letzten Jahre, die Parameterzahl, geben die großen Labore gar nicht mehr heraus.
In diesem Artikel sortiere ich die Zahlen. Alle Werte stammen aus unserer zentral gepflegten LLM-Datenbank, die auch hinter Tools wie dem API-Kostenrechner steht.
- In unserer Datenbank sind 274 LLMs von 35 Anbietern erfasst, davon 116 proprietär und 158 offen verfügbar.
- Bei Coding führt Claude Fable 5 mit 95,0 % SWE-bench, vor Claude Opus 4.8 mit 88,6 %. GPT-5.5 liegt im Vals-AI-Harness bei 82,6 %. Open-Weights-Modelle wie DeepSeek-V4-Pro liegen nur rund 8 Prozentpunkte hinter Claude Opus 4.8.
- Die Preise reichen von 0,05 USD (GPT-5 nano) bis 30 USD (GPT-5.5 Pro) pro 1 Million Input-Tokens. Parameterzahlen geben die führenden Labore nicht mehr an.
1. Wie viele große Sprachmodelle gibt es 2026?
In unserer Datenbank sind aktuell 274 große Sprachmodelle von 35 verschiedenen Anbietern erfasst, von GPT-2 aus dem Jahr 2019 bis zu den aktuellen Flaggschiffen vom August 2026, darunter Gemini 3.7 Flash als Googles neuestes stabiles Flash-Modell. Das ist bewusst eine kuratierte Auswahl der wichtigsten Modelle und kein Anspruch auf Vollständigkeit.
Zur Einordnung:
Laut dem Stanford AI Index 2026 haben allein US-Labore im Jahr 2025 rund 60 nennenswerte Modelle veröffentlicht, chinesische Anbieter etwa 35. Über 90 % aller bedeutenden Spitzenmodelle stammen mittlerweile aus der Industrie, nicht mehr aus der akademischen Forschung. Der Markt hat sich also professionalisiert und konzentriert.
2. Die größten LLM-Anbieter nach Modellanzahl
Ein einfacher Indikator dafür, wie aktiv ein Labor ist, ist die Zahl der Modelle, die es pflegt. Die folgende Grafik zeigt, wie viele der von uns erfassten Modelle auf welchen Anbieter entfallen:
OpenAI führt mit 35 Modellen, gefolgt von Anthropic mit 19 und Google mit 18. Diese Zahl misst allerdings nur die Pflegetiefe der Modellpalette, nicht die tatsächliche Nutzung. Bei den realen Marktanteilen sieht das Bild anders aus: Im Web-Traffic der KI-Chatbots dominiert ChatGPT, während Gemini und Claude dahinter folgen.
3. Parameter und Architektur: das Ende der Größenangaben
Jahrelang galt die Parameterzahl als wichtigste Kennzahl eines Modells. GPT-3 hatte 175 Milliarden, GPT-4 schätzungsweise 1,76 Billionen. Doch dann hörten die Labore auf, diese Zahl zu nennen.
Heute gilt:
Bei allen aktuellen Spitzenmodellen von OpenAI, Anthropic, Google und xAI ist die Parameterzahl offiziell unbekannt. Modellgröße ist zum Geschäftsgeheimnis geworden. Konkrete, bestätigte Zahlen gibt es fast nur noch bei Open-Weights-Modellen, und die sind riesig. Neuer Spitzenreiter ist Kimi K3 von Moonshot AI mit offiziell 2,8 Billionen Parametern (vorgestellt am 16.07.2026, die Gewichte sind seit dem 27.07. unter der eigenen „Kimi K3 License“ verfügbar):
Auffällig ist die Architektur. Fast alle großen Modelle nutzen heute ein Mixture-of-Experts-Design (MoE), bei dem pro Anfrage nur ein Bruchteil der Parameter aktiv ist. DeepSeek-V4-Pro hat zwar 1,6 Billionen Parameter, aktiviert davon aber nur 49 Milliarden pro Token, also rund 3 %. Das macht riesige Modelle bezahlbar im Betrieb. Insgesamt sind 104 der erfassten Modelle als MoE gebaut.
Die vollständige Parameter-Datenbank kannst du hier nach Anbieter, Größe und Typ filtern und durchsuchen. Bei den meisten aktuellen Spitzenmodellen steht in der Spalte Parameter bewusst „unbekannt“:
Legende:
Zeige 274 Modelle
Modell | Entwickler | Parameter |
|---|---|---|
MiniMax M2.7 MoE | MiniMax | Unbekannt |
MiniMax M2.5 MoE | MiniMax | Unbekannt |
GLM-4.7 MoE | Z.ai | Unbekannt |
GLM-4.7-Flash MoE | Z.ai | Unbekannt |
GLM-4.6V MoE | Z.ai | Unbekannt |
GPT-5.6 Sol | OpenAI | Unbekannt |
GPT-5.6 Terra | OpenAI | Unbekannt |
GPT-5.6 Luna | OpenAI | Unbekannt |
GPT-5.5 | OpenAI | Unbekannt |
GPT-5.5 Pro | OpenAI | Unbekannt |
GPT-5.5 Instant | OpenAI | Unbekannt |
ChatGPT chat-latest | OpenAI | Unbekannt |
GPT-5.4 | OpenAI | Unbekannt |
GPT-5.4 Pro | OpenAI | Unbekannt |
GPT-5.4 mini | OpenAI | Unbekannt |
GPT-5.4 nano | OpenAI | Unbekannt |
GPT-5.3-Codex | OpenAI | Unbekannt |
GPT-5.3 Instant | OpenAI | Unbekannt |
GPT-5.2 | OpenAI | Unbekannt |
GPT-5.1 Instant | OpenAI | Unbekannt |
GPT-5.1 Thinking | OpenAI | Unbekannt |
GPT-5 | OpenAI | Unbekannt |
GPT-5 pro | OpenAI | Unbekannt |
GPT-5 mini | OpenAI | Unbekannt |
GPT-5 nano | OpenAI | Unbekannt |
GPT-4 Turbo | OpenAI | Unbekannt |
GPT-4.1 | OpenAI | Unbekannt |
GPT-4.1 mini | OpenAI | Unbekannt |
GPT-4.1 nano | OpenAI | Unbekannt |
GPT-3.5 Turbo | OpenAI | Unbekannt |
o3 | OpenAI | Unbekannt |
o3-pro | OpenAI | Unbekannt |
o3-mini | OpenAI | Unbekannt |
o4-mini | OpenAI | Unbekannt |
o1 | OpenAI | Unbekannt |
o1-mini | OpenAI | Unbekannt |
Claude Fable 5 | Anthropic | Unbekannt |
Claude Mythos 5 | Anthropic | Unbekannt |
Claude Sonnet 5 | Anthropic | Unbekannt |
Claude Opus 5 | Anthropic | Unbekannt |
Claude Opus 4.8 | Anthropic | Unbekannt |
Claude Opus 4.7 | Anthropic | Unbekannt |
Claude Opus 4.6 | Anthropic | Unbekannt |
Claude Sonnet 4.6 | Anthropic | Unbekannt |
Claude Opus 4.5 | Anthropic | Unbekannt |
Claude Opus 4.1 | Anthropic | Unbekannt |
Claude Sonnet 4.5 | Anthropic | Unbekannt |
Claude Haiku 4.5 | Anthropic | Unbekannt |
Claude Sonnet 4 | Anthropic | Unbekannt |
Claude Opus 4 | Anthropic | Unbekannt |
Claude Sonnet 3.7 | Anthropic | Unbekannt |
Claude 3.5 Haiku | Anthropic | Unbekannt |
Gemini 3.7 Flash | Unbekannt | |
Gemini 3.6 Flash | Unbekannt | |
Gemini 3.5 Flash | Unbekannt | |
Gemini 3.1 Pro Preview | Unbekannt | |
Gemini 3 Flash MoE | Unbekannt | |
Gemini 3.5 Flash-Lite | Unbekannt | |
Gemini 3.1 Flash-Lite MoE | Unbekannt | |
Gemini 2.5 Pro MoE | Unbekannt | |
Gemini 2.5 Flash MoE | Unbekannt | |
Gemini 2.5 Flash-Lite MoE | Unbekannt | |
Gemini 3 Pro MoE | Unbekannt | |
Gemini 2.0 Flash MoE | Unbekannt | |
Gemini 1.5 Pro MoE | Unbekannt | |
Grok 4.6 | xAI | Unbekannt |
Grok 4.5 | xAI | Unbekannt |
Grok 4.3 | xAI | Unbekannt |
Grok 4.20 Reasoning | xAI | Unbekannt |
Grok 4.20 Multi-Agent | xAI | Unbekannt |
Grok Build 0.1 | xAI | Unbekannt |
Grok 4 | xAI | Unbekannt |
Grok 3 | xAI | Unbekannt |
Grok 2 | xAI | Unbekannt |
Mistral Medium 3.5 | Mistral AI | Unbekannt |
MiniMax M3 | MiniMax | Unbekannt |
Qwen 3.7 Max MoE | Alibaba | Unbekannt |
Seed 1.8 | ByteDance | Unbekannt |
Seed 2.0 Pro | ByteDance | Unbekannt |
Muse Spark 1.2 | Meta | Unbekannt |
KAT-Coder-Air V2.5 | Kuaishou | Unbekannt |
KAT-Coder-Pro V2.5 | Kuaishou | Unbekannt |
Seed 1.6 | ByteDance | Unbekannt |
Seed 1.6 Flash | ByteDance | Unbekannt |
Seed 2.0 Lite | ByteDance | Unbekannt |
Seed 2.0 Mini | ByteDance | Unbekannt |
Seed 2.0 Code | ByteDance | Unbekannt |
Seed 2.1 Turbo | ByteDance | Unbekannt |
Qwen 3.7 Flash | Alibaba | Unbekannt |
Qwen 3.7 Plus MoE | Alibaba | Unbekannt |
Nova 2 Lite | Amazon | Unbekannt |
Nova Premier 1.0 | Amazon | Unbekannt |
Nova Pro 1.0 | Amazon | Unbekannt |
Nova Lite 1.0 | Amazon | Unbekannt |
Nova Micro 1.0 | Amazon | Unbekannt |
Sonar | Perplexity | Unbekannt |
Sonar Pro | Perplexity | Unbekannt |
Sonar Reasoning Pro | Perplexity | Unbekannt |
Sonar Deep Research | Perplexity | Unbekannt |
MiMo-V2.5 MoE | Xiaomi | Unbekannt |
Solar Pro 4 | Upstage | Unbekannt |
Solar Mini | Upstage | Unbekannt |
Kimi K3 MoE(104 Mrd. aktiv) | Moonshot AI | 2,8 Billionen |
Qwen 3.8 2.4T A95B MoE(95 Mrd. aktiv) | Alibaba | 2,4 Billionen |
Qwen 3.8 Max MoE(95 Mrd. aktiv) | Alibaba | 2,4 Billionen |
Claude 3 Opus | Anthropic | 2 Billionen* |
Llama 4 Behemoth MoE(288 Mrd. aktiv) | Meta | 2 Billionen |
GPT-4 MoE(220 Mrd. aktiv) | OpenAI | 1,76 Billionen* |
DeepSeek-V4-Pro MoE(49 Mrd. aktiv) | DeepSeek | 1,6 Billionen |
LongCat 2.0 MoE(48 Mrd. aktiv) | Meituan | 1,6 Billionen |
Ring 2.6 1T MoE(63 Mrd. aktiv) | inclusionAI | 1 Billionen |
Kimi K2.5 MoE(32 Mrd. aktiv) | Moonshot AI | 1 Billionen |
Kimi K2 Thinking MoE(32 Mrd. aktiv) | Moonshot AI | 1 Billionen |
Kimi K2 0711 MoE(32 Mrd. aktiv) | Moonshot AI | 1 Billionen |
Kimi K2 0905 MoE(32 Mrd. aktiv) | Moonshot AI | 1 Billionen |
Kimi K2.6 MoE(32 Mrd. aktiv) | Moonshot AI | 1 Billionen |
Kimi K2.7 Code MoE(32 Mrd. aktiv) | Moonshot AI | 1 Billionen |
Qwen 3.6 Max-Preview MoE | Alibaba | 1 Billionen* |
Yi-Large MoE | 01.AI | 1 Billionen |
MiMo-V2.5-Pro MoE(42 Mrd. aktiv) | Xiaomi | 1 Billionen |
MiMo-V2.5-Pro-UltraSpeed MoE(42 Mrd. aktiv) | Xiaomi | 1 Billionen |
Inkling MoE(41 Mrd. aktiv) | Thinking Machines Lab | 975 Mrd. |
GLM-5.2 MoE(40 Mrd. aktiv) | Z.ai | 744 Mrd. |
GLM-5.3 MoE(40 Mrd. aktiv) | Z.ai | 744 Mrd. |
GLM-5.1 MoE(40 Mrd. aktiv) | Z.ai | 744 Mrd. |
GLM-5 MoE(40 Mrd. aktiv) | Z.ai | 744 Mrd. |
DeepSeek-V3 0324 MoE(37 Mrd. aktiv) | DeepSeek | 685 Mrd. |
DeepSeek-V3.2 Exp MoE(37 Mrd. aktiv) | DeepSeek | 685 Mrd. |
DeepSeek-V3.2 MoE(37 Mrd. aktiv) | DeepSeek | 685 Mrd. |
Mistral Large 3 MoE(41 Mrd. aktiv) | Mistral AI | 675 Mrd. |
DeepSeek-V3.1 Terminus MoE(37 Mrd. aktiv) | DeepSeek | 671 Mrd. |
DeepSeek-V3.1 MoE(37 Mrd. aktiv) | DeepSeek | 671 Mrd. |
DeepSeek-R1 0528 MoE(37 Mrd. aktiv) | DeepSeek | 671 Mrd. |
DeepSeek-V3 MoE(37 Mrd. aktiv) | DeepSeek | 671 Mrd. |
DeepSeek-R1 MoE(37 Mrd. aktiv) | DeepSeek | 671 Mrd. |
Nemotron 3 Ultra MoE(55 Mrd. aktiv) | NVIDIA | 550 Mrd. |
PaLM | 540 Mrd. | |
Megatron-Turing NLG | NVIDIA | 530 Mrd. |
Qwen 3 Coder 480B A35B MoE(35 Mrd. aktiv) | Alibaba | 480 Mrd. |
MiniMax M1 MoE(45,9 Mrd. aktiv) | MiniMax | 456 Mrd. |
MiniMax-01 MoE(45,9 Mrd. aktiv) | MiniMax | 456 Mrd. |
ERNIE 4.5 VL 424B A47B MoE(47 Mrd. aktiv) | Baidu | 424 Mrd. |
Hermes 4 405B | Nous Research | 405 Mrd. |
Llama 3.1 405B | Meta | 405 Mrd. |
Llama 4 Maverick MoE(17 Mrd. aktiv) | Meta | 400 Mrd. |
Trinity Large Thinking MoE(13 Mrd. aktiv) | Arcee AI | 398 Mrd. |
Nex-N2-Pro MoE(17 Mrd. aktiv) | Nex AGI | 397 Mrd. |
Qwen 3.5 397B A17B MoE(17 Mrd. aktiv) | Alibaba | 397 Mrd. |
GLM-4.6 MoE(32 Mrd. aktiv) | Z.ai | 355 Mrd. |
GLM-4.5 MoE(32 Mrd. aktiv) | Z.ai | 355 Mrd. |
Nemotron-4 340B | NVIDIA | 340 Mrd. |
PaLM 2 | 340 Mrd.* | |
Grok 1 MoE(86 Mrd. aktiv) | xAI | 314 Mrd. |
Hy3 MoE(21 Mrd. aktiv) | Tencent | 295 Mrd. |
DeepSeek-V4-Flash MoE(13 Mrd. aktiv) | DeepSeek | 284 Mrd. |
Inkling Small MoE(12 Mrd. aktiv) | Thinking Machines Lab | 276 Mrd. |
DeepSeek-V2 MoE(21 Mrd. aktiv) | DeepSeek | 236 Mrd. |
Qwen 3 235B A22B Instruct 2507 MoE(22 Mrd. aktiv) | Alibaba | 235 Mrd. |
Qwen 3 235B A22B MoE(22 Mrd. aktiv) | Alibaba | 235 Mrd. |
Qwen 3 235B A22B Thinking 2507 MoE(22 Mrd. aktiv) | Alibaba | 235 Mrd. |
Qwen 3 VL 235B A22B MoE(22 Mrd. aktiv) | Alibaba | 235 Mrd. |
Qwen 3 VL 235B A22B Thinking MoE(22 Mrd. aktiv) | Alibaba | 235 Mrd. |
MiniMax M2.1 MoE(10 Mrd. aktiv) | MiniMax | 230 Mrd. |
MiniMax M2 MoE(10 Mrd. aktiv) | MiniMax | 230 Mrd. |
GPT-4o | OpenAI | 200 Mrd.* |
Step 3.7 Flash MoE(11 Mrd. aktiv) | StepFun | 198 Mrd. |
Step 3.5 Flash MoE(11 Mrd. aktiv) | StepFun | 196,8 Mrd. |
Falcon 180B | TII | 180 Mrd. |
BLOOM | BigScience | 176 Mrd. |
GPT-3 | OpenAI | 175 Mrd. |
Claude 3.5 Sonnet | Anthropic | 175 Mrd.* |
OPT-175B | Meta | 175 Mrd. |
Mixtral 8x22B MoE(39 Mrd. aktiv) | Mistral AI | 141 Mrd. |
LaMDA | 137 Mrd. | |
DBRX MoE(36 Mrd. aktiv) | Databricks | 132 Mrd. |
Ling 3.0 Flash MoE(5,1 Mrd. aktiv) | inclusionAI | 124 Mrd. |
Mistral Large 2 | Mistral AI | 123 Mrd. |
Qwen 3.5 122B A10B MoE(10 Mrd. aktiv) | Alibaba | 122 Mrd. |
Nemotron 3 Super MoE(12 Mrd. aktiv) | NVIDIA | 120 Mrd. |
Mistral Small 4 MoE(6 Mrd. aktiv) | Mistral AI | 119 Mrd. |
Laguna S 2.1 MoE(8 Mrd. aktiv) | Poolside | 118 Mrd. |
GPT OSS 120B MoE(5,1 Mrd. aktiv) | OpenAI | 117 Mrd. |
Command A | Cohere | 111 Mrd. |
Llama 4 Scout MoE(17 Mrd. aktiv) | Meta | 109 Mrd. |
GLM-4.5 Air MoE(12 Mrd. aktiv) | Z.ai | 106 Mrd. |
GLM-4.5V MoE(12 Mrd. aktiv) | Z.ai | 106 Mrd. |
Command R+ | Cohere | 104 Mrd. |
Solar Pro 3 MoE | Upstage | 102 Mrd. |
Hunyuan A13B Instruct MoE(13 Mrd. aktiv) | Tencent | 80 Mrd. |
Qwen 3 Coder Next MoE(3 Mrd. aktiv) | Alibaba | 80 Mrd. |
Qwen 3 Next 80B A3B Instruct MoE(3 Mrd. aktiv) | Alibaba | 80 Mrd. |
Qwen 3 Next 80B A3B Thinking MoE(3 Mrd. aktiv) | Alibaba | 80 Mrd. |
Virtuoso Large | Arcee AI | 72 Mrd. |
Qwen 2.5 VL 72B | Alibaba | 72 Mrd. |
Qwen 2.5 72B | Alibaba | 72 Mrd. |
Hermes 4 70B | Nous Research | 70 Mrd. |
DeepSeek-R1 Distill Llama 70B | DeepSeek | 70 Mrd. |
Claude 3 Sonnet | Anthropic | 70 Mrd.* |
Llama 3.3 70B | Meta | 70 Mrd. |
Llama 3.1 70B | Meta | 70 Mrd. |
Llama 3 70B | Meta | 70 Mrd. |
Llama 2 70B | Meta | 70 Mrd. |
Mixtral 8x7B MoE(14 Mrd. aktiv) | Mistral AI | 56 Mrd. |
Falcon 40B | TII | 40 Mrd. |
Nex-N2-mini MoE(3 Mrd. aktiv) | Nex AGI | 35 Mrd. |
Qwen 3.6 35B A3B MoE(3 Mrd. aktiv) | Alibaba | 35 Mrd. |
Qwen 3.5 35B A3B MoE(3 Mrd. aktiv) | Alibaba | 35 Mrd. |
Yi-34B | 01.AI | 34 Mrd. |
Laguna XS 2.1 MoE(3 Mrd. aktiv) | Poolside | 33 Mrd. |
Qwen 3 32B | Alibaba | 32 Mrd. |
Qwen 2.5 Coder 32B | Alibaba | 32 Mrd. |
Qwen 3 VL 32B | Alibaba | 32 Mrd. |
Qwen 2.5 32B | Alibaba | 32 Mrd. |
Command R | Cohere | 32 Mrd. |
Gemma 4 31B | 31 Mrd. | |
Solar Pro 2 | Upstage | 31 Mrd. |
Nemotron 3 Nano MoE(3,5 Mrd. aktiv) | NVIDIA | 30 Mrd. |
Nemotron 3.5 Lightning MoE(3 Mrd. aktiv) | NVIDIA | 30 Mrd. |
Qwen 3 30B A3B Instruct 2507 MoE(3 Mrd. aktiv) | Alibaba | 30 Mrd. |
Qwen 3 Coder 30B A3B MoE(3 Mrd. aktiv) | Alibaba | 30 Mrd. |
Qwen 3 30B A3B MoE(3 Mrd. aktiv) | Alibaba | 30 Mrd. |
Qwen 3 30B A3B Thinking 2507 MoE(3 Mrd. aktiv) | Alibaba | 30 Mrd. |
Qwen 3 VL 30B A3B MoE(3 Mrd. aktiv) | Alibaba | 30 Mrd. |
Qwen 3 VL 30B A3B Thinking MoE(3 Mrd. aktiv) | Alibaba | 30 Mrd. |
Muse Glimmer 30B | Meta | 30 Mrd. |
Gemma 3 27B | 27 Mrd. | |
Qwen 3.8 27B | Alibaba | 27 Mrd. |
Qwen 3.5 27B | Alibaba | 27 Mrd. |
Qwen 3.6 27B | Alibaba | 27 Mrd. |
Gemma 2 27B | 27 Mrd. | |
Gemma 4 26B A4B MoE(4 Mrd. aktiv) | 26 Mrd. | |
Mistral Small 3.2 | Mistral AI | 24 Mrd. |
Mistral Small 3.1 | Mistral AI | 24 Mrd. |
Voxtral Small 24B | Mistral AI | 24 Mrd. |
Mistral Small 3 | Mistral AI | 24 Mrd. |
GPT OSS 20B MoE(3,6 Mrd. aktiv) | OpenAI | 21 Mrd. |
Claude 3 Haiku | Anthropic | 20 Mrd.* |
Ministral 3 14B | Mistral AI | 14 Mrd. |
Qwen 3 14B | Alibaba | 14 Mrd. |
Qwen 2.5 14B | Alibaba | 14 Mrd. |
Phi-4 | Microsoft | 14 Mrd. |
Gemma 3 12B | 12 Mrd. | |
Mistral Nemo | Mistral AI | 12 Mrd. |
Nemotron Nano 2 VL 12B | NVIDIA | 12 Mrd. |
Qwen 3.5 9B | Alibaba | 9 Mrd. |
Gemma 2 9B | 9 Mrd. | |
Nemotron Nano 2 9B | NVIDIA | 9 Mrd. |
Granite 4.1 8B | IBM | 8 Mrd. |
Gemma 3n E4B | 8 Mrd. | |
Ministral 3 8B | Mistral AI | 8 Mrd. |
Qwen 3 8B | Alibaba | 8 Mrd. |
Qwen 3 VL 8B | Alibaba | 8 Mrd. |
Qwen 3 VL 8B Thinking | Alibaba | 8 Mrd. |
GPT-4o mini | OpenAI | 8 Mrd.* |
Llama 3.1 8B | Meta | 8 Mrd. |
Llama 3 8B | Meta | 8 Mrd. |
Ministral 8B | Mistral AI | 8 Mrd. |
Mistral 7B | Mistral AI | 7 Mrd. |
Qwen 2.5 7B | Alibaba | 7 Mrd. |
Command R7B | Cohere | 7 Mrd. |
Phi-4 Multimodal | Microsoft | 5,6 Mrd. |
Gemma 3 4B | 4 Mrd. | |
Phi-4 mini | Microsoft | 3,8 Mrd. |
Phi-3 mini | Microsoft | 3,8 Mrd. |
Gemini Nano 2 | 3,3 Mrd. | |
Granite 4.0 H Micro | IBM | 3 Mrd. |
Llama 3.2 3B | Meta | 3 Mrd. |
Ministral 3 3B | Mistral AI | 3 Mrd. |
Ministral 3B | Mistral AI | 3 Mrd. |
Gemma 2 2B | 2 Mrd. | |
Gemini Nano 1 | 1,8 Mrd. | |
GPT-2 | OpenAI | 1,5 Mrd. |
Llama 3.2 1B | Meta | 1 Mrd. |
Qwen 2.5 0.5B | Alibaba | 0,5 Mrd. |
Parameter-Größen bekannter Large Language Models (Stand: August 2026)
4. Kontextfenster: von 200.000 bis 10 Millionen Tokens
Das Kontextfenster bestimmt, wie viel Text ein Modell auf einmal verarbeiten kann. Hier haben sich die Größenordnungen in den letzten zwei Jahren vervielfacht. Die folgende Übersicht zeigt über 140 aktuelle Modelle, sortierbar und nach Anbieter filterbar:
Modell | Entwickler | Kontextfenster |
|---|---|---|
| Meta | 10 Mio. | |
| Alibaba | 10 Mio. | |
2 Mio. | ||
2 Mio. | ||
| xAI | 2 Mio. | |
| xAI | 2 Mio. | |
| Meta | 1,1 Mio. | |
| OpenAI | 1,1 Mio. | |
| OpenAI | 1,1 Mio. | |
| OpenAI | 1,1 Mio. | |
| OpenAI | 1,1 Mio. | |
| OpenAI | 1,1 Mio. | |
1 Mio. | ||
1 Mio. | ||
1 Mio. | ||
1 Mio. | ||
1 Mio. | ||
| Moonshot AI | 1 Mio. | |
| Meta | 1 Mio. | |
| Poolside | 1 Mio. | |
1 Mio. | ||
1 Mio. | ||
1 Mio. | ||
1 Mio. | ||
1 Mio. | ||
1 Mio. | ||
1 Mio. | ||
1 Mio. | ||
| xAI | 1 Mio. | |
| xAI | 1 Mio. | |
| xAI | 1 Mio. | |
| Anthropic | 1 Mio. | |
| Anthropic | 1 Mio. | |
| Anthropic | 1 Mio. | |
| Anthropic | 1 Mio. | |
| Anthropic | 1 Mio. | |
| Anthropic | 1 Mio. | |
| Anthropic | 1 Mio. | |
| Anthropic | 1 Mio. | |
| OpenAI | 1 Mio. | |
| OpenAI | 1 Mio. | |
| OpenAI | 1 Mio. | |
| OpenAI | 1 Mio. | |
| OpenAI | 1 Mio. | |
| OpenAI | 1 Mio. | |
| DeepSeek | 1 Mio. | |
| DeepSeek | 1 Mio. | |
| MiniMax | 1 Mio. | |
| Alibaba | 1 Mio. | |
| Alibaba | 1 Mio. | |
| Alibaba | 1 Mio. | |
| Meituan | 1 Mio. | |
| Thinking Machines Lab | 1 Mio. | |
| Thinking Machines Lab | 1 Mio. | |
| Alibaba | 1 Mio. | |
| Alibaba | 1 Mio. | |
| Alibaba | 1 Mio. | |
| Z.ai | 1 Mio. | |
| Z.ai | 1 Mio. | |
| Xiaomi | 1 Mio. | |
| Xiaomi | 1 Mio. | |
| Xiaomi | 1 Mio. | |
| MiniMax | 1 Mio. | |
| NVIDIA | 1 Mio. | |
| NVIDIA | 1 Mio. | |
| NVIDIA | 1 Mio. | |
| NVIDIA | 1 Mio. | |
| Amazon | 1 Mio. | |
| Amazon | 1 Mio. | |
| Amazon | 1 Mio. | |
| MiniMax | 1 Mio. | |
| Upstage | 512.000 | |
| xAI | 500.000 | |
| xAI | 500.000 | |
| OpenAI | 400.000 | |
| OpenAI | 400.000 | |
| OpenAI | 400.000 | |
| OpenAI | 400.000 | |
| OpenAI | 400.000 | |
| OpenAI | 400.000 | |
| OpenAI | 400.000 | |
| OpenAI | 400.000 | |
| OpenAI | 400.000 | |
| OpenAI | 400.000 | |
| OpenAI | 400.000 | |
| OpenAI | 400.000 | |
| OpenAI | 400.000 | |
| OpenAI | 400.000 | |
| Amazon | 300.000 | |
| Amazon | 300.000 | |
| Moonshot AI | 262.144 | |
| Moonshot AI | 262.144 | |
| Alibaba | 262.144 | |
| Alibaba | 262.144 | |
| Poolside | 262.144 | |
| Nex AGI | 262.144 | |
| Nex AGI | 262.144 | |
| Tencent | 262.144 | |
| Tencent | 262.144 | |
| inclusionAI | 262.144 | |
| inclusionAI | 262.144 | |
| Arcee AI | 262.144 | |
262.144 | ||
262.144 | ||
| Mistral AI | 262.144 | |
| Mistral AI | 262.144 | |
| Alibaba | 262.144 | |
| Alibaba | 262.144 | |
| Alibaba | 262.144 | |
| Alibaba | 262.144 | |
| Alibaba | 262.144 | |
| Alibaba | 262.144 | |
| Alibaba | 262.144 | |
| Alibaba | 262.144 | |
| Alibaba | 262.144 | |
| Alibaba | 262.144 | |
| Alibaba | 262.144 | |
| Alibaba | 262.144 | |
| Alibaba | 262.144 | |
| Alibaba | 262.144 | |
| Alibaba | 262.144 | |
| Alibaba | 262.144 | |
| Alibaba | 262.144 | |
| Alibaba | 262.144 | |
| Alibaba | 262.144 | |
| Alibaba | 262.144 | |
| Alibaba | 262.144 | |
| Moonshot AI | 262.144 | |
| Moonshot AI | 262.144 | |
| Moonshot AI | 262.144 | |
| xAI | 256.000 | |
| xAI | 256.000 | |
| xAI | 256.000 | |
| Mistral | 256.000 | |
| Mistral | 256.000 | |
| Mistral | 256.000 | |
| Mistral | 256.000 | |
| Alibaba | 256.000 | |
| ByteDance | 256.000 | |
| ByteDance | 256.000 | |
| Kuaishou | 256.000 | |
| Kuaishou | 256.000 | |
| ByteDance | 256.000 | |
| ByteDance | 256.000 | |
| ByteDance | 256.000 | |
| ByteDance | 256.000 | |
| ByteDance | 256.000 | |
| ByteDance | 256.000 | |
| StepFun | 256.000 | |
| StepFun | 256.000 | |
| Cohere | 256.000 | |
| Cohere | 256.000 | |
| AI21 Labs | 256.000 | |
| AI21 Labs | 256.000 | |
| AI21 Labs | 256.000 | |
| MiniMax | 245.760 | |
| MiniMax | 204.800 | |
| MiniMax | 204.800 | |
| MiniMax | 204.800 | |
| MiniMax | 204.800 | |
| Z.ai | 204.800 | |
| Z.ai | 204.800 | |
| Anthropic | 200.000 | |
| Anthropic | 200.000 | |
| Anthropic | 200.000 | |
| Anthropic | 200.000 | |
| Anthropic | 200.000 | |
| Anthropic | 200.000 | |
| Anthropic | 200.000 | |
| Anthropic | 200.000 | |
| Anthropic | 200.000 | |
| Anthropic | 200.000 | |
| Anthropic | 200.000 | |
| Anthropic | 200.000 | |
| OpenAI | 200.000 | |
| OpenAI | 200.000 | |
| OpenAI | 200.000 | |
| OpenAI | 200.000 | |
| OpenAI | 200.000 | |
| Z.ai | 200.000 | |
| Z.ai | 200.000 | |
| Perplexity | 200.000 | |
| Z.ai | 200.000 | |
| 01.AI | 200.000 | |
| 01.AI | 200.000 | |
| DeepSeek | 163.840 | |
| DeepSeek | 163.840 | |
| DeepSeek | 163.840 | |
| DeepSeek | 163.840 | |
| DeepSeek | 163.840 | |
| xAI | 131.072 | |
| Meta | 131.072 | |
| Upstage | 131.072 | |
| Baidu | 131.072 | |
| IBM | 131.072 | |
| IBM | 131.072 | |
| Arcee AI | 131.072 | |
| Nous Research | 131.072 | |
| Nous Research | 131.072 | |
| OpenAI | 131.072 | |
| OpenAI | 131.072 | |
| Mistral AI | 131.072 | |
| Alibaba | 131.072 | |
| Alibaba | 131.072 | |
| Alibaba | 131.072 | |
| Alibaba | 131.072 | |
| Alibaba | 131.072 | |
| Alibaba | 131.072 | |
| Alibaba | 131.072 | |
| Alibaba | 131.072 | |
| Moonshot AI | 131.072 | |
| Z.ai | 131.072 | |
| Z.ai | 131.072 | |
| Z.ai | 131.072 | |
| Meta | 128.000 | |
| Meta | 128.000 | |
| Meta | 128.000 | |
| Meta | 128.000 | |
| Meta | 128.000 | |
| Meta | 128.000 | |
| Meta | 128.000 | |
| Meta | 128.000 | |
128.000 | ||
128.000 | ||
128.000 | ||
| xAI | 128.000 | |
| OpenAI | 128.000 | |
| OpenAI | 128.000 | |
| OpenAI | 128.000 | |
| OpenAI | 128.000 | |
| OpenAI | 128.000 | |
| DeepSeek | 128.000 | |
| DeepSeek | 128.000 | |
| DeepSeek | 128.000 | |
| DeepSeek | 128.000 | |
| DeepSeek | 128.000 | |
| DeepSeek | 128.000 | |
| DeepSeek | 128.000 | |
| DeepSeek | 128.000 | |
| DeepSeek | 128.000 | |
| DeepSeek | 128.000 | |
| Mistral | 128.000 | |
| Mistral | 128.000 | |
| Mistral | 128.000 | |
| Mistral | 128.000 | |
| Mistral | 128.000 | |
| Alibaba | 128.000 | |
| Alibaba | 128.000 | |
| Alibaba | 128.000 | |
| Alibaba | 128.000 | |
| Alibaba | 128.000 | |
| Alibaba | 128.000 | |
| Alibaba | 128.000 | |
| Alibaba | 128.000 | |
| Alibaba | 128.000 | |
| Alibaba | 128.000 | |
| Alibaba | 128.000 | |
| Alibaba | 128.000 | |
| NVIDIA | 128.000 | |
| NVIDIA | 128.000 | |
| Cohere | 128.000 | |
| Perplexity | 128.000 | |
| Perplexity | 128.000 | |
| Perplexity | 128.000 | |
| Mistral AI | 128.000 | |
| Mistral AI | 128.000 | |
| Alibaba | 128.000 | |
| Cohere | 128.000 | |
| Cohere | 128.000 | |
| Amazon | 128.000 | |
| Microsoft | 128.000 | |
| Microsoft | 128.000 | |
| Microsoft | 128.000 | |
| Microsoft | 128.000 | |
| Microsoft | 128.000 | |
| Microsoft | 128.000 | |
| 01.AI | 128.000 | |
| 01.AI | 128.000 | |
| Nvidia | 128.000 | |
| Nvidia | 128.000 | |
| Nvidia | 128.000 | |
| Reka | 128.000 | |
| Reka | 128.000 | |
| Reka | 128.000 | |
| Zhipu AI | 128.000 | |
| Zhipu AI | 128.000 | |
| Baidu | 128.000 | |
| Alibaba | 81.920 | |
| Mistral | 65.536 | |
| Upstage | 65.536 | |
| Z.ai | 65.536 | |
| Microsoft | 64.000 | |
| Mistral | 32.768 | |
| Mistral | 32.768 | |
| Alibaba | 32.768 | |
| Alibaba | 32.768 | |
| Alibaba | 32.768 | |
| Upstage | 32.768 | |
32.768 | ||
| Microsoft | 32.768 | |
| Databricks | 32.768 | |
32.000 | ||
| Mistral AI | 32.000 | |
| 01.AI | 32.000 | |
| Microsoft | 16.384 | |
| 01.AI | 16.000 | |
8.192 | ||
8.192 | ||
| OpenAI | 8.192 | |
| AI21 Labs | 8.192 | |
| Zhipu AI | 8.192 | |
| Baidu | 8.000 | |
| Cohere | 4.096 | |
| Nvidia | 4.096 | |
| Stability AI | 4.096 | |
| Stability AI | 4.096 |
Kontextfenster-Größen aktueller KI-Sprachmodelle (Stand: August 2026)
Die Spitze bilden Llama 4 Scout und Qwen-Long mit jeweils 10 Millionen Tokens. Das entspricht etwa 30 Bänden Harry Potter in einem einzigen Prompt. Die aktuellen Allrounder liegen meist um 1 Million Tokens. GPT-5.5 liegt bei 1 Million, Claude Opus 5 und Gemini 3.1 Pro bei 1 Million. Mehr zu den einzelnen Modellfamilien findest du in unseren Übersichten zu den Claude-Modellen und Gemini-Modellen.
5. Was kostet ein LLM? Preise pro 1 Million Tokens
Bei den API-Preisen liegen Welten zwischen den Modellen. Das günstigste Modell mit API-Zugang ist GPT-5 nano mit 0,05 USD pro 1 Million Input-Tokens. Das teuerste ist GPT-5.5 Pro mit 30 USD, also dem 600-Fachen.
Spannender als der reine Preis ist aber das Verhältnis von Preis zu Leistung. Die folgende Grafik trägt den Input-Preis gegen die Coding-Leistung (SWE-bench Verified) ab. Modelle unten rechts sind ideal: stark und günstig.
Der heimliche Star dieser Grafik ist DeepSeek-V4-Pro. Mit 80,6 % SWE-bench bei nur 0,435 USD Input-Preis liegt das Modell auf der Effizienz-Grenze, kein anderes Modell ist gleichzeitig stärker und günstiger. Wer also nicht zwingend die letzten Prozentpunkte Coding-Leistung braucht, bekommt mit den offenen Modellen ein extrem gutes Preis-Leistungs-Verhältnis. Eine ausführliche Kostenrechnung für deine konkrete Nutzung liefert der API-Kostenrechner.
6. LLM-Leistung im Direktvergleich
Um die Stärken und Schwächen der führenden Modelle auf einen Blick sichtbar zu machen, vergleicht das folgende Radar fünf repräsentative Spitzenmodelle über vier Dimensionen: Reasoning, Coding, Kontextfenster und Preis-Effizienz. Jede Achse ist relativ zu den fünf Modellen skaliert, damit auch kleine Vorsprünge sichtbar werden. Die echten Werte erscheinen im Tooltip.
Das Muster ist klar erkennbar. Claude Opus 4.8 und GPT-5.5 dominieren bei der reinen Coding-Leistung, sind aber teuer. Gemini 3.5 Flash dreht das um, denn beim Reasoning liegt es fast auf Augenhöhe und nur beim Coding zurück, dafür die beste Preis-Effizienz im Feld. Auf diese eine Abwägung läuft jedes KI-Projekt am Ende hinaus, maximale Qualität gegen maximale Wirtschaftlichkeit.
7. Open Source gegen proprietär
Eine der wichtigsten Entwicklungen 2026 ist das Aufholen der offenen Modelle. Von den 274 erfassten Modellen sind 116 proprietär und 158 offen verfügbar, davon 153 mit offenen Gewichten und 5 vollständig quelloffen.
Aber an der absoluten Spitze:
Laut Stanford AI Index 2026 führte das beste geschlossene Modell Anfang 2026 mit 3,3 Prozentpunkten vor dem besten Open-Weights-Modell. Im August 2024 waren es nur 0,5 Prozentpunkte gewesen. An der Spitze ist der Abstand also nicht geschrumpft, sondern wieder gewachsen, denn sechs der zehn besten Modelle in der Chatbot Arena sind inzwischen wieder geschlossen. In unseren Daten zeigt sich derselbe Vorsprung beim Coding. DeepSeek-V4-Pro und Kimi K2.6 erreichen beim SWE-bench 80,6 % beziehungsweise 80,2 %. Damit liegen beide rund 8 Prozentpunkte hinter Claude Opus 4.8, das 88,6 % erzielt. GPT-5.5 kommt im Vals-AI-Harness auf 82,6 %. Eine Übersicht der besten freien Modelle findest du in unserem Artikel zu den Open-Source-LLMs.
Wie sich der Lizenz-Mix auf die einzelnen Anbieter verteilt, zeigt die folgende Übersicht. Die Spaltenbreite steht für die Anzahl getrackter Modelle je Anbieter, die Farben für den Lizenztyp.
8. Wissensstand: Wie aktuell sind die Modelle?
Jedes Modell hat einen Wissens-Stichtag, nach dem es nichts mehr über die Welt gelernt hat. Aktuell liegt der frischeste Stichtag in unserer Datenbank im Januar 2026:
Zwischen dem Wissens-Stichtag und der Veröffentlichung liegen meist sechs bis acht Monate, in denen das Modell trainiert und getestet wird. Für aktuelle Ereignisse brauchen die Modelle deshalb fast immer eine Websuche. Reines Modellwissen ist immer ein paar Monate alt.
9. Release-Tempo: Die Schlagzahl der Labore
Wie schnell sich der Markt dreht, zeigt die Release-Timeline. Was 2024 noch im Quartalsrhythmus passierte, kommt 2026 fast monatlich:
Verteilt man alle erfassten Modelle auf ihren Erscheinungsmonat, wird die Verdichtung sichtbar. Je dunkler ein Feld, desto mehr Modelle kamen in diesem Monat heraus.
Besonders dicht war der Dezember 2025, als Google, OpenAI und Mistral im selben Monat neue Flaggschiffe veröffentlichten. Und der April 2026, in dem mit GPT-5.5, Claude Opus 4.7, DeepSeek-V4-Pro, Kimi K2.6 und Qwen 3.6 Max gleich fünf Spitzenmodelle erschienen. Wer hier den Überblick behalten will, sollte sich nicht zu sehr an einzelne Versionsnummern klammern.
10. Modell-Status: aktiv, veraltet, Legacy
Nicht jedes Modell, das je veröffentlicht wurde, ist noch nutzbar. Über die drei großen Anbieter Anthropic, Google und OpenAI verfolgen wir den Lebenszyklus von 88 Modellen. So verteilen sie sich auf die einzelnen Status:
Gut die Hälfte der Modelle ist noch aktiv, knapp ein Drittel bereits veraltet. Und die Lebenszyklen werden kürzer. Ein gutes Beispiel ist Gemini 3 Pro, das nur rund drei Monate nach seiner Veröffentlichung schon wieder abgekündigt wurde, weil mit Gemini 3.1 Pro ein Nachfolger bereitstand. Wer produktiv auf einem Modell aufbaut, muss diese Abkündigungen aktiv im Blick behalten.
11. Marktposition und Fazit
Der LLM-Markt 2026 ist erwachsen geworden. Statt eines einzelnen dominierenden Modells gibt es ein knappes Spitzenfeld aus OpenAI, Anthropic und Google, dicht verfolgt von offenen Modellen aus China, allen voran DeepSeek und Moonshot.
Unterm Strich:
Die Leistung an der Spitze ist erstaunlich nah beieinander, der Wettbewerb verlagert sich auf Preis, Kontextlänge und Spezialisierung. Für die meisten Anwendungen kommt es 2026 weniger auf das absolut beste Modell an als auf das richtige für den jeweiligen Zweck und das Budget. Wer tiefer in einzelne Anbieter einsteigen will, findet die Details in unseren Statistiken zu OpenAI, Anthropic, Google Gemini, Grok und DeepSeek.






