LLM-Preisvergleich
Input-, Output- und Cache-Preise für jedes Modell, sortiert pro 1M Tokens mit Filtern.
458 von 464 Modellen werden angezeigt
Space Bunny Alpha stealth | Kostenlos | Kostenlos | Kostenlos | — | 1.00M | ToolsReasoningVision | |
Ling 3.0 Flash Sante (free) inclusionAI | Kostenlos | Kostenlos | Kostenlos | — | 262K | ToolsReasoning | |
Qwen3.8 27B (free) Qwen | Kostenlos | Kostenlos | Kostenlos | — | 262K | ToolsReasoningVision | |
Dots3-Note Preview (free) Dots Studio | Kostenlos | Kostenlos | Kostenlos | — | 512K | ToolsReasoningVision | |
LFM2.5-2.6B (free) LiquidAI | Kostenlos | Kostenlos | Kostenlos | — | 65.5K | ToolsReasoning | |
Nemotron 3.5 Lightning (free) NVIDIA | Kostenlos | Kostenlos | Kostenlos | — | 1.00M | ToolsReasoning | |
Inkling Small (free) Thinking Machines | Kostenlos | Kostenlos | Kostenlos | — | 1.05M | ToolsReasoningVision | |
Laguna S 2.1 (free) Poolside | Kostenlos | Kostenlos | Kostenlos | — | 262K | ToolsReasoning | |
Inkling (free) Thinking Machines | Kostenlos | Kostenlos | Kostenlos | — | 1.05M | ToolsReasoningVision | |
Laguna XS 2.1 (free) Poolside | Kostenlos | Kostenlos | Kostenlos | — | 262K | ToolsReasoning | |
North Mini Code (free) Cohere | Kostenlos | Kostenlos | Kostenlos | — | 256K | ToolsReasoning | |
Nemotron 3.5 Content Safety (free) NVIDIA | Kostenlos | Kostenlos | Kostenlos | — | 128K | ReasoningVision | |
Nemotron 3 Ultra (free) NVIDIA | Kostenlos | Kostenlos | Kostenlos | — | 1.00M | ToolsReasoning | |
Nemotron 3 Nano Omni (free) NVIDIA | Kostenlos | Kostenlos | Kostenlos | — | 256K | ToolsReasoningVision | |
Gemma 4 26B A4B (free) | Kostenlos | Kostenlos | Kostenlos | — | 262K | ToolsReasoningVision | |
Gemma 4 31B (free) | Kostenlos | Kostenlos | Kostenlos | — | 262K | ToolsReasoningVision | |
Lyria 3 Pro Preview | Kostenlos | Kostenlos | Kostenlos | — | 1.05M | Vision | |
Lyria 3 Clip Preview | Kostenlos | Kostenlos | Kostenlos | — | 1.05M | Vision | |
Nemotron 3 Super (free) NVIDIA | Kostenlos | Kostenlos | Kostenlos | — | 262K | ToolsReasoning | |
Free Models Router openrouter | Kostenlos | Kostenlos | Kostenlos | — | 200K | ToolsReasoningVision | |
Mistral Nemo Mistral | $0.019 | $0.030 | $0.022 | — | 131K | Tools | |
Ling 3.0 Flash VL inclusionAI | $0.021 | $0.062 | $0.031 | $0.019 | 262K | ToolsReasoningVision | |
Ling 3.0 Flash inclusionAI | $0.021 | $0.063 | $0.032 | $0.019 | 262K | ToolsReasoning | |
gpt-oss-20b OpenAI | $0.018 | $0.090 | $0.036 | $0.029 | 131K | ToolsReasoning | |
DeepSeek V4 Flash Latest DeepSeek | $0.010 | $0.131 | $0.040 | $0.034 | 1.05M | ToolsReasoning | |
Granite 4.0 Micro IBM | $0.017 | $0.112 | $0.041 | — | 131K | ||
Llama 3 8B Lunaris Sao10K | $0.040 | $0.050 | $0.042 | — | 8.19K | ||
Nex-N2.5-Mini Nex AGI | $0.025 | $0.100 | $0.044 | $0.027 | 262K | ReasoningVision | |
gpt-oss-20b (batch) OpenAI | $0.024 | $0.112 | $0.046 | — | 131K | ToolsReasoning | |
Qwen3.7 Flash Qwen | $0.030 | $0.130 | $0.055 | $0.037 | 1.00M | ToolsReasoningVision | |
gpt-oss-120b (batch) OpenAI | $0.030 | $0.136 | $0.056 | — | 131K | ToolsReasoning | |
Mistral Small 3 Mistral | $0.050 | $0.080 | $0.057 | — | 32.8K | ||
Llama 3.1 8B Instruct Meta | $0.050 | $0.080 | $0.057 | $0.039 | 131K | Tools | |
Schematron V2 Turbo Inference.net | $0.030 | $0.150 | $0.060 | $0.060 | 128K | ||
Nova Micro 1.0 Amazon | $0.035 | $0.140 | $0.061 | — | 128K | Tools | |
Gemma 3 4B | $0.050 | $0.100 | $0.063 | — | 131K | Vision | |
Command R7B (12-2024) Cohere | $0.037 | $0.150 | $0.066 | — | 128K | ||
Mercury 2.5 Inception | $0.040 | $0.150 | $0.068 | $0.041 | 260K | ToolsReasoning | |
GPT-5 Nano (batch) OpenAI | $0.025 | $0.200 | $0.069 | $0.052 | 400K | ToolsReasoningVision | |
gpt-oss-120b OpenAI | $0.037 | $0.170 | $0.070 | — | 131K | ToolsReasoning | |
Llama 3.2 1B Instruct Meta | $0.027 | $0.201 | $0.071 | — | 60.0K | ||
Laguna XS 2.1 Poolside | $0.060 | $0.120 | $0.075 | $0.052 | 262K | ToolsReasoning | |
Ministral 3 8B 2512 (batch) Mistral | $0.075 | $0.075 | $0.075 | $0.024 | 262K | ToolsVision | |
Gemma 3 12B | $0.050 | $0.150 | $0.075 | — | 131K | ToolsVision | |
GLM Flash Latest Z.ai | $0.020 | $0.248 | $0.077 | $0.069 | 1.05M | ToolsReasoningVision | |
Hy-MT2-1.8B Tencent | $0.044 | $0.177 | $0.077 | — | 8.19K | ||
Qwen3 30B A3B Instruct 2507 Qwen | $0.048 | $0.193 | $0.084 | — | 262K | Tools | |
Nemotron 3.5 Lightning NVIDIA | $0.060 | $0.160 | $0.085 | $0.063 | 262K | ToolsReasoning | |
Solar Mini 4 Upstage | $0.050 | $0.200 | $0.087 | $0.054 | 524K | ToolsReasoning | |
Nemotron 3 Nano 30B A3B NVIDIA | $0.050 | $0.200 | $0.087 | $0.072 | 262K | ToolsReasoning | |
Gemini 2.5 Flash Lite (batch) | $0.050 | $0.200 | $0.087 | $0.057 | 1.05M | ToolsReasoningVision | |
GPT-4.1 Nano (batch) OpenAI | $0.050 | $0.200 | $0.087 | $0.059 | 1.05M | ToolsVision | |
MythoMax 13B gryphe | $0.080 | $0.110 | $0.087 | — | 8.19K | ||
Phi 4 Microsoft | $0.070 | $0.140 | $0.088 | — | 16.4K | ||
Ling 3.0 Flash Fin inclusionAI | $0.060 | $0.180 | $0.090 | $0.054 | 262K | ToolsReasoning | |
Schematron V2 Small Inference.net | $0.050 | $0.230 | $0.095 | $0.095 | 128K | ||
GLM 5.3 Flash (batch) Z.ai | $0.060 | $0.200 | $0.095 | $0.059 | 1.05M | ToolsReasoningVision | |
Reka Edge rekaai | $0.100 | $0.100 | $0.100 | — | 16.4K | ToolsReasoningVision | |
Ministral 3 3B 2512 Mistral | $0.100 | $0.100 | $0.100 | $0.033 | 131K | ToolsVision | |
GPT-6 Luna Pro (batch) OpenAI | $0.050 | $0.250 | $0.100 | $0.066 | 1.05M | ToolsReasoningVision |
Kostenschätzer
Gib die Nutzung einer Aufgabe ein, um Preise in Kosten pro Aufruf und pro Monat umzurechnen.
Noch kein Modell ausgewählt. Nutze den Schätzen-Button in einer Zeile, um eines hinzuzufügen.
Preise sind USD pro 1M Tokens, umgerechnet aus OpenRouters offiziellen Tarifen. Der Cache-Preis gilt für wiederverwendete lange Prompts: ein Cache-Hit berechnet den Input zum rabattierten Tarif.
Input-, Output- und Cache-Preise für jedes Modell, sortiert pro 1M Tokens mit Filtern.
Jedes Modell auf OpenRouter berechnet Input und Output separat, und die Lücke zwischen beiden ist routinemäßig vier- bis fünfmal so groß. Nur nach Output zu sortieren wählt das falsche Modell — ebenso nur nach Input. Diese Tabelle stellt beide Preise, den Cache-Read-Tarif, die Kontextlänge und Fähigkeits-Tags in eine Zeile, sodass du ein Modell an deine eigene Nutzungsform anpassen kannst — und der darunterliegende Schätzer rechnet Preise in um, was eine Aufgabe und ein Monat tatsächlich kosten.
Anleitung
- 1Grenze die Liste mit dem Suchfeld oder dem Anbieter-Dropdown ein und stapele dann Filter für Preisklasse, Kontextlänge und Fähigkeiten.
- 2Klicke auf eine Spaltenüberschrift, um nach Input-, Output- oder Blended-Preis zu sortieren — Blended gewichtet Input drei zu eins, was einer echten Rechnung näher kommt.
- 3Gib im Schätzer die Input- und Output-Tokens einer Aufgabe ein, um die Monatskosten der Kandidaten zu vergleichen.