Live-Preise · vor 12 min
DeepSeek V4.1 FlashIonstream 0.24 / 0.83 DeepSeek V4.1 FlashWafer 0.041 / 0.37 DeepSeek V4.1 FlashMorph 0.066 / 0.43 Mimo V2.6 FlashDeepInfra 0.12 / 0.23 DeepSeek V4.1 FlashDeepSeek 0.25 / 1.00 ▲ DeepSeek V4.1 FlashAlibaba 0.25 / 1.00 ▲ DeepSeek V4.1 FlashStreamLake 0.14 / 0.55 ▼ DeepSeek V4.1 FlashPhala 0.18 / 0.70 ▼ DeepSeek V4.1 FlashInferenceNet 0.057 / 0.38 ▲ DeepSeek V4.1 FlashOpenInference 0.025 / 0.42 DeepSeek V4.1 FlashRelace 0.017 / 0.50 DeepSeek V4 Flash 0731DeepInfra 0.050 / 0.15 Ling 3.0 Flash VLDeepInfra 0.050 / 0.15 DeepSeek V4 FlashDeepInfra 0.075 / 0.15 DeepSeek V4.1 FlashSail Research 0.067 / 0.33 GLM 5.3 FlashNovita 0.13 / 0.42 Mimo V2.6 ProDeepInfra 0.36 / 0.73 Minimax M3DeepInfra 0.23 / 0.92 Mimo V2.5 ProNovita 0.44 / 0.87 Qwen3.8 27bNovita 0.35 / 2.50 DeepSeek V4 ProDeepInfra 1.08 / 2.17 DeepSeek V4 Pro 0813DeepInfra 1.08 / 2.17 Kimi K2.6Novita 0.67 / 2.83 Gemini 3.7 FlashDeepInfra 0.63 / 3.13 Kimi K2.7 CodeNovita 0.79 / 3.33 InklingDeepInfra 0.79 / 3.37 Qwen3.7 MaxNovita 1.04 / 3.13 GLM 5.1Novita 1.15 / 3.67 GLM 5.2Novita 1.17 / 3.67 GLM 5.3Novita 1.17 / 3.67 GPT 5.6 SolOpenAI 0.83 / 4.17 Qwen3.8 2.4t A95bNovita 1.67 / 5.00 Grok 4.6xAI 1.67 / 5.00 Gemini 3.5 FlashDeepInfra 1.25 / 7.50 DeepSeek V4.1 FlashIonstream 0.24 / 0.83 DeepSeek V4.1 FlashWafer 0.041 / 0.37 DeepSeek V4.1 FlashMorph 0.066 / 0.43 Mimo V2.6 FlashDeepInfra 0.12 / 0.23 DeepSeek V4.1 FlashDeepSeek 0.25 / 1.00 ▲ DeepSeek V4.1 FlashAlibaba 0.25 / 1.00 ▲ DeepSeek V4.1 FlashStreamLake 0.14 / 0.55 ▼ DeepSeek V4.1 FlashPhala 0.18 / 0.70 ▼ DeepSeek V4.1 FlashInferenceNet 0.057 / 0.38 ▲ DeepSeek V4.1 FlashOpenInference 0.025 / 0.42 DeepSeek V4.1 FlashRelace 0.017 / 0.50 DeepSeek V4 Flash 0731DeepInfra 0.050 / 0.15 Ling 3.0 Flash VLDeepInfra 0.050 / 0.15 DeepSeek V4 FlashDeepInfra 0.075 / 0.15 DeepSeek V4.1 FlashSail Research 0.067 / 0.33 GLM 5.3 FlashNovita 0.13 / 0.42 Mimo V2.6 ProDeepInfra 0.36 / 0.73 Minimax M3DeepInfra 0.23 / 0.92 Mimo V2.5 ProNovita 0.44 / 0.87 Qwen3.8 27bNovita 0.35 / 2.50 DeepSeek V4 ProDeepInfra 1.08 / 2.17 DeepSeek V4 Pro 0813DeepInfra 1.08 / 2.17 Kimi K2.6Novita 0.67 / 2.83 Gemini 3.7 FlashDeepInfra 0.63 / 3.13 Kimi K2.7 CodeNovita 0.79 / 3.33 InklingDeepInfra 0.79 / 3.37 Qwen3.7 MaxNovita 1.04 / 3.13 GLM 5.1Novita 1.15 / 3.67 GLM 5.2Novita 1.17 / 3.67 GLM 5.3Novita 1.17 / 3.67 GPT 5.6 SolOpenAI 0.83 / 4.17 Qwen3.8 2.4t A95bNovita 1.67 / 5.00 Grok 4.6xAI 1.67 / 5.00 Gemini 3.5 FlashDeepInfra 1.25 / 7.50

LLM · Bild · Sprache · Einmal einbauen · Immer das Beste

Die beste Leistung zum besten Preis, automatisch.

Du sagst einmal, was du brauchst: Leistung oder Modell, Modellfamilie, Standort, Geschwindigkeit, Fähigkeiten, Preis. Wir sorgen dafür, dass dein API-Schlüssel genau das bekommt — heute und bei jeder neuen Modellgeneration, ohne dass du etwas anpasst. LLM, Bilder, Sprachausgabe und Transkription mit einem Schlüssel; Preise live verglichen, Leistung selbst gemessen, Konto und Abrechnung auch per API.

33Modelle im Vergleich
37Plattformen
0.15CHF je Mio. Ausgabe, ab
Gläserne Marktstände auf dunklem Wasser, verbunden durch einen Strom aus Licht
Viele Anbieter, ein Weg: jede Anfrage geht zum günstigsten, der deine Regeln erfüllt.

Du nennst die Kriterien. Wir halten sie aktuell.

Einmal festlegen, was zählt — dein API-Schlüssel bekommt genau das, bei jeder Anfrage neu entschieden. Alle Felder sind Teil derselben OpenAI-kompatiblen API.

Leistung oder Modell

Das beste gemessene Modell je Einsatzzweck, eine Stufe (solid, strong, top), eine eigene Mindestleistung — etwa 0.80 im Programmieren — oder ein fester Modellname. Sonst nehmen wir den günstigsten, der das erfüllt.

category + level | min_score · model

Modellfamilie

Zum Beispiel claude, qwen3 oder deepseek/deepseek-v4. Erscheint eine neue Generation, ist sie dabei, sobald sie am Markt ist — mit min_score, sobald wir sie gemessen haben.

family

Standort

Schweiz, EU, USA oder Asien: nur Anbieter mit von uns erfasstem Ausführungsort (eu schliesst ch ein).

region

Geschwindigkeit

Nach gemessenem Durchsatz ordnen, wenn die Antwortzeit zählt.

sort: "speed"

Fähigkeiten

Werkzeuge, strukturierte Ausgabe, Reasoning, Bildeingabe, Mindestkontext — jeder gewählte Anbieter muss es können.

capabilities · min_context

Preis

Günstigster zuerst, beste Punktzahl je Franken oder ein harter Höchstpreis je Million Token.

sort: "price" | "value" · max_price

Einmal einbauen. Nie wieder nachziehen.

Wer eine Plattform oder ein Werkzeug baut, legt sich heute auf ein Modell fest — und zieht morgen nach, wenn ein besseres oder günstigeres erscheint. Hier legst du dich auf deine Anforderungen fest, nicht auf ein Modell. Die Schnittstelle bleibt gleich; die Auswahl dahinter treffen wir laufend neu.

  • Neue Modellgenerationen kommen an, ohne Code-Änderung.
  • Fällt ein Anbieter aus, übernimmt der nächste, der deine Regeln erfüllt.
  • Preissenkungen am Markt landen automatisch bei dir.
  • Erfüllt nichts deine Regeln, sagen wir es klar (409) — kein heimliches Ausweichen.
{"model": "james-direct",
 "routing": {"family": "deepseek", "category": "coding", "min_score": 0.8,
             "sort": "value", "region": "eu", "capabilities": ["tools"]},
 "messages": [{"role": "user", "content": "…"}]}

Marktpreise

Listenpreise der Plattformen in CHF je 1 Million Token (Tageskurs, ohne unseren Aufschlag), geprüft alle 15 Minuten. Balken machen Preis und Tempo vergleichbar; Index = Artificial-Analysis über OpenRouter (Vorauswahl, zugesagt wird nur, was wir selbst messen). Ausführungsort: von uns erfasst — sonst „global“ (anbieterabhängig).

Leistungskarte

Jeder Punkt ein Modell: links günstig, oben stark. Die leuchtende Linie ist die Effizienzgrenze — kein anderes Modell ist zugleich billiger und besser. Blasengrösse = Kontextfenster.

↖ stark & günstig 0 20 40 60 0.1 1 10 100 CHF je Mio. Ausgabe-Token (logarithmisch) → Index Denken ↑ GPT 5.6 SolGPT 5.6 Sol Mimo V2.6 Pro GLM 5.3 FlashGLM 5.3 Flash DeepSeek V4.1 FlashDeepSeek V4.1 Flash Mimo V2.6 Flash DeepSeek V4 Flash 0731DeepSeek V4 Flash 0731 Claude Opus 5.5 Claude Fable 5.1 Claude Opus 5 Gemini 3.7 Flash
Effizienzgrenze anthropicdeepseekz-aimoonshotaiqwenxiaomigoogleopenai

Preisspanne je Plattform

Dasselbe Modell kostet je Plattform verschieden viel. Der leuchtende Punkt ist der günstigste — dorthin routen wir.

0.1110100
GPT 6 Astra
×2.2 · −55 %
GPT 5.6 Sol
×4.4 · −77 %
Grok 4.6
×1.1 · −9 %
Kimi K3
×1.1 · −5 %
DeepSeek V4.1 Flash
×3.8 · −73 %
DeepSeek V4 Pro 0813
×1.5 · −34 %
DeepSeek V4 Flash 0731
×7.3 · −86 %
DeepSeek V4 Pro
×1.2 · −19 %
Qwen3.7 Max
×2.0 · −50 %
Kimi K2.6
×1.0 · −3 %
Ling 3.0 Flash VL
×1.2 · −18 %
DeepSeek V4 Flash
×1.6 · −36 %

Preisbewegung

Günstigster Ausgabepreis (CHF je 1 Mio. Token) über alle Plattformen — Kerzen je Intervall, rot = teurer, türkis = günstiger.

Kerze = 1 h · seit 29.09.26 01:32 · 39 Preisänderungen
0.333 ▼ 33.4 %
0.3360.3870.4380.489 29.09.26 01:0029.09.26 13:0030.09.26 02:00 0.333

Preis-Leistung

Index-Punkte je CHF Ausgabepreis · Preisbewegung der letzten 30 Tage.

1. D DeepSeek V4 Flash 0731deepseek 228.7 P/CHF neu
2. I Ling 3.0 Flash VLinclusionai 164.0 P/CHF neu
3. X Mimo V2.6 Flashxiaomi 162.7 P/CHF neu
4. D DeepSeek V4 Flashdeepseek 161.3 P/CHF neu
5. D DeepSeek V4.1 Flashdeepseek 118.6 P/CHF neu
6. Z GLM 5.3 Flashz-ai 100.2 P/CHF neu
7. X Mimo V2.6 Proxiaomi 63.9 P/CHF neu
8. M Minimax M3minimax 31.8 P/CHF neu
9. X Mimo V2.5 Proxiaomi 29.9 P/CHF neu
10. D DeepSeek V4 Pro 0813deepseek 16.6 P/CHF neu
Modell Denken Code Preis ein/aus Tempo Ort Verlauf Plattform Kontext
Claude Opus 5.5 anthropic 58
3.33
16.66
– global neu
DeepInfra · 1 ▾
  • DeepInfra: 3.33 / 16.66
1 M
Claude Fable 5.1 anthropic 53 82
8.33
41.66
57 tok/s
Uptime 100 %
global neu
Amazon Bedrock · 4 ▾
  • Amazon Bedrock: 8.33 / 41.66
  • Google: 8.33 / 41.66
  • Azure: 8.33 / 41.66
  • Anthropic: 8.33 / 41.66
1 M
GPT 6 Astra openai 53 77
4.17
20.83
70 tok/s
Uptime 100 %
global neu
OpenAI · 3 ▾
  • OpenAI: 4.17 / 20.83
  • Azure: 8.33 / 41.66
  • Amazon Bedrock: 9.17 / 45.83
1 M
Claude Opus 5 anthropic 51 78
4.17
20.83
101 tok/s
Uptime 100 %
global neu
DeepInfra · 6 ▾
  • DeepInfra: 4.17 / 20.83
  • Claude Platform on AWS: 4.17 / 20.83
  • Google: 4.17 / 20.83
  • Amazon Bedrock: 4.17 / 20.83
  • Azure: 4.17 / 20.83
  • Anthropic: 4.17 / 20.83
1 M
Claude Fable 5 anthropic 50 77
8.33
41.66
– global neu
DeepInfra · 1 ▾
  • DeepInfra: 8.33 / 41.66
1 M
GPT 5.6 Sol openai 47 77
0.83
4.17
106 tok/s
Uptime 100 %
global neu
OpenAI · 3 ▾
  • OpenAI: 0.83 / 4.17
  • Azure: 3.33 / 16.66
  • Amazon Bedrock: 3.67 / 18.33
1 M
Mimo V2.6 Pro xiaomi 46
0.36
0.73
– global neu
DeepInfra · 2 ▾
  • DeepInfra: 0.36 / 0.73
  • Novita: 0.36 / 0.73
1 M
GLM 5.3 z-ai 45 75
1.17
3.67
– global neu
Novita · 1 ▾
  • Novita: 1.17 / 3.67
1 M
Grok 4.6 x-ai 44 77
1.67
5.00
83 tok/s
Uptime 100 %
global neu
xAI · 2 ▾
  • xAI: 1.67 / 5.00
  • Amazon Bedrock: 1.83 / 5.50
500 k
Kimi K3 moonshotai 44 76
2.38
11.87
– global neu
DeepInfra · 2 ▾
  • DeepInfra: 2.38 / 11.87
  • Novita: 2.50 / 12.50
1 M
GLM 5.3 Flash z-ai 42 72
0.13
0.42
– global neu
Novita · 1 ▾
  • Novita: 0.13 / 0.42
1 M
Claude Opus 4.8 anthropic 42 74
4.17
20.83
– global neu
DeepInfra · 1 ▾
  • DeepInfra: 4.17 / 20.83
1 M
Qwen3.8 2.4t A95b qwen 40 72
1.67
5.00
– global neu
Novita · 2 ▾
  • Novita: 1.67 / 5.00
  • DeepInfra: 1.67 / 5.00
1 M
DeepSeek V4.1 Flash deepseek 40
0.067
0.33
236 tok/s
Uptime 100 %
global
Sail Research · 30 ▾
  • Sail Research: 0.067 / 0.33
  • Wafer: 0.041 / 0.37
  • InferenceNet: 0.057 / 0.38
  • DekaLLM: 0.10 / 0.33
  • OpenInference: 0.025 / 0.42
  • DeepInfra: 0.12 / 0.35
  • AtlasCloud: 0.095 / 0.38
  • Morph: 0.066 / 0.43
  • Relace: 0.017 / 0.50
  • StreamLake: 0.14 / 0.55
  • CoreWeave: 0.17 / 0.54
  • Fireworks: 0.18 / 0.55
  • GMICloud: 0.15 / 0.60
  • Novita: 0.16 / 0.65
  • NextBit: 0.18 / 0.70
  • Phala: 0.18 / 0.70
  • Krea: 0.19 / 0.75
  • Io Net: 0.21 / 0.83
  • Ionstream: 0.24 / 0.83
  • Baidu: 0.25 / 1.00
  • BaseTen: 0.25 / 1.00
  • Makora: 0.25 / 1.00
  • Modal: 0.25 / 1.00
  • Parasail: 0.25 / 1.00
  • DeepSeek: 0.25 / 1.00
  • DigitalOcean: 0.25 / 1.00
  • Alibaba: 0.25 / 1.00
  • Together: 0.25 / 1.00
  • SiliconFlow: 0.25 / 1.00
  • Venice: 0.31 / 1.25
1 M
Gemini 3.7 Flash google 39 76
0.63
3.13
– global neu
DeepInfra · 1 ▾
  • DeepInfra: 0.63 / 3.13
1 M
Claude Sonnet 5 anthropic 38 72
2.50
12.50
– global neu
DeepInfra · 1 ▾
  • DeepInfra: 2.50 / 12.50
1 M
Mimo V2.6 Flash xiaomi 38
0.12
0.23
– global
DeepInfra · 2 ▾
  • DeepInfra: 0.12 / 0.23
  • Novita: 0.12 / 0.23
1 M
DeepSeek V4 Pro 0813 deepseek 36 69
1.08
2.17
– global neu
DeepInfra · 2 ▾
  • DeepInfra: 1.08 / 2.17
  • Novita: 1.10 / 3.30
1 M
DeepSeek V4 Flash 0731 deepseek 34 69
0.050
0.15
– global neu
DeepInfra · 2 ▾
  • DeepInfra: 0.050 / 0.15
  • Novita: 0.37 / 1.10
1 M
Qwen3.8 27b qwen 34 68
0.35
2.50
– global neu
Novita · 1 ▾
  • Novita: 0.35 / 2.50
1 M
GLM 5.2 z-ai 34 69
1.17
3.67
– global neu
Novita · 1 ▾
  • Novita: 1.17 / 3.67
1 M
Gemini 3.5 Flash google 33 70
1.25
7.50
– global neu
DeepInfra · 1 ▾
  • DeepInfra: 1.25 / 7.50
1 M
DeepSeek V4 Pro deepseek 30 59
1.08
2.17
– global neu
DeepInfra · 2 ▾
  • DeepInfra: 1.08 / 2.17
  • Novita: 1.33 / 2.67
1 M
Claude Sonnet 4.6 anthropic 30 63
2.50
12.50
– global neu
DeepInfra · 1 ▾
  • DeepInfra: 2.50 / 12.50
1 M
Qwen3.7 Max qwen 30 66
1.04
3.13
– global neu
Novita · 2 ▾
  • Novita: 1.04 / 3.13
  • DeepInfra: 2.08 / 6.25
1 M
Minimax M3 minimax 29 59
0.23
0.92
– global neu
DeepInfra · 1 ▾
  • DeepInfra: 0.23 / 0.92
524 k
Kimi K2.6 moonshotai 27 62
0.67
2.83
– global neu
Novita · 2 ▾
  • Novita: 0.67 / 2.83
  • DeepInfra: 0.63 / 2.92
262 k
GLM 5.1 z-ai 26 56
1.15
3.67
– global neu
Novita · 1 ▾
  • Novita: 1.15 / 3.67
204 k
Mimo V2.5 Pro xiaomi 26 60
0.44
0.87
– global neu
Novita · 1 ▾
  • Novita: 0.44 / 0.87
1 M
Kimi K2.7 Code moonshotai 26 61
0.79
3.33
– global neu
Novita · 1 ▾
  • Novita: 0.79 / 3.33
262 k
Inkling thinkingmachines 25 52
0.79
3.37
– global neu
DeepInfra · 1 ▾
  • DeepInfra: 0.79 / 3.37
524 k
Ling 3.0 Flash VL inclusionai 25 57
0.050
0.15
– global neu
DeepInfra · 2 ▾
  • DeepInfra: 0.050 / 0.15
  • Novita: 0.062 / 0.18
262 k
DeepSeek V4 Flash deepseek 24 56
0.075
0.15
– global neu
DeepInfra · 2 ▾
  • DeepInfra: 0.075 / 0.15
  • Novita: 0.12 / 0.23
1 M

Bild & Sprache — derselbe Schlüssel

Nicht nur LLM: Bilder, Sprachausgabe und Transkription vom Markt, mit derselben OpenAI-kompatiblen API und derselben Abrechnung. Du nennst eine Markt-ID, wir nehmen den günstigsten Anbieter. Preise in CHF, inklusive unserer Marge, live aus /api/v1/broker/models?type=….

Ein Lichtstrahl malt ein leuchtendes Berglandschaftsbild über einem Schreibtisch

Bilder erzeugen

Vom schnellen Entwurf bis zur Druckqualität: FLUX, Qwen-Image, Seedream und mehr — oder iris, unser eigenes Bildmodell.

  • iris 0.0065 CHF je Bild
  • stabilityai/sdxl-turbo 0.000217 CHF je Bild
  • black-forest-labs/FLUX-1-schnell 0.000542 CHF je Bild
  • PrunaAI/p-image 0.0054 CHF je Bild
  • black-forest-labs/FLUX-1-dev 0.0097 CHF je Bild
  • black-forest-labs/FLUX-2-dev 0.0108 CHF je Bild
curl https://llm-broker.net/api/v1/images/generations \
  -H "Authorization: Bearer $BROKER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"black-forest-labs/FLUX-1-schnell","prompt":"a lighthouse at dawn","size":"1024x1024"}'
Leuchtende Schallwellen fliessen aus einem Studiomikrofon

Sprachausgabe

Text zu Sprache in vielen Stimmen und Sprachen — Kokoro, Qwen3-TTS, Chatterbox und mehr — oder quill mit Klonstimmen.

  • quill 0.1 CHF je 1 000 Zeichen
  • hexgrad/Kokoro-82M 0.000672 CHF je 1 000 Zeichen
  • ResembleAI/chatterbox-multilingual 0.0011 CHF je 1 000 Zeichen
  • ResembleAI/chatterbox-turbo 0.0011 CHF je 1 000 Zeichen
  • Audio8/Audio8-TTS-Preview-0.6b 0.0054 CHF je 1 000 Zeichen
  • sesame/csm-1b 0.0076 CHF je 1 000 Zeichen
curl https://llm-broker.net/api/v1/audio/speech \
  -H "Authorization: Bearer $BROKER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"hexgrad/Kokoro-82M","input":"Hello from LLM Broker","voice":"af_bella"}' -o hello.mp3
Lichtspuren fliessen über ein nächtliches Stadtraster zu einem hellen Zentrum

Transkription

Sprache zu Text: Whisper, Qwen3-ASR, Voxtral und mehr — abgerechnet nach der Dauer, die der Anbieter misst.

  • quill 0.01 CHF je Minute
  • nvidia/Nemotron-3.5-ASR-Streaming-Multilingual-0.6b 0.000216 CHF je Minute
  • openai/whisper-large-v3-turbo 0.000216 CHF je Minute
  • Qwen/Qwen3-ASR-0.6B 0.000216 CHF je Minute
  • openai/whisper-large-v3 0.000487 CHF je Minute
  • Qwen/Qwen3-ASR-1.7B 0.000487 CHF je Minute
curl https://llm-broker.net/api/v1/audio/transcriptions \
  -H "Authorization: Bearer $BROKER_API_KEY" \
  -F model=openai/whisper-large-v3-turbo -F [email protected]

Ein Prompt — dein KI-Assistent richtet alles ein

Kopiere den Prompt in Claude Code, Cursor, Codex, OpenCode oder jeden anderen Coding-Assistenten. Er liest unsere Doku, eröffnet das Konto per API, legt den Schlüssel sicher ab, bindet die API ein und prüft sie mit einem Rauchtest. Du bestätigst nur die Zahlung.

Eine gläserne Roboterhand setzt einen leuchtenden Schlüssel in ein Schloss

Claude Code: Prompt in die Sitzung einfügen · Cursor/Windsurf: in den Agent-Chat · OpenCode: opencode run "…" · Codex: codex "…"

Richte in diesem Projekt den LLM Broker ein (https://llm-broker.net) — eine OpenAI-kompatible API für LLM, Bilder,
Sprachausgabe und Transkription mit einem Schlüssel. Arbeite selbstständig; frag mich nur, wenn eine Zahlung
bestätigt oder ein Geheimnis eingegeben werden muss.

1. Lies zuerst die Beschreibungen, nicht raten:
   - https://llm-broker.net/llms.txt (Einstieg für Agenten)
   - https://llm-broker.net/api/openapi (alle Endpunkte und Schemata)
   - https://astrioncore.wiki/api und https://astrioncore.wiki/api#konto (Konto und Bezahlung per API)
2. Schlüssel: Ist BROKER_API_KEY (beginnt mit ast_sk_) nicht gesetzt, eröffne ein Konto per API:
   POST https://llm-broker.net/api/v1/broker/accounts
   {"category": "coding", "level": "strong", "billing": "topup", "amount": 25, "currency": "CHF"}
   Zeig mir die checkout_url (die Karte wird einmal bei Stripe eingegeben) und frag danach status_url ab,
   bis 200 kommt. Der api_key erscheint GENAU EINMAL: sofort in .env als BROKER_API_KEY speichern,
   .env in .gitignore, nie ins Log oder in einen Commit. base_url steht in derselben Antwort.
3. Einbinden: OpenAI-SDK der Projektsprache mit base_url und BROKER_API_KEY. Modelle findest du unter
   GET /api/v1/broker/models?type=chat|image|speech|transcription (ohne Schlüssel lesbar).
   - LLM: POST /api/v1/chat/completions, model "james-direct" mit "routing" (category, level|min_score, sort,
     region, family, capabilities, max_price) oder direkt eine Markt-ID wie "deepseek/deepseek-v4.1-flash".
   - Bilder: POST /api/v1/images/generations, Sprache: POST /api/v1/audio/speech,
     Transkription: POST /api/v1/audio/transcriptions — jeweils mit einer Markt-ID der passenden type.
4. Lege eine kleine Client-Schicht an (Konfiguration aus der Umgebung, keine festen Modellnamen im Code —
   lieber routing), schreibe einen Rauchtest mit einem kurzen Chat-Aufruf und führe ihn aus.
5. Abrechnung: GET /api/v1/broker/billing zeigt Guthaben und Verbrauch; Aufladen oder Monatsrahmen ändern
   mit PATCH /api/v1/broker/billing, Karte mit POST|DELETE /api/v1/broker/card.
   Fehler: 402 insufficient_balance (aufladen), 409 no_matching_offer (routing lockern),
   404 model_not_found (Marktliste prüfen), 429 rate_limited (später erneut).
Fasse am Ende zusammen, was eingerichtet ist und wo der Schlüssel liegt.

taylor-Stufen

Eine Stufe ist eine Mindestpunktzahl in UNSEREN Messungen je Einsatzzweck. Der Preis ist der heutige taylor-Preis (günstigstes erfüllendes Modell, inkl. unserer Marge) — je Anfrage entscheidet der Preis in diesem Moment, welches erfüllende Modell antwortet. Die Stufe beim Kauf ist nur die Vorgabe deines Schlüssels: je Anfrage wählst du sie selbst — "routing": {"category": "coding", "level": "best"} für das beste gemessene Modell, "level": "strong" für eine Stufe oder "min_score": 0.85 für deine eigene Schwelle.

Programmierengemessen mit HumanEval+
Solide ≥ 70 %
2.17 / 6.50
10 Modelle erfüllen
Stark ≥ 80 %
2.17 / 6.50
9 Modelle erfüllen
Spitze ≥ 88 %
2.17 / 6.50
8 Modelle erfüllen
Denken & Wissengemessen mit MMLU-Pro + GPQA Diamond
Solide ≥ 55 %
2.17 / 6.50
5 Modelle erfüllen
Stark ≥ 65 %
2.17 / 6.50
5 Modelle erfüllen
Spitze ≥ 75 %
2.17 / 6.50
3 Modelle erfüllen
Mathematikgemessen mit MATH
Solide ≥ 60 %
0.45 / 3.25
6 Modelle erfüllen
Stark ≥ 75 %
0.45 / 3.25
6 Modelle erfüllen
Spitze ≥ 85 %
0.45 / 3.25
4 Modelle erfüllen
Anweisungen befolgengemessen mit IFEval
Solide ≥ 75 %
0.45 / 3.25
6 Modelle erfüllen
Stark ≥ 82 %
0.45 / 3.25
4 Modelle erfüllen
Spitze ≥ 88 %
0.45 / 3.25
3 Modelle erfüllen

Schlüssel holen

Einmal Karte hinterlegen, dann läuft es. Die Kartennummer sieht nur Stripe — wir nie.

Abrechnung (nur Kreditkarte)

Weiter zu Stripe · Visa, Mastercard, Amex · jederzeit per API kündbar

Gläserne Regler lenken Lichtstrahlen in eine leuchtende Kugel

Ein Schlüssel für LLM, Bilder, Sprache und Transkription. Lieber ohne Formular? Alles auch per API — oder lass es deinen KI-Assistenten machen.

Registrieren und bezahlen — alles per API

Ein Programm oder Agent eröffnet das Konto, holt den Schlüssel und verwaltet die Abrechnung selbst. Geld vor Schlüssel: kein Gratisguthaben, der Schlüssel entsteht erst nach der Zahlung.

1 · KONTO

Konto eröffnen

Einsatzzweck, Stufe und Abrechnung wählen. Die Antwort nennt checkout_url und status_url.

curl -X POST https://llm-broker.net/api/v1/broker/accounts \
  -H "Content-Type: application/json" \
  -d '{"category":"coding","level":"strong",
       "billing":"topup","amount":25}'
2 · KARTE

Einmal bezahlen

Die Karte wird einmal bei Stripe eingegeben — von dir oder einem Agenten mit Browser. Wir sehen die Kartennummer nie.

3 · SCHLÜSSEL

Schlüssel abholen

202 bis zur Zahlung, dann api_key (ast_sk_…) und base_url — genau einmal.

curl https://llm-broker.net/api/v1/broker/accounts/$SESSION_ID
4 · ABRECHNUNG

Selbst verwalten

Guthaben und Verbrauch lesen, Aufladen oder Monatsrahmen ändern, Karte wechseln oder entfernen.

GET|PATCH /api/v1/broker/billing
POST|DELETE /api/v1/broker/card

Danach läuft alles ohne Menschen: Aufladen mit der gespeicherten Karte, Monatsabrechnung, Kündigung. Nur die allererste Karteneingabe braucht heute einen Browser bei Stripe. Details: Wiki: Konto & Bezahlung per API.

Welches Modell bekomme ich mit taylor?

Das gerade günstigste unter allen, die deine Stufe in unseren Messungen erreichen. Die Tabelle oben zeigt den Markt; welches Modell eine einzelne Anfrage beantwortet, entscheidet der Preis im Moment der Anfrage. Willst du statt des günstigsten das stärkste: "routing": {"category": "…", "level": "best"} — gilt für taylor, james-direct und jede Markt-ID.

Was heisst „gemessen“?

Wir prüfen jedes Modell selbst mit offenen Benchmarks (Stichproben, gleiche Einstellungen) und messen regelmässig neu. Die Indizes Dritter dienen nur der Vorauswahl.

Und wenn keines die Stufe erfüllt?

Dann antwortet die API mit level_unavailable und belastet nichts — nie still ein schwächeres Modell.

Gibt es auch Bild- und Sprachmodelle?

Ja: Bilderzeugung, Sprachausgabe und Transkription vom Markt mit demselben Schlüssel — Markt-ID unter /api/v1/broker/models?type=image|speech|transcription, dazu unsere eigenen Modelle iris und quill.

Wie wird abgerechnet?

Nach Verbrauch zum Tagespreis — Token, Bilder, Zeichen oder Minuten —, ausschliesslich per Kreditkarte: automatisch aufladen oder monatlich im Nachhinein. Kein Abo, kein Startguthaben.