LLM · Bild · Sprache · Einmal einbauen · Immer das Beste
Die beste Leistung zum besten Preis, automatisch.
Du sagst einmal, was du brauchst: Leistung oder Modell, Modellfamilie, Standort, Geschwindigkeit,
Fähigkeiten, Preis. Wir sorgen dafür, dass dein API-Schlüssel genau das bekommt — heute und bei jeder
neuen Modellgeneration, ohne dass du etwas anpasst. LLM, Bilder, Sprachausgabe und Transkription mit
einem Schlüssel; Preise live verglichen, Leistung selbst gemessen, Konto und Abrechnung auch per API.
33Modelle im Vergleich
37Plattformen
0.15CHF je Mio. Ausgabe, ab
Viele Anbieter, ein Weg: jede Anfrage geht zum günstigsten, der deine Regeln erfüllt.
Du nennst die Kriterien. Wir halten sie aktuell.
Einmal festlegen, was zählt — dein API-Schlüssel bekommt genau das, bei jeder Anfrage neu entschieden.
Alle Felder sind Teil derselben OpenAI-kompatiblen API.
Leistung oder Modell
Das beste gemessene Modell je Einsatzzweck, eine Stufe (solid, strong, top), eine eigene Mindestleistung — etwa 0.80 im Programmieren — oder ein fester Modellname. Sonst nehmen wir den günstigsten, der das erfüllt.
category + level | min_score · model
Modellfamilie
Zum Beispiel claude, qwen3 oder deepseek/deepseek-v4. Erscheint eine neue Generation, ist sie dabei, sobald sie am Markt ist — mit min_score, sobald wir sie gemessen haben.
family
Standort
Schweiz, EU, USA oder Asien: nur Anbieter mit von uns erfasstem Ausführungsort (eu schliesst ch ein).
region
Geschwindigkeit
Nach gemessenem Durchsatz ordnen, wenn die Antwortzeit zählt.
sort: "speed"
Fähigkeiten
Werkzeuge, strukturierte Ausgabe, Reasoning, Bildeingabe, Mindestkontext — jeder gewählte Anbieter muss es können.
capabilities · min_context
Preis
Günstigster zuerst, beste Punktzahl je Franken oder ein harter Höchstpreis je Million Token.
sort: "price" | "value" · max_price
Einmal einbauen. Nie wieder nachziehen.
Wer eine Plattform oder ein Werkzeug baut, legt sich heute auf ein Modell fest — und zieht morgen nach,
wenn ein besseres oder günstigeres erscheint. Hier legst du dich auf deine Anforderungen fest, nicht auf ein
Modell. Die Schnittstelle bleibt gleich; die Auswahl dahinter treffen wir laufend neu.
Neue Modellgenerationen kommen an, ohne Code-Änderung.
Fällt ein Anbieter aus, übernimmt der nächste, der deine Regeln erfüllt.
Preissenkungen am Markt landen automatisch bei dir.
Erfüllt nichts deine Regeln, sagen wir es klar (409) — kein heimliches Ausweichen.
Listenpreise der Plattformen in CHF je 1 Million Token (Tageskurs, ohne unseren Aufschlag), geprüft alle
15 Minuten. Balken machen Preis und Tempo vergleichbar; Index = Artificial-Analysis über OpenRouter (Vorauswahl,
zugesagt wird nur, was wir selbst messen). Ausführungsort: von uns erfasst — sonst „global“ (anbieterabhängig).
Leistungskarte
Jeder Punkt ein Modell: links günstig, oben stark. Die leuchtende Linie ist die
Effizienzgrenze — kein anderes Modell ist zugleich billiger und besser. Blasengrösse = Kontextfenster.
Nicht nur LLM: Bilder, Sprachausgabe und Transkription vom Markt, mit derselben OpenAI-kompatiblen API und
derselben Abrechnung. Du nennst eine Markt-ID, wir nehmen den günstigsten Anbieter. Preise in CHF,
inklusive unserer Marge, live aus /api/v1/broker/models?type=….
Bilder erzeugen
Vom schnellen Entwurf bis zur Druckqualität: FLUX, Qwen-Image, Seedream und mehr — oder iris, unser eigenes Bildmodell.
iris0.0065 CHF je Bild
stabilityai/sdxl-turbo0.000217 CHF je Bild
black-forest-labs/FLUX-1-schnell0.000542 CHF je Bild
Kopiere den Prompt in Claude Code, Cursor, Codex, OpenCode oder jeden anderen Coding-Assistenten. Er liest
unsere Doku, eröffnet das Konto per API, legt den Schlüssel sicher ab, bindet die API ein und prüft sie mit
einem Rauchtest. Du bestätigst nur die Zahlung.
Claude Code: Prompt in die Sitzung einfügen · Cursor/Windsurf: in den Agent-Chat · OpenCode:
opencode run "…" · Codex: codex "…"
Richte in diesem Projekt den LLM Broker ein (https://llm-broker.net) — eine OpenAI-kompatible API für LLM, Bilder,
Sprachausgabe und Transkription mit einem Schlüssel. Arbeite selbstständig; frag mich nur, wenn eine Zahlung
bestätigt oder ein Geheimnis eingegeben werden muss.
1. Lies zuerst die Beschreibungen, nicht raten:
- https://llm-broker.net/llms.txt (Einstieg für Agenten)
- https://llm-broker.net/api/openapi (alle Endpunkte und Schemata)
- https://astrioncore.wiki/api und https://astrioncore.wiki/api#konto (Konto und Bezahlung per API)
2. Schlüssel: Ist BROKER_API_KEY (beginnt mit ast_sk_) nicht gesetzt, eröffne ein Konto per API:
POST https://llm-broker.net/api/v1/broker/accounts
{"category": "coding", "level": "strong", "billing": "topup", "amount": 25, "currency": "CHF"}
Zeig mir die checkout_url (die Karte wird einmal bei Stripe eingegeben) und frag danach status_url ab,
bis 200 kommt. Der api_key erscheint GENAU EINMAL: sofort in .env als BROKER_API_KEY speichern,
.env in .gitignore, nie ins Log oder in einen Commit. base_url steht in derselben Antwort.
3. Einbinden: OpenAI-SDK der Projektsprache mit base_url und BROKER_API_KEY. Modelle findest du unter
GET /api/v1/broker/models?type=chat|image|speech|transcription (ohne Schlüssel lesbar).
- LLM: POST /api/v1/chat/completions, model "james-direct" mit "routing" (category, level|min_score, sort,
region, family, capabilities, max_price) oder direkt eine Markt-ID wie "deepseek/deepseek-v4.1-flash".
- Bilder: POST /api/v1/images/generations, Sprache: POST /api/v1/audio/speech,
Transkription: POST /api/v1/audio/transcriptions — jeweils mit einer Markt-ID der passenden type.
4. Lege eine kleine Client-Schicht an (Konfiguration aus der Umgebung, keine festen Modellnamen im Code —
lieber routing), schreibe einen Rauchtest mit einem kurzen Chat-Aufruf und führe ihn aus.
5. Abrechnung: GET /api/v1/broker/billing zeigt Guthaben und Verbrauch; Aufladen oder Monatsrahmen ändern
mit PATCH /api/v1/broker/billing, Karte mit POST|DELETE /api/v1/broker/card.
Fehler: 402 insufficient_balance (aufladen), 409 no_matching_offer (routing lockern),
404 model_not_found (Marktliste prüfen), 429 rate_limited (später erneut).
Fasse am Ende zusammen, was eingerichtet ist und wo der Schlüssel liegt.
Set up LLM Broker in this project (https://llm-broker.net) — one OpenAI-compatible API for LLMs, images, speech
and transcription with a single key. Work on your own; only ask me when a payment must be confirmed or a secret
must be entered.
1. Read the descriptions first, don't guess:
- https://llm-broker.net/llms.txt (entry point for agents)
- https://llm-broker.net/api/openapi (all endpoints and schemas)
- https://astrioncore.wiki/api and https://astrioncore.wiki/api#konto (account and billing via API)
2. Key: if BROKER_API_KEY (starts with ast_sk_) is not set, open an account via the API:
POST https://llm-broker.net/api/v1/broker/accounts
{"category": "coding", "level": "strong", "billing": "topup", "amount": 25, "currency": "USD"}
Show me the checkout_url (the card is entered once at Stripe), then poll status_url until it returns 200.
The api_key is shown EXACTLY ONCE: store it right away in .env as BROKER_API_KEY, add .env to .gitignore,
never log or commit it. base_url is in the same response.
3. Integrate: the OpenAI SDK of the project's language with base_url and BROKER_API_KEY. Models are listed at
GET /api/v1/broker/models?type=chat|image|speech|transcription (no key needed).
- LLM: POST /api/v1/chat/completions, model "james-direct" with "routing" (category, level|min_score, sort,
region, family, capabilities, max_price) or a market id such as "deepseek/deepseek-v4.1-flash".
- Images: POST /api/v1/images/generations, speech: POST /api/v1/audio/speech,
transcription: POST /api/v1/audio/transcriptions — each with a market id of the matching type.
4. Add a small client layer (configuration from the environment, no hard-coded model names — prefer routing),
write a smoke test with one short chat call and run it.
5. Billing: GET /api/v1/broker/billing shows balance and spend; top up or change the monthly limit with
PATCH /api/v1/broker/billing, the card with POST|DELETE /api/v1/broker/card.
Errors: 402 insufficient_balance (top up), 409 no_matching_offer (relax routing),
404 model_not_found (check the market list), 429 rate_limited (retry later).
Finish with a summary of what is set up and where the key is stored.
taylor-Stufen
Eine Stufe ist eine Mindestpunktzahl in UNSEREN Messungen je Einsatzzweck. Der Preis ist der heutige
taylor-Preis (günstigstes erfüllendes Modell, inkl. unserer Marge) — je Anfrage entscheidet der Preis
in diesem Moment, welches erfüllende Modell antwortet. Die Stufe beim Kauf ist nur die Vorgabe deines Schlüssels: je Anfrage wählst du sie selbst — "routing": {"category": "coding", "level": "best"} für das beste gemessene Modell, "level": "strong" für eine Stufe oder "min_score": 0.85 für deine eigene Schwelle.
Programmierengemessen mit HumanEval+
Solide ≥ 70 %
2.17 / 6.50
10 Modelle erfüllen
Stark ≥ 80 %
2.17 / 6.50
9 Modelle erfüllen
Spitze ≥ 88 %
2.17 / 6.50
8 Modelle erfüllen
Denken & Wissengemessen mit MMLU-Pro + GPQA Diamond
Solide ≥ 55 %
2.17 / 6.50
5 Modelle erfüllen
Stark ≥ 65 %
2.17 / 6.50
5 Modelle erfüllen
Spitze ≥ 75 %
2.17 / 6.50
3 Modelle erfüllen
Mathematikgemessen mit MATH
Solide ≥ 60 %
0.45 / 3.25
6 Modelle erfüllen
Stark ≥ 75 %
0.45 / 3.25
6 Modelle erfüllen
Spitze ≥ 85 %
0.45 / 3.25
4 Modelle erfüllen
Anweisungen befolgengemessen mit IFEval
Solide ≥ 75 %
0.45 / 3.25
6 Modelle erfüllen
Stark ≥ 82 %
0.45 / 3.25
4 Modelle erfüllen
Spitze ≥ 88 %
0.45 / 3.25
3 Modelle erfüllen
Schlüssel holen
Einmal Karte hinterlegen, dann läuft es. Die Kartennummer sieht nur Stripe — wir nie.
Registrieren und bezahlen — alles per API
Ein Programm oder Agent eröffnet das Konto, holt den Schlüssel und verwaltet die Abrechnung selbst. Geld vor
Schlüssel: kein Gratisguthaben, der Schlüssel entsteht erst nach der Zahlung.
1 · KONTO
Konto eröffnen
Einsatzzweck, Stufe und Abrechnung wählen. Die Antwort nennt checkout_url und status_url.
Danach läuft alles ohne Menschen: Aufladen mit der gespeicherten Karte, Monatsabrechnung, Kündigung. Nur die
allererste Karteneingabe braucht heute einen Browser bei Stripe. Details: Wiki: Konto & Bezahlung per API.
Welches Modell bekomme ich mit taylor?
Das gerade günstigste unter allen, die deine Stufe in unseren Messungen erreichen. Die Tabelle oben zeigt den Markt; welches Modell eine einzelne Anfrage beantwortet, entscheidet der Preis im Moment der Anfrage. Willst du statt des günstigsten das stärkste: "routing": {"category": "…", "level": "best"} — gilt für taylor, james-direct und jede Markt-ID.
Was heisst „gemessen“?
Wir prüfen jedes Modell selbst mit offenen Benchmarks (Stichproben, gleiche Einstellungen) und messen regelmässig neu. Die Indizes Dritter dienen nur der Vorauswahl.
Und wenn keines die Stufe erfüllt?
Dann antwortet die API mit level_unavailable und belastet nichts — nie still ein schwächeres Modell.
Gibt es auch Bild- und Sprachmodelle?
Ja: Bilderzeugung, Sprachausgabe und Transkription vom Markt mit demselben Schlüssel — Markt-ID unter /api/v1/broker/models?type=image|speech|transcription, dazu unsere eigenen Modelle iris und quill.
Wie wird abgerechnet?
Nach Verbrauch zum Tagespreis — Token, Bilder, Zeichen oder Minuten —, ausschliesslich per Kreditkarte: automatisch aufladen oder monatlich im Nachhinein. Kein Abo, kein Startguthaben.