Zahlen Sie pro Token, in USD.
Prepaid-Guthaben, pro Request abgebucht. Preise pro 1M Tokens.
| Modell | Input | Cache | Output | Delta |
|---|---|---|---|---|
| Anthropic · Claude | ||||
| claude-opus-5 | — | −89% | ||
| claude-opus-4-8 | $0.055 | −89% | ||
| claude-sonnet-5 | — | −92% | ||
| claude-haiku-4-5 | — | −88% | ||
| claude-fable-5-1 | — | −50% | ||
| OpenAI · GPT | ||||
| gpt-5.6-sol | — | −92% | ||
| gpt-5.6-terra | — | −90% | ||
| gpt-5.6-luna | $0.004 | −80% | ||
| gpt-6-astra | — | −80% | ||
| Moonshot · Kimi | ||||
| kimi-k3 | $0.20 | −33% | ||
| xAI · Grok | ||||
| grok-4.6 | $0.03 | −85% | ||
| grok-4.5 | — | −85% | ||
| Z.ai · GLM | ||||
| glm-5.3 | — | −29% | ||
| glm-5.3-flash | — | −20% | ||
| Google · Gemini | ||||
| gemini-3.1-pro-preview | — | −75% | ||
| gemini-3.7-flash | — | −40% | ||
| gemini-3.8-flash | — | −40% | ||
| gemini-3.1-flash-lite | — | −50% | ||
| DeepSeek | ||||
| deepseek-v4-pro | $0.025 | −62% | ||
| deepseek-v4-flash-0731 | — | −55% | ||
| Alibaba · Qwen | ||||
| qwen3.8-max | — | −50% | ||
$0.00Listenpreis
Nur Modelle mit einem Preis in der Spalte „Cache“ unterstützen Prompt-Caching. Modelle mit einem Gedankenstrich (—) rechnen jedes Eingabe-Token zum Standardtarif ab. Caching erfordert einen stabilen Präfix von mindestens 1.024 Tokens; der Cache-Tarif gilt ab der zweiten Anfrage, die ihn wiederverwendet.
Selbst nachrechnen
Auf das eigene Monatsvolumen ziehen. Der Vergleich rechnet mit 4 Eingabe-Tokens je 1 Ausgabe-Token, ungefähr so sieht Coding-Traffic aus.
Bilder, pro Bild abgerechnet
| Modell | Ausgabe | Pro Bild |
|---|---|---|
| Images | ||
| gpt-image-2-1k | ≈1.6 MP | $0.12 |
| gpt-image-2-2k | ≈4.2 MP · 2048² | $0.20 |
| gpt-image-2-4k | ≈14.7 MP · 3840² | $0.30 |
| gemini-3-pro-image | 1024² – 2048², your choice | $0.08 |
Abgerechnet wird pro Bild, nicht pro Token. Jede Stufe legt das Pixelbudget der Ausgabe fest (das Seitenverhältnis darf weiterhin dem Prompt folgen), die Parameter size und quality werden ignoriert: gekauft wird die Stufe. Ein Listenpreis der Anbieter wird nicht gezeigt, weil Anbieter Bildpreise nach Qualität und Größe veröffentlichen, nicht nach solchen Stufen.
Jedes Modell läuft unter seinem eigenen Namen, unterwegs wird nichts umetikettiert. Guthaben verfällt nie. Aufladen per USDT oder, in Indonesien, per QRIS, E-Wallet oder Banküberweisung; während der Beta geben wir Aufladungen von Hand als Einlösecode aus. Beta-Preise folgen dem Aggregatormarkt und können sich bewegen, bereits gekauftes Guthaben bleibt aber zum bezahlten Preis gültig. Der „Listenpreis“ ist der vom jeweiligen Anbieter im Juli 2026 veröffentlichte Tarif und dient nur zum Vergleich.
Jedes Modell läuft unter seinem eigenen Namen.
Nichts wird unterwegs still gegen etwas Billigeres getauscht. Was Sie aufrufen, läuft auch, und wir prüfen unsere eigenen Anbieter regelmäßig.
Zwei Zeilen Konfiguration.
Base URL ändern, Code behalten. Streaming und Tool Use werden unverändert durchgereicht.
# Claude Code auf LajuAPI zeigen lassen export ANTHROPIC_BASE_URL=https://api.lajuapi.com export ANTHROPIC_AUTH_TOKEN=sk-laju-•••••••• claude
from openai import OpenAI client = OpenAI( base_url="https://api.lajuapi.com/v1", api_key="sk-laju-••••••••", ) resp = client.chat.completions.create( model="gpt-5.6-terra", messages=[{"role": "user", "content": "hello"}], )
$ curl -N https://api.lajuapi.com/v1/messages \ -H "x-api-key: sk-laju-••••••••" \ -H "anthropic-version: 2023-06-01" \ -H "content-type: application/json" \ -d '{"model":"claude-opus-5","stream":true, "max_tokens":256,"messages":[...]}'
Jeder Client mit konfigurierbarer Base URL funktioniert.
Die ehrliche Version.
Billiger Zugang ist leicht versprochen und leicht vermasselt. Das hier sagen wir zu, und das hier nicht.
Best-Effort, kein SLA
Hinter jedem Modell stehen mehrere Anbieter mit automatischem Failover. Die Statuszahlen oben stammen aus echtem Monitoring, nicht aus Dekoration. Wir versprechen keine Verfügbarkeit, die wir nicht halten können.
Kein stilles Modell-Tauschen
Sie bekommen das Modell, das Sie angefordert haben. Genau dafür prüfen wir unsere eigenen Anbieter planmäßig, und eine Route, die beim Vortäuschen erwischt wird, fliegt aus der Rotation.
Nur Prepaid
Keine gespeicherte Karte, keine Überraschungskosten. Ist das Guthaben leer, stoppen die Requests.
Vorhersehbare, typisierte Fehler
Jeder Fehler kommt als dokumentierter Fehler mit Request-ID zurück. Rohe Meldungen der Vorlieferanten werden nie durchgereicht.
Ehrlich beim Logging
Request-Metadaten werden für die Abrechnung gespeichert. Prompt-Inhalte bleiben nur für ein kurzes Debug-Fenster. Die Infrastruktur dahinter protokolliert nach eigenen Regeln, deshalb behaupten wir kein Zero-Logging.
Unabhängiger Dienst
Wir sind niemandes offizieller Reseller und mit keinem Modellanbieter verbunden. Was wir anbieten, ist Kompatibilität mit deren API-Formaten.
Fragen, die sich lohnen.
Ist das ein offizieller Dienst von Anthropic oder OpenAI?
Nein. LajuAPI ist ein unabhängiges Gateway, das dieselben API-Formate spricht, sodass vorhandene SDKs und Coding-Tools unverändert funktionieren. Keine Verbindung, keine Empfehlung.
Wie kann das so viel billiger sein?
Wir kaufen Kapazität in großen Mengen über den Aggregatormarkt und verkaufen sie mit Marge weiter, auf eigener Infrastruktur und mit eigenen Keys. Das ist der ganze Trick: kein angedeuteter Sonderdeal, keine behauptete Partnerschaft. Unser Preis folgt diesem Markt, deshalb sind die Tarife hier indikativ und deshalb bleibt der bereits bezahlte Tarif bestehen.
Funktionieren Streaming und Tool Use?
Ja. Beides geht unverändert durch, und genau das macht agentische Tools wie Claude Code hier brauchbar. Was Ihr Client im Anthropic- oder OpenAI-Format schickt, wird so weitergereicht; Sie ändern nur Base-URL und Key.
Wie bezahle ich?
Prepaid-Guthaben in USD. International per USDT; in Indonesien auch per QRIS, E-Wallet oder Banküberweisung. Während der Beta zahlen Sie zuerst und wir geben einen Einlösecode für Ihr Guthaben aus. Automatische Aufladungen kommen mit der allgemeinen Öffnung.
Werden meine Prompts gespeichert?
Wir behalten Request-Metadaten: Zeitstempel, Modell, Token-Zahl, Latenz, Request-ID, für Abrechnung und Missbrauchsbehandlung. Prompt- und Antwortinhalte bleiben nur für ein kurzes Debug-Fenster. Ihre Requests laufen über Modellinfrastruktur Dritter, deren Aufbewahrungsregeln wir nicht kontrollieren.
Kann ich jetzt ein Konto bekommen?
Nur auf Einladung, solange der Abrechnungsablauf fertiggestellt wird. API, Dashboard und Statusseite sind bereits live, und die öffentliche Anmeldung öffnet zusammen mit automatischen Aufladungen.
Richten Sie Ihre Tools auf einen Endpoint.
API, Dashboard und Statusseite sind live. Die Registrierung öffnet mit der automatischen Abrechnung.