DE ▾
API-Schlüssel erhalten

Wechsle deinen Client in drei Zeilen

Dieser Schnellstart zeigt dir, wie du unsere unzensierte, OpenAI-kompatible API über das Standard-Mistral-Endpunktformat integrierst. Du lernst, wie du dich authentifizierst, Anfragen sendest und Streaming-Antworten ohne Konfigurationsaufwand verarbeitest.

Basis-URL & Authentifizierung

Um die API zu nutzen, richte deinen Client auf https://api.mistralapi.top/v1 aus. Die Authentifizierung erfolgt über ein Bearer-Token, das im Authorization-Header enthalten sein muss. Du rufst diesen Schlüssel über die Seite API-Schlüssel abrufen ab, entweder mit einem Google-Konto oder einer normalen E-Mail-/Passwort-Konfiguration. Der Schlüssel wird direkt nach der Erstellung angezeigt. Bewahre dieses Token sicher auf, da es dir den vollständigen Zugriff auf dein Prepaid-Guthaben gewährt. Im Gegensatz zu Standard-Anbietern benötigen wir für die Aktivierung des kostenlosen Testguthabens keine Telefonnummer oder Kreditkarte.

Unser Dienst lässt sich nahtlos in bestehende Mistral- oder OpenAI-Client-Konfigurationen einfügen. Aktualisiere einfach die Eigenschaft base_url in deiner SDK-Instanz. Die Endpunktstruktur entspricht dem Standardformat /v1/chat/completions, sodass dein bestehender Code ohne Änderungen funktioniert. Wir unterstützen eine einzige Modell-ID, uncensored, die alle Textgenerierungsaufgaben übernimmt.

Chat Completions Endpunkt

Die Kerninteraktion erfolgt über den Endpunkt POST /v1/chat/completions. Du sendest einen JSON-Body mit deiner model-ID, dem messages-Array und optionalen Parametern. Die API gibt eine Textantwort oder strukturierte Daten zurück, wenn du den JSON-Modus angibst. Dieser Endpunkt ist die primäre Schnittstelle zur Interaktion mit dem LLM. Er unterstützt sowohl Standard-Anfragen als auch Streaming-Antworten. Jede Anfrage verbraucht Token von deinem Prepaid-Guthaben basierend auf Input- und Output-Volumen.

Fehler werden über Standard-HTTP-Statuscodes behandelt. Bei einem ungültigen Schlüssel erhältst du 401. Wenn dein Guthaben aufgebraucht ist, erhältst du 402. Ratenlimits werden mit 300 Anfragen pro Minute und 8 parallelen Verbindungen pro Schlüssel durchgesetzt. Verwende das folgende Beispiel, um deine Verbindung und Schlüsselgültigkeit zu überprüfen.

curl https://api.mistralapi.top/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Streaming-Antworten (SSE)

Für geringere Latenz und bessere Benutzererfahrung aktiviere das Streaming, indem du stream: true in deinem Anfrage-Body festlegst. Die API gibt einen Server-Sent Events (SSE)-Stream zurück. Jeder Chunk enthält eine Teilantwort. Der letzte Chunk enthält die vollständigen Token-Nutzungsstatistiken für die Anfrage. So kann deine Anwendung Token anzeigen, während sie generiert werden, statt auf die vollständige Antwort zu warten. Streaming ist ideal für Chat-Schnittstellen, bei denen sofortiges Feedback entscheidend ist.

Stelle beim Streaming sicher, dass dein Client das SSE-Format korrekt parst. Das choices-Array in jedem Chunk enthält Delta-Inhalte. Du musst diese Deltas akkumulieren, um die vollständige Antwort zu erstellen. Die Token-Nutzung ist nur im letzten Ereignis des Streams verfügbar. Nutze diese Methode, um deine Benutzer engagiert zu halten, während das Modell komplexe Prompts verarbeitet.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Python

from openai import OpenAI

client = OpenAI(base_url="https://api.mistralapi.top/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node.js

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.mistralapi.top/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Fragen und Antworten

Ist dies die offizielle Mistral-API?

Nein. Wir sind ein unabhängiger Dienst, der die Endpunktstruktur der Mistral-API nachahmt. Wir bieten unser eigenes unzensiertes Modell an, nicht die proprietären Modelle von Mistral. Nutze diese API, wenn du die gleiche Client-Kompatibilität möchtest, aber mit anderen Inhaltsrichtlinien und Preisen.

Wie lade ich mein Guthaben auf?

Aufladungen erfolgen ausschließlich per Kryptowährung (USDT auf TRC20 oder USDC auf Base). Mindestaufladung: 10 $, Maximum: 500 $. Du erhältst einen Bonus von 5 % bei Aufladungen über 50 $ und einen Bonus von 10 % bei Aufladungen über 100 $. Keine Kreditkarten oder PayPal.

Wie hoch ist das Kontextfenster-Limit?

Das Modell unterstützt ein Kontextfenster mit 100.000 Token für Prompt und Completion zusammen. Die maximale Ausgabe pro Anfrage beträgt 32.000 Token oder 2.048 Token, wenn du den <code>max_tokens</code>-Parameter nicht angibst.

Dein Schlüssel ist nur ein Formular entfernt

Erstelle ein Konto, kopiere den Schlüssel, ändere die Basis-URL. Das ist die gesamte Einrichtung.

API-Schlüssel erhalten

Technische Daten

Alle echten Grenzen und Funktionen der API auf einen Blick – prüfen Sie sie, bevor Sie Guthaben kaufen.

MerkmalWert
API-FormatOpenAI-kompatibel: jedes OpenAI-SDK funktioniert – nur Base-URL und Schlüssel ändern
Modell-IDuncensored
Base-URLhttps://api.mistralapi.top/v1
EndpunktePOST /v1/chat/completions · GET /v1/models
AuthentifizierungAuthorization: Bearer YOUR_KEY
Function Callingja – tools, tool_choice; Antworten mit tool_calls, auch im Stream; Ergebnisse als role: tool
Parametertemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Streamingja – Server-Sent Events, der letzte Chunk enthält die Token-Nutzung
Kontextfenster100.000 Tokens (Eingabe + Ausgabe)
JSON-Modusresponse_format: {"type": "json_object"}
Max. Ausgabebis zum Rest des 100.000-Token-Fensters; max_tokens optional (kein separates Limit)
Anfragegrößebis 8 MB
Parallelität8 gleichzeitige Anfragen pro Schlüssel
Antwort-HeaderX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Ratenlimit300 Anfragen pro Minute und Schlüssel
Preis$0,25 pro 1 Mio. Eingabe-Tokens · $1,00 pro 1 Mio. Ausgabe-Tokens
Gültigkeitbezahltes Guthaben verfällt nie, kein Abo
Bonus+5 % ab $50, +10 % ab $100
AbrechnungPrepaid-Guthaben nach echter Nutzung; Fehler und Ablehnungen sind kostenlos
Testguthaben$0,50 für 7 Tage, ohne Karte · Testschlüssel: 2 parallele Anfragen, 60 pro Minute; volle Limits (8 und 300) nach erster Aufladung
AufladenUSDT (TRC20) oder USDC (Base), jeder ganze Betrag von $10 bis $500
AnmeldungGoogle oder E-Mail und Passwort
InhalteInhalte für Erwachsene erlaubt; sexuelle Inhalte mit Minderjährigen werden abgelehnt
Schlüsselein aktiver Schlüssel pro Konto; ein neuer ersetzt den alten

Fehlercodes

Fehler kommen als JSON mit festem type; fehlgeschlagene oder abgelehnte Anfragen kosten nichts.

CodeTypBedeutung
400bad_requestungültiges JSON, leere Nachrichten, falscher Parameter oder Kontext zu lang
401missing_key · invalid_key · key_revokedSchlüssel fehlt, ist falsch oder wurde ersetzt
402no_creditkein Guthaben – aufladen, dann geht es sofort weiter
403content_blockedsexuelle Inhalte mit Minderjährigen – abgelehnt, nicht berechnet
404not_foundunbekannter Endpunkt
413request_too_largeAnfrage größer als 8 MB
429rate_limited · concurrencyüber 300/Min. oder 8 parallel – kurz warten
503upstream_busyModell ausgelastet – in Sekunden erneut versuchen