Wechsle deinen Client in drei Zeilen
Dieser Schnellstart zeigt dir, wie du unsere unzensierte, OpenAI-kompatible API über das Standard-Mistral-Endpunktformat integrierst. Du lernst, wie du dich authentifizierst, Anfragen sendest und Streaming-Antworten ohne Konfigurationsaufwand verarbeitest.
Basis-URL & Authentifizierung
Um die API zu nutzen, richte deinen Client auf https://api.mistralapi.top/v1 aus. Die Authentifizierung erfolgt über ein Bearer-Token, das im Authorization-Header enthalten sein muss. Du rufst diesen Schlüssel über die Seite API-Schlüssel abrufen ab, entweder mit einem Google-Konto oder einer normalen E-Mail-/Passwort-Konfiguration. Der Schlüssel wird direkt nach der Erstellung angezeigt. Bewahre dieses Token sicher auf, da es dir den vollständigen Zugriff auf dein Prepaid-Guthaben gewährt. Im Gegensatz zu Standard-Anbietern benötigen wir für die Aktivierung des kostenlosen Testguthabens keine Telefonnummer oder Kreditkarte.
Unser Dienst lässt sich nahtlos in bestehende Mistral- oder OpenAI-Client-Konfigurationen einfügen. Aktualisiere einfach die Eigenschaft base_url in deiner SDK-Instanz. Die Endpunktstruktur entspricht dem Standardformat /v1/chat/completions, sodass dein bestehender Code ohne Änderungen funktioniert. Wir unterstützen eine einzige Modell-ID, uncensored, die alle Textgenerierungsaufgaben übernimmt.
Chat Completions Endpunkt
Die Kerninteraktion erfolgt über den Endpunkt POST /v1/chat/completions. Du sendest einen JSON-Body mit deiner model-ID, dem messages-Array und optionalen Parametern. Die API gibt eine Textantwort oder strukturierte Daten zurück, wenn du den JSON-Modus angibst. Dieser Endpunkt ist die primäre Schnittstelle zur Interaktion mit dem LLM. Er unterstützt sowohl Standard-Anfragen als auch Streaming-Antworten. Jede Anfrage verbraucht Token von deinem Prepaid-Guthaben basierend auf Input- und Output-Volumen.
Fehler werden über Standard-HTTP-Statuscodes behandelt. Bei einem ungültigen Schlüssel erhältst du 401. Wenn dein Guthaben aufgebraucht ist, erhältst du 402. Ratenlimits werden mit 300 Anfragen pro Minute und 8 parallelen Verbindungen pro Schlüssel durchgesetzt. Verwende das folgende Beispiel, um deine Verbindung und Schlüsselgültigkeit zu überprüfen.
curl https://api.mistralapi.top/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Streaming-Antworten (SSE)
Für geringere Latenz und bessere Benutzererfahrung aktiviere das Streaming, indem du stream: true in deinem Anfrage-Body festlegst. Die API gibt einen Server-Sent Events (SSE)-Stream zurück. Jeder Chunk enthält eine Teilantwort. Der letzte Chunk enthält die vollständigen Token-Nutzungsstatistiken für die Anfrage. So kann deine Anwendung Token anzeigen, während sie generiert werden, statt auf die vollständige Antwort zu warten. Streaming ist ideal für Chat-Schnittstellen, bei denen sofortiges Feedback entscheidend ist.
Stelle beim Streaming sicher, dass dein Client das SSE-Format korrekt parst. Das choices-Array in jedem Chunk enthält Delta-Inhalte. Du musst diese Deltas akkumulieren, um die vollständige Antwort zu erstellen. Die Token-Nutzung ist nur im letzten Ereignis des Streams verfügbar. Nutze diese Methode, um deine Benutzer engagiert zu halten, während das Modell komplexe Prompts verarbeitet.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Python
from openai import OpenAI
client = OpenAI(base_url="https://api.mistralapi.top/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.mistralapi.top/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Fragen und Antworten
Ist dies die offizielle Mistral-API?
Nein. Wir sind ein unabhängiger Dienst, der die Endpunktstruktur der Mistral-API nachahmt. Wir bieten unser eigenes unzensiertes Modell an, nicht die proprietären Modelle von Mistral. Nutze diese API, wenn du die gleiche Client-Kompatibilität möchtest, aber mit anderen Inhaltsrichtlinien und Preisen.
Wie lade ich mein Guthaben auf?
Aufladungen erfolgen ausschließlich per Kryptowährung (USDT auf TRC20 oder USDC auf Base). Mindestaufladung: 10 $, Maximum: 500 $. Du erhältst einen Bonus von 5 % bei Aufladungen über 50 $ und einen Bonus von 10 % bei Aufladungen über 100 $. Keine Kreditkarten oder PayPal.
Wie hoch ist das Kontextfenster-Limit?
Das Modell unterstützt ein Kontextfenster mit 100.000 Token für Prompt und Completion zusammen. Die maximale Ausgabe pro Anfrage beträgt 32.000 Token oder 2.048 Token, wenn du den <code>max_tokens</code>-Parameter nicht angibst.
Dein Schlüssel ist nur ein Formular entfernt
Erstelle ein Konto, kopiere den Schlüssel, ändere die Basis-URL. Das ist die gesamte Einrichtung.
Technische Daten
Alle echten Grenzen und Funktionen der API auf einen Blick – prüfen Sie sie, bevor Sie Guthaben kaufen.
| Merkmal | Wert |
|---|---|
| API-Format | OpenAI-kompatibel: jedes OpenAI-SDK funktioniert – nur Base-URL und Schlüssel ändern |
| Modell-ID | uncensored |
| Base-URL | https://api.mistralapi.top/v1 |
| Endpunkte | POST /v1/chat/completions · GET /v1/models |
| Authentifizierung | Authorization: Bearer YOUR_KEY |
| Function Calling | ja – tools, tool_choice; Antworten mit tool_calls, auch im Stream; Ergebnisse als role: tool |
| Parameter | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Streaming | ja – Server-Sent Events, der letzte Chunk enthält die Token-Nutzung |
| Kontextfenster | 100.000 Tokens (Eingabe + Ausgabe) |
| JSON-Modus | response_format: {"type": "json_object"} |
| Max. Ausgabe | bis zum Rest des 100.000-Token-Fensters; max_tokens optional (kein separates Limit) |
| Anfragegröße | bis 8 MB |
| Parallelität | 8 gleichzeitige Anfragen pro Schlüssel |
| Antwort-Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Ratenlimit | 300 Anfragen pro Minute und Schlüssel |
| Preis | $0,25 pro 1 Mio. Eingabe-Tokens · $1,00 pro 1 Mio. Ausgabe-Tokens |
| Gültigkeit | bezahltes Guthaben verfällt nie, kein Abo |
| Bonus | +5 % ab $50, +10 % ab $100 |
| Abrechnung | Prepaid-Guthaben nach echter Nutzung; Fehler und Ablehnungen sind kostenlos |
| Testguthaben | $0,50 für 7 Tage, ohne Karte · Testschlüssel: 2 parallele Anfragen, 60 pro Minute; volle Limits (8 und 300) nach erster Aufladung |
| Aufladen | USDT (TRC20) oder USDC (Base), jeder ganze Betrag von $10 bis $500 |
| Anmeldung | Google oder E-Mail und Passwort |
| Inhalte | Inhalte für Erwachsene erlaubt; sexuelle Inhalte mit Minderjährigen werden abgelehnt |
| Schlüssel | ein aktiver Schlüssel pro Konto; ein neuer ersetzt den alten |
Fehlercodes
Fehler kommen als JSON mit festem type; fehlgeschlagene oder abgelehnte Anfragen kosten nichts.
| Code | Typ | Bedeutung |
|---|---|---|
400 | bad_request | ungültiges JSON, leere Nachrichten, falscher Parameter oder Kontext zu lang |
401 | missing_key · invalid_key · key_revoked | Schlüssel fehlt, ist falsch oder wurde ersetzt |
402 | no_credit | kein Guthaben – aufladen, dann geht es sofort weiter |
403 | content_blocked | sexuelle Inhalte mit Minderjährigen – abgelehnt, nicht berechnet |
404 | not_found | unbekannter Endpunkt |
413 | request_too_large | Anfrage größer als 8 MB |
429 | rate_limited · concurrency | über 300/Min. oder 8 parallel – kurz warten |
503 | upstream_busy | Modell ausgelastet – in Sekunden erneut versuchen |