Schakel je client in drie regels
Deze quickstart-gids laat zien hoe je je integreert met onze ongecensureerde, OpenAI-compatible API met behulp van het standaard Mistral-endpointformaat. Je leert authenticeren, verzoeken versturen en streamingresponsen verwerken zonder configuratie-overhead.
Base URL & Authenticatie
Om de API te gebruiken, wijst je client naar https://api.mistralapi.top/v1. Authenticatie verloopt via een bearer token in de Authorization header. Je genereert deze sleutel via de API-sleutel ophalen pagina met een Google-account of een standaard e-mail/wachtwoord-setup. De sleutel wordt direct na het aanmaken weergegeven. Bewaar deze token veilig, omdat deze volledige toegang geeft tot je prepaid tegoed. In tegenstelling tot standaardproviders, vragen we niet om een telefoonnummer of creditcard voor het activeren van het gratis proeftegoed.
Onze dienst is ontworpen om direct in bestaande Mistral- of OpenAI-clientconfiguraties te passen. Werk simpelweg de eigenschap base_url bij in je SDK-instantie. De endpointstructuur komt overeen met het standaard /v1/chat/completions formaat, waardoor je bestaande code zonder aanpassingen werkt. We ondersteunen één model-ID, uncensored, dat alle tekstgeneratietaken afhandelt.
Chat Completions Endpoint
De kerninteractie gebeurt via het POST /v1/chat/completions endpoint. Je stuurt een JSON-lichaam met je model ID, messages array en optionele parameters. De API retourneert een tekstrespons of gestructureerde data als je JSON-modus specificeert. Dit endpoint is de primaire manier om met de LLM te communiceren. Het ondersteunt zowel standaard synchronische verzoeken als streamingresponsen. Elk verzoek verbruikt tokens van je prepaid saldo op basis van input- en outputvolume.
Fouten worden afgehandeld via standaard HTTP-statuscodes. Als je sleutel ongeldig is, ontvang je een 401. Als je tegoed op is, ontvang je een 402. Rate limits worden afgedwongen op 300 verzoeken per minuut en 8 gelijktijdige verbindingen per sleutel. Gebruik het volgende voorbeeld om je verbinding en sleutelvaliditeit te verifiëren.
curl https://api.mistralapi.top/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Streaming Responsen (SSE)
Voor lagere latentie en een betere gebruikerservaring, activeer streaming door stream: true in je request body in te stellen. De API retourneert een Server-Sent Events (SSE) stream. Elke chunk bevat een gedeeltelijke respons. De laatste chunk bevat de volledige token-gebruiksstatistieken voor het verzoek. Dit stelt je applicatie in staat tokens weer te geven zodra ze gegenereerd zijn, in plaats van te wachten op de volledige completion. Streaming is ideaal voor chatinterfaces waar directe feedback cruciaal is.
Bij het gebruik van streaming, zorg er dan voor dat je client het SSE-formaat correct parseert. De choices array in elke chunk bevat delta-inhoud. Je moet deze deltas accumuleren om de volledige respons te construeren. Token-gebruik is alleen beschikbaar in het laatste evenement van de stream. Gebruik deze methode om je gebruikers betrokken te houden terwijl het model complexe prompts verwerkt.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Python
from openai import OpenAI
client = OpenAI(base_url="https://api.mistralapi.top/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.mistralapi.top/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Vragen en antwoorden
Is dit de officiële Mistral API?
Nee. Wij zijn een onafhankelijke dienst die de endpointstructuur van de Mistral API nabootst. Wij serveren ons eigen ongecensureerde model, niet de propriëtaire modellen van Mistral. Gebruik deze API als je dezelfde clientcompatibiliteit wilt, maar met andere contentbeleid en prijzen.
Hoe laad ik tegoed op?
Opwaarderingen gebeuren alleen via cryptocurrency (USDT op TRC20 of USDC op Base). Minimale opwaardering is $10, maximaal $500. Je ontvangt een bonus van 5% voor opwaarderingen boven de $50 en een bonus van 10% voor opwaarderingen boven de $100. Er worden geen creditcards of PayPal geaccepteerd.
Wat is de limiet van het contextvenster?
Het model ondersteunt een contextvenster van 100.000 tokens voor zowel prompt als completion samen. De maximale uitvoer per verzoek is 32.000 tokens, of 2.048 tokens als je de parameter <code>max_tokens</code> niet specificeert.
Je sleutel is nog maar één formulier verwijderd
Maak een account aan, kopieer de sleutel, pas de basis-URL aan. Dat is de hele setup.
Technische specificaties
Alle echte limieten en functies van de API op één plek — controleer ze voordat je opwaardeert.
| Onderdeel | Waarde |
|---|---|
| API-formaat | OpenAI-compatibel: elke OpenAI-SDK werkt — vervang alleen base URL en sleutel |
| Model-ID | uncensored |
| Base URL | https://api.mistralapi.top/v1 |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Authenticatie | Authorization: Bearer YOUR_KEY |
| Function calling | ja — tools, tool_choice; antwoorden bevatten tool_calls, ook bij streaming; resultaten als role: tool |
| Parameters | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Streaming | ja — server-sent events; het laatste deel bevat het tokenverbruik |
| Contextvenster | 100.000 tokens (invoer + uitvoer) |
| JSON-modus | response_format: {"type": "json_object"} |
| Max. uitvoer | tot de rest van het venster van 100.000 tokens; max_tokens optioneel (geen aparte limiet) |
| Verzoekgrootte | tot 8 MB |
| Gelijktijdige verzoeken | tot 8 tegelijk per sleutel |
| Responsheaders | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Rate limit | 300 verzoeken per minuut per sleutel |
| Prijs | $0,25 per 1 mln invoertokens · $1,00 per 1 mln uitvoertokens |
| Geldigheid | betaald tegoed verloopt niet, geen abonnement |
| Bonus | +5% vanaf $50, +10% vanaf $100 |
| Afrekening | prepaid tegoed op basis van echt verbruik; fouten en weigeringen zijn gratis |
| Gratis proeftegoed | $0,50 voor 7 dagen, zonder kaart · Proefsleutel: 2 parallelle verzoeken, 60 per minuut; volledige limieten (8 en 300) na eerste opwaardering |
| Opwaarderen | USDT (TRC20) of USDC (Base), elk heel bedrag van $10 tot $500 |
| Inloggen | Google of e-mail en wachtwoord |
| Inhoud | inhoud voor volwassenen toegestaan; seksuele inhoud met minderjarigen wordt geweigerd |
| Sleutels | één actieve sleutel per account; een nieuwe vervangt de oude |
Foutcodes
Fouten komen als JSON met een vaste type; mislukte of geweigerde verzoeken kosten niets.
| Code | Type | Betekenis |
|---|---|---|
400 | bad_request | ongeldige JSON, lege berichten, verkeerde parameter of context te lang |
401 | missing_key · invalid_key · key_revoked | sleutel ontbreekt, is onjuist of is vervangen |
402 | no_credit | geen tegoed — waardeer op en ga direct verder |
403 | content_blocked | seksuele inhoud met minderjarigen — geweigerd, niet gerekend |
404 | not_found | onbekend endpoint |
413 | request_too_large | body groter dan 8 MB |
429 | rate_limited · concurrency | meer dan 300/min of 8 tegelijk — wacht en probeer opnieuw |
503 | upstream_busy | model bezet — probeer het over enkele seconden opnieuw |