NL ▾
API-sleutel aanvragen

Schakel je client in drie regels

Deze quickstart-gids laat zien hoe je je integreert met onze ongecensureerde, OpenAI-compatible API met behulp van het standaard Mistral-endpointformaat. Je leert authenticeren, verzoeken versturen en streamingresponsen verwerken zonder configuratie-overhead.

Base URL & Authenticatie

Om de API te gebruiken, wijst je client naar https://api.mistralapi.top/v1. Authenticatie verloopt via een bearer token in de Authorization header. Je genereert deze sleutel via de API-sleutel ophalen pagina met een Google-account of een standaard e-mail/wachtwoord-setup. De sleutel wordt direct na het aanmaken weergegeven. Bewaar deze token veilig, omdat deze volledige toegang geeft tot je prepaid tegoed. In tegenstelling tot standaardproviders, vragen we niet om een telefoonnummer of creditcard voor het activeren van het gratis proeftegoed.

Onze dienst is ontworpen om direct in bestaande Mistral- of OpenAI-clientconfiguraties te passen. Werk simpelweg de eigenschap base_url bij in je SDK-instantie. De endpointstructuur komt overeen met het standaard /v1/chat/completions formaat, waardoor je bestaande code zonder aanpassingen werkt. We ondersteunen één model-ID, uncensored, dat alle tekstgeneratietaken afhandelt.

Chat Completions Endpoint

De kerninteractie gebeurt via het POST /v1/chat/completions endpoint. Je stuurt een JSON-lichaam met je model ID, messages array en optionele parameters. De API retourneert een tekstrespons of gestructureerde data als je JSON-modus specificeert. Dit endpoint is de primaire manier om met de LLM te communiceren. Het ondersteunt zowel standaard synchronische verzoeken als streamingresponsen. Elk verzoek verbruikt tokens van je prepaid saldo op basis van input- en outputvolume.

Fouten worden afgehandeld via standaard HTTP-statuscodes. Als je sleutel ongeldig is, ontvang je een 401. Als je tegoed op is, ontvang je een 402. Rate limits worden afgedwongen op 300 verzoeken per minuut en 8 gelijktijdige verbindingen per sleutel. Gebruik het volgende voorbeeld om je verbinding en sleutelvaliditeit te verifiëren.

curl https://api.mistralapi.top/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Streaming Responsen (SSE)

Voor lagere latentie en een betere gebruikerservaring, activeer streaming door stream: true in je request body in te stellen. De API retourneert een Server-Sent Events (SSE) stream. Elke chunk bevat een gedeeltelijke respons. De laatste chunk bevat de volledige token-gebruiksstatistieken voor het verzoek. Dit stelt je applicatie in staat tokens weer te geven zodra ze gegenereerd zijn, in plaats van te wachten op de volledige completion. Streaming is ideaal voor chatinterfaces waar directe feedback cruciaal is.

Bij het gebruik van streaming, zorg er dan voor dat je client het SSE-formaat correct parseert. De choices array in elke chunk bevat delta-inhoud. Je moet deze deltas accumuleren om de volledige respons te construeren. Token-gebruik is alleen beschikbaar in het laatste evenement van de stream. Gebruik deze methode om je gebruikers betrokken te houden terwijl het model complexe prompts verwerkt.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Python

from openai import OpenAI

client = OpenAI(base_url="https://api.mistralapi.top/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node.js

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.mistralapi.top/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Vragen en antwoorden

Is dit de officiële Mistral API?

Nee. Wij zijn een onafhankelijke dienst die de endpointstructuur van de Mistral API nabootst. Wij serveren ons eigen ongecensureerde model, niet de propriëtaire modellen van Mistral. Gebruik deze API als je dezelfde clientcompatibiliteit wilt, maar met andere contentbeleid en prijzen.

Hoe laad ik tegoed op?

Opwaarderingen gebeuren alleen via cryptocurrency (USDT op TRC20 of USDC op Base). Minimale opwaardering is $10, maximaal $500. Je ontvangt een bonus van 5% voor opwaarderingen boven de $50 en een bonus van 10% voor opwaarderingen boven de $100. Er worden geen creditcards of PayPal geaccepteerd.

Wat is de limiet van het contextvenster?

Het model ondersteunt een contextvenster van 100.000 tokens voor zowel prompt als completion samen. De maximale uitvoer per verzoek is 32.000 tokens, of 2.048 tokens als je de parameter <code>max_tokens</code> niet specificeert.

Je sleutel is nog maar één formulier verwijderd

Maak een account aan, kopieer de sleutel, pas de basis-URL aan. Dat is de hele setup.

API-sleutel aanvragen

Technische specificaties

Alle echte limieten en functies van de API op één plek — controleer ze voordat je opwaardeert.

OnderdeelWaarde
API-formaatOpenAI-compatibel: elke OpenAI-SDK werkt — vervang alleen base URL en sleutel
Model-IDuncensored
Base URLhttps://api.mistralapi.top/v1
EndpointsPOST /v1/chat/completions · GET /v1/models
AuthenticatieAuthorization: Bearer YOUR_KEY
Function callingja — tools, tool_choice; antwoorden bevatten tool_calls, ook bij streaming; resultaten als role: tool
Parameterstemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Streamingja — server-sent events; het laatste deel bevat het tokenverbruik
Contextvenster100.000 tokens (invoer + uitvoer)
JSON-modusresponse_format: {"type": "json_object"}
Max. uitvoertot de rest van het venster van 100.000 tokens; max_tokens optioneel (geen aparte limiet)
Verzoekgroottetot 8 MB
Gelijktijdige verzoekentot 8 tegelijk per sleutel
ResponsheadersX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Rate limit300 verzoeken per minuut per sleutel
Prijs$0,25 per 1 mln invoertokens · $1,00 per 1 mln uitvoertokens
Geldigheidbetaald tegoed verloopt niet, geen abonnement
Bonus+5% vanaf $50, +10% vanaf $100
Afrekeningprepaid tegoed op basis van echt verbruik; fouten en weigeringen zijn gratis
Gratis proeftegoed$0,50 voor 7 dagen, zonder kaart · Proefsleutel: 2 parallelle verzoeken, 60 per minuut; volledige limieten (8 en 300) na eerste opwaardering
OpwaarderenUSDT (TRC20) of USDC (Base), elk heel bedrag van $10 tot $500
InloggenGoogle of e-mail en wachtwoord
Inhoudinhoud voor volwassenen toegestaan; seksuele inhoud met minderjarigen wordt geweigerd
Sleutelséén actieve sleutel per account; een nieuwe vervangt de oude

Foutcodes

Fouten komen als JSON met een vaste type; mislukte of geweigerde verzoeken kosten niets.

CodeTypeBetekenis
400bad_requestongeldige JSON, lege berichten, verkeerde parameter of context te lang
401missing_key · invalid_key · key_revokedsleutel ontbreekt, is onjuist of is vervangen
402no_creditgeen tegoed — waardeer op en ga direct verder
403content_blockedseksuele inhoud met minderjarigen — geweigerd, niet gerekend
404not_foundonbekend endpoint
413request_too_largebody groter dan 8 MB
429rate_limited · concurrencymeer dan 300/min of 8 tegelijk — wacht en probeer opnieuw
503upstream_busymodel bezet — probeer het over enkele seconden opnieuw