PL ▾
Pobierz klucz API

Zmień klienta w trzech krokach

Ten przewodnik szybkiego startu pokazuje, jak zintegrować się z naszym API kompatybilnym z OpenAI i pozbawionym cenzury, używając standardowego formatu endpointu Mistral. Nauczysz się uwierzytelniać, wysyłać zapytania i obsługiwać odpowiedzi strumieniowe bez dodatkowego narzutu konfiguracyjnego.

URL bazowy i uwierzytelnianie

Aby korzystać z API, skieruj swojego klienta do https://api.mistralapi.top/v1. Uwierzytelnianie opiera się na tokenie Bearer dołączonym do nagłówka Authorization. Klucz ten generujesz na stronie Uzyskaj klucz API, używając konta Google lub standardowego logowania e-mail/hasło. Klucz jest wyświetlany natychmiast po utworzeniu. Przechowuj ten token bezpiecznie, ponieważ zapewnia pełny dostęp do Twojego przedpłaconego kredytu. W przeciwieństwie do standardowych dostawców, nie wymagamy numeru telefonu ani karty kredytowej do aktywacji darmowego kredytu próbnego.

Nasza usługa jest zaprojektowana tak, aby wpaść bezpośrednio w istniejące konfiguracje klientów Mistral lub OpenAI. Po prostu zaktualizuj właściwość base_url w instancji swojego SDK. Struktura endpointu odpowiada standardowemu formatowi /v1/chat/completions, zapewniając działanie Twojego istniejącego kodu bez modyfikacji. Obsługujemy jeden identyfikator modelu, uncensored, który obsługuje wszystkie zadania generowania tekstu.

Endpoint Chat Completions

Podstawowa interakcja odbywa się przez endpoint POST /v1/chat/completions. Wysyłasz ciało JSON zawierające identyfikator model, tablicę messages oraz parametry opcjonalne. API zwraca odpowiedź tekstową lub dane strukturalne, jeśli określisz tryb JSON. Ten endpoint jest głównym sposobem interakcji z LLM. Obsługuje zarówno standardowe zapytania synchroniczne, jak i odpowiedzi strumieniowe. Każde zapytanie zużywa tokeny z Twojego przedpłaconego salda na podstawie objętości danych wejściowych i wyjściowych.

Błędy są obsługiwane za pomocą standardowych kodów statusu HTTP. Jeśli Twój klucz jest nieprawidłowy, otrzymasz 401. Jeśli zabraknie Ci kredytu, otrzymasz 402. Limity zapytań są egzekwowane na poziomie 300 zapytań na minutę i 8 równoległych połączeń na klucz. Użyj poniższego przykładu, aby zweryfikować połączenie i ważność klucza.

curl https://api.mistralapi.top/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Odpowiedzi strumieniowe (SSE)

Aby zmniejszyć opóźnienia i poprawić doświadczenie użytkownika, włącz strumieniowanie, ustawiając stream: true w ciele zapytania. API zwraca strumień zdarzeń wysłanych przez serwer (SSE). Każdy fragment zawiera częściową odpowiedź. Ostatni fragment zawiera pełne statystyki użycia tokenów dla zapytania. Pozwala to Twojej aplikacji wyświetlać tokeny w miarę ich generowania, zamiast czekać na pełne uzupełnienie. Strumieniowanie jest idealne dla interfejsów czatu, gdzie natychmiastowa informacja zwrotna jest kluczowa.

Podczas strumieniowania upewnij się, że Twój klient poprawnie parsuje format SSE. Tablica choices w każdym cząstkowym pakiecie zawiera zawartość delta. Musisz zsumować te delta, aby zbudować pełną odpowiedź. Użycie tokenów jest dostępne tylko w ostatnim zdarzeniu strumienia. Użyj tej metody, aby utrzymać zaangażowanie użytkowników, podczas gdy model przetwarza złożone prompty.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Python

from openai import OpenAI

client = OpenAI(base_url="https://api.mistralapi.top/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node.js

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.mistralapi.top/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Pytania i odpowiedzi

Czy to oficjalne API Mistral?

Nie. Jesteśmy niezależną usługą, która naśladuje strukturę endpointu API Mistral. Udostępniamy nasz własny model bez cenzury, a nie własne modele Mistral. Skorzystaj z tego API, jeśli chcesz zachować kompatybilność z klientami, ale z innymi politykami treści i cenami.

Jak doładować kredyt?

Doładowania wykonuje się wyłącznie za pomocą kryptowalut (USDT w sieci TRC20 lub USDC na Base). Minimalne doładowanie to $10, maksymalne to $500. Otrzymujesz bonus 5% przy doładowaniach powyżej $50 oraz bonus 10% przy doładowaniach powyżej $100. Nie akceptujemy kart kredytowych ani PayPal.

Jaki jest limit okna kontekstu?

Model obsługuje okno kontekstu 100 000 tokenów dla promptu i uzupełnienia łącznie. Maksymalna wyjściowa wartość na zapytanie to 32 000 tokenów lub 2 048 tokenów, jeśli nie określisz parametru <code>max_tokens</code>.

Twój klucz jest o jeden formularz stąd

Utwórz konto, skopiuj klucz, zmień URL bazowy. To cała konfiguracja.

Pobierz klucz API

Specyfikacja techniczna

Wszystkie rzeczywiste limity i funkcje API w jednym miejscu — sprawdź je przed doładowaniem.

ElementWartość
Format APIzgodne z OpenAI: działa każdy SDK OpenAI — zmień base URL i klucz
ID modeluuncensored
Base URLhttps://api.mistralapi.top/v1
EndpointyPOST /v1/chat/completions · GET /v1/models
UwierzytelnianieAuthorization: Bearer YOUR_KEY
Wywoływanie funkcjitak — tools, tool_choice; odpowiedź zawiera tool_calls, także w strumieniu; wyniki jako role: tool
Parametrytemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Strumieniowanietak — server-sent events; ostatni fragment zawiera zużycie tokenów
Okno kontekstu100 000 tokenów (wejście + odpowiedź)
Tryb JSONresponse_format: {"type": "json_object"}
Maks. odpowiedźdo reszty okna 100 000 tokenów; max_tokens opcjonalne (bez osobnego limitu)
Rozmiar zapytaniado 8 MB
Równoległe zapytaniado 8 jednocześnie na klucz
Nagłówki odpowiedziX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Limit zapytań300 zapytań na minutę na klucz
Cena$0,25 za 1 mln tokenów wejścia · $1,00 za 1 mln tokenów wyjścia
Ważnośćopłacony kredyt nie wygasa, bez subskrypcji
Bonus+5% od $50, +10% od $100
Rozliczenieprzedpłacony kredyt według rzeczywistego zużycia; błędy i odmowy są darmowe
Darmowy kredyt$0,50 na 7 dni, bez karty · Klucz próbny: 2 równoległe żądania, 60 na minutę; pełne limity (8 i 300) po pierwszym doładowaniu
DoładowanieUSDT (TRC20) lub USDC (Base), dowolna pełna kwota od $10 do $500
LogowanieGoogle albo e-mail i hasło
Treścitreści dla dorosłych dozwolone; treści seksualne z udziałem nieletnich są odrzucane
Kluczejeden aktywny klucz na konto; nowy zastępuje stary

Kody błędów

Błędy wracają jako JSON ze stałym type; nieudane i odrzucone zapytania są bezpłatne.

KodTypZnaczenie
400bad_requestbłędny JSON, puste wiadomości, zły parametr lub za długi kontekst
401missing_key · invalid_key · key_revokedbrak klucza, zły klucz lub klucz zastąpiony nowym
402no_creditbrak kredytu — doładuj, działa od razu
403content_blockedtreści seksualne z nieletnimi — odmowa, bez opłaty
404not_foundnieznany endpoint
413request_too_largetreść większa niż 8 MB
429rate_limited · concurrencyponad 300/min lub 8 równolegle — odczekaj i ponów
503upstream_busymodel zajęty — ponów za kilka sekund