Passa al client in tre righe
Questa guida rapida mostra come integrare la nostra API compatibile con OpenAI e senza censura utilizzando il formato standard dell'endpoint Mistral. Imparerai a autenticarti, inviare richieste e gestire le risposte in streaming con zero overhead di configurazione.
URL di base e autenticazione
Per usare l'API, punta il tuo client su https://api.mistralapi.top/v1. L'autenticazione si basa su un token bearer incluso nell'intestazione Authorization. Generi questa chiave nella pagina Ottieni chiave API usando un account Google o una configurazione standard con email e password. La chiave viene visualizzata immediatamente dopo la creazione. Mantieni questo token al sicuro, poiché garantisce l'accesso completo al tuo credito prepagato. A differenza dei provider standard, non richiediamo un numero di telefono o una carta di credito per l'attivazione del credito di prova iniziale.
Il nostro servizio è progettato per essere integrato direttamente nelle configurazioni esistenti dei client Mistral o OpenAI. Aggiorna semplicemente la proprietà base_url nell'istanza del tuo SDK. La struttura dell'endpoint corrisponde al formato standard /v1/chat/completions, garantendo che il tuo codice esistente funzioni senza modifiche. Supportiamo un singolo ID modello, uncensored, che gestisce tutte le attività di generazione del testo.
Endpoint Chat Completions
L'interazione avviene tramite l'endpoint POST /v1/chat/completions. Invii un JSON con ID model, array messages e parametri opzionali. L'API restituisce testo o dati strutturati in modalità JSON. È il modo principale per interagire con il LLM. Supporta richieste sincrone e streaming. Ogni richiesta consuma token dal saldo prepagato in base al volume di input e output.
Gli errori vengono gestiti tramite codici di stato HTTP standard. Se la tua chiave non è valida, ricevi un 401. Se il credito termina, ricevi un 402. I limiti di richiesta sono impostati a 300 richieste al minuto e 8 connessioni concorrenti per chiave. Usa l'esempio seguente per verificare la tua connessione e la validità della chiave.
curl https://api.mistralapi.top/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Risposte in streaming (SSE)
Per una latenza inferiore e una migliore esperienza utente, abilita lo streaming impostando stream: true nel corpo della richiesta. L'API restituisce uno stream Server-Sent Events (SSE). Ogni chunk contiene una risposta parziale. L'ultimo chunk include le statistiche complete sull'utilizzo dei token per la richiesta. Questo consente alla tua applicazione di visualizzare i token man mano che vengono generati, invece di attendere il completamento completo. Lo streaming è ideale per le interfacce chat dove il feedback immediato è fondamentale.
Quando utilizzi lo streaming, assicurati che il client analizzi correttamente il formato SSE. L'array choices in ogni chunk conterrà contenuti delta. Devi accumulare questi delta per costruire la risposta completa. L'utilizzo dei token è disponibile solo nell'ultimo evento dello stream. Usa questo metodo per mantenere gli utenti coinvolti mentre il modello elabora prompt complessi.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Python
from openai import OpenAI
client = OpenAI(base_url="https://api.mistralapi.top/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.mistralapi.top/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Domande e risposte
Questa è l'API ufficiale di Mistral?
No. Siamo un servizio indipendente che replica la struttura dell'endpoint dell'API Mistral. Serviamo il nostro modello senza censura, non i modelli proprietari di Mistral. Usa questa API se vuoi la stessa compatibilità con i client ma con politiche sui contenuti e prezzi diversi.
Come ricarico il mio credito?
Le ricariche avvengono esclusivamente tramite criptovalute (USDT su TRC20 o USDC su Base). La ricarica minima è di $10, quella massima è di $500. Ricevi un bonus del 5% per ricariche superiori a $50 e un bonus del 10% per ricariche superiori a $100. Non accettiamo carte di credito né PayPal.
Qual è il limite della finestra di contesto?
Il modello supporta una finestra di contesto di 100.000 token per prompt e completamento combinati. L'output massimo per richiesta è di 32.000 token, o 2.048 token se non specifichi il <code>max_tokens</code> parametro.
La tua chiave è a un modulo di distanza
Crea un account, copia la chiave, cambia l'URL di base. È tutta la configurazione.
Specifiche tecniche
Tutti i limiti e le funzioni reali dell'API in un unico posto: controllali prima di ricaricare.
| Voce | Valore |
|---|---|
| Formato | compatibile OpenAI: qualsiasi SDK OpenAI funziona cambiando base URL e chiave |
| ID modello | uncensored |
| Base URL | https://api.mistralapi.top/v1 |
| Endpoint | POST /v1/chat/completions · GET /v1/models |
| Autenticazione | Authorization: Bearer YOUR_KEY |
| Function calling | sì — tools, tool_choice; risposte con tool_calls anche in streaming; risultati come role: tool |
| Parametri | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Streaming | sì — server-sent events; l'ultimo blocco riporta l'uso dei token |
| Finestra di contesto | 100.000 token (input + output) |
| Modalità JSON | response_format: {"type": "json_object"} |
| Output massimo | fino al resto della finestra di 100.000 token; max_tokens opzionale (nessun limite separato) |
| Dimensione | fino a 8 MB per richiesta |
| Concorrenza | 8 richieste contemporanee per chiave |
| Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Limite di frequenza | 300 richieste al minuto per chiave |
| Prezzo | $0,25 per 1M token in input · $1,00 per 1M in output |
| Scadenza | il credito pagato non scade, nessun abbonamento |
| Bonus | +5% da $50, +10% da $100 |
| Fatturazione | credito prepagato in base all'uso reale; errori e rifiuti gratuiti |
| Prova gratuita | $0,50 per 7 giorni, senza carta · Chiave di prova: 2 richieste parallele, 60 al minuto; limiti completi (8 e 300) dopo la prima ricarica |
| Ricarica | USDT (TRC20) o USDC (Base), qualsiasi importo intero da $10 a $500 |
| Accesso | Google oppure e-mail e password |
| Contenuti | contenuti per adulti consentiti; rifiutati i contenuti sessuali con minori |
| Chiavi | una chiave attiva per account; una nuova sostituisce la precedente |
Codici di errore
Gli errori arrivano in JSON con un type fisso; le richieste fallite o rifiutate non si pagano.
| Codice | Tipo | Significato |
|---|---|---|
400 | bad_request | JSON non valido, messaggi vuoti, parametro errato o contesto troppo lungo |
401 | missing_key · invalid_key · key_revoked | chiave mancante, errata o sostituita |
402 | no_credit | credito esaurito — ricarica e riparti subito |
403 | content_blocked | contenuti sessuali con minori — rifiutato, non addebitato |
404 | not_found | endpoint sconosciuto |
413 | request_too_large | corpo oltre 8 MB |
429 | rate_limited · concurrency | oltre 300/min o 8 in parallelo — attendi e riprova |
503 | upstream_busy | modello occupato — riprova tra pochi secondi |