IT ▾
Ottieni la chiave API

Passa al client in tre righe

Questa guida rapida mostra come integrare la nostra API compatibile con OpenAI e senza censura utilizzando il formato standard dell'endpoint Mistral. Imparerai a autenticarti, inviare richieste e gestire le risposte in streaming con zero overhead di configurazione.

URL di base e autenticazione

Per usare l'API, punta il tuo client su https://api.mistralapi.top/v1. L'autenticazione si basa su un token bearer incluso nell'intestazione Authorization. Generi questa chiave nella pagina Ottieni chiave API usando un account Google o una configurazione standard con email e password. La chiave viene visualizzata immediatamente dopo la creazione. Mantieni questo token al sicuro, poiché garantisce l'accesso completo al tuo credito prepagato. A differenza dei provider standard, non richiediamo un numero di telefono o una carta di credito per l'attivazione del credito di prova iniziale.

Il nostro servizio è progettato per essere integrato direttamente nelle configurazioni esistenti dei client Mistral o OpenAI. Aggiorna semplicemente la proprietà base_url nell'istanza del tuo SDK. La struttura dell'endpoint corrisponde al formato standard /v1/chat/completions, garantendo che il tuo codice esistente funzioni senza modifiche. Supportiamo un singolo ID modello, uncensored, che gestisce tutte le attività di generazione del testo.

Endpoint Chat Completions

L'interazione avviene tramite l'endpoint POST /v1/chat/completions. Invii un JSON con ID model, array messages e parametri opzionali. L'API restituisce testo o dati strutturati in modalità JSON. È il modo principale per interagire con il LLM. Supporta richieste sincrone e streaming. Ogni richiesta consuma token dal saldo prepagato in base al volume di input e output.

Gli errori vengono gestiti tramite codici di stato HTTP standard. Se la tua chiave non è valida, ricevi un 401. Se il credito termina, ricevi un 402. I limiti di richiesta sono impostati a 300 richieste al minuto e 8 connessioni concorrenti per chiave. Usa l'esempio seguente per verificare la tua connessione e la validità della chiave.

curl https://api.mistralapi.top/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Risposte in streaming (SSE)

Per una latenza inferiore e una migliore esperienza utente, abilita lo streaming impostando stream: true nel corpo della richiesta. L'API restituisce uno stream Server-Sent Events (SSE). Ogni chunk contiene una risposta parziale. L'ultimo chunk include le statistiche complete sull'utilizzo dei token per la richiesta. Questo consente alla tua applicazione di visualizzare i token man mano che vengono generati, invece di attendere il completamento completo. Lo streaming è ideale per le interfacce chat dove il feedback immediato è fondamentale.

Quando utilizzi lo streaming, assicurati che il client analizzi correttamente il formato SSE. L'array choices in ogni chunk conterrà contenuti delta. Devi accumulare questi delta per costruire la risposta completa. L'utilizzo dei token è disponibile solo nell'ultimo evento dello stream. Usa questo metodo per mantenere gli utenti coinvolti mentre il modello elabora prompt complessi.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Python

from openai import OpenAI

client = OpenAI(base_url="https://api.mistralapi.top/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node.js

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.mistralapi.top/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Domande e risposte

Questa è l'API ufficiale di Mistral?

No. Siamo un servizio indipendente che replica la struttura dell'endpoint dell'API Mistral. Serviamo il nostro modello senza censura, non i modelli proprietari di Mistral. Usa questa API se vuoi la stessa compatibilità con i client ma con politiche sui contenuti e prezzi diversi.

Come ricarico il mio credito?

Le ricariche avvengono esclusivamente tramite criptovalute (USDT su TRC20 o USDC su Base). La ricarica minima è di $10, quella massima è di $500. Ricevi un bonus del 5% per ricariche superiori a $50 e un bonus del 10% per ricariche superiori a $100. Non accettiamo carte di credito né PayPal.

Qual è il limite della finestra di contesto?

Il modello supporta una finestra di contesto di 100.000 token per prompt e completamento combinati. L'output massimo per richiesta è di 32.000 token, o 2.048 token se non specifichi il <code>max_tokens</code> parametro.

La tua chiave è a un modulo di distanza

Crea un account, copia la chiave, cambia l'URL di base. È tutta la configurazione.

Ottieni la chiave API

Specifiche tecniche

Tutti i limiti e le funzioni reali dell'API in un unico posto: controllali prima di ricaricare.

VoceValore
Formatocompatibile OpenAI: qualsiasi SDK OpenAI funziona cambiando base URL e chiave
ID modellouncensored
Base URLhttps://api.mistralapi.top/v1
EndpointPOST /v1/chat/completions · GET /v1/models
AutenticazioneAuthorization: Bearer YOUR_KEY
Function callingsì — tools, tool_choice; risposte con tool_calls anche in streaming; risultati come role: tool
Parametritemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Streamingsì — server-sent events; l'ultimo blocco riporta l'uso dei token
Finestra di contesto100.000 token (input + output)
Modalità JSONresponse_format: {"type": "json_object"}
Output massimofino al resto della finestra di 100.000 token; max_tokens opzionale (nessun limite separato)
Dimensionefino a 8 MB per richiesta
Concorrenza8 richieste contemporanee per chiave
HeaderX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Limite di frequenza300 richieste al minuto per chiave
Prezzo$0,25 per 1M token in input · $1,00 per 1M in output
Scadenzail credito pagato non scade, nessun abbonamento
Bonus+5% da $50, +10% da $100
Fatturazionecredito prepagato in base all'uso reale; errori e rifiuti gratuiti
Prova gratuita$0,50 per 7 giorni, senza carta · Chiave di prova: 2 richieste parallele, 60 al minuto; limiti completi (8 e 300) dopo la prima ricarica
RicaricaUSDT (TRC20) o USDC (Base), qualsiasi importo intero da $10 a $500
AccessoGoogle oppure e-mail e password
Contenuticontenuti per adulti consentiti; rifiutati i contenuti sessuali con minori
Chiaviuna chiave attiva per account; una nuova sostituisce la precedente

Codici di errore

Gli errori arrivano in JSON con un type fisso; le richieste fallite o rifiutate non si pagano.

CodiceTipoSignificato
400bad_requestJSON non valido, messaggi vuoti, parametro errato o contesto troppo lungo
401missing_key · invalid_key · key_revokedchiave mancante, errata o sostituita
402no_creditcredito esaurito — ricarica e riparti subito
403content_blockedcontenuti sessuali con minori — rifiutato, non addebitato
404not_foundendpoint sconosciuto
413request_too_largecorpo oltre 8 MB
429rate_limited · concurrencyoltre 300/min o 8 in parallelo — attendi e riprova
503upstream_busymodello occupato — riprova tra pochi secondi