VI ▾
Lấy khóa API

Chuyển đổi client của bạn chỉ trong ba dòng

Hướng dẫn nhanh này cho bạn thấy cách tích hợp với API tương thích OpenAI không kiểm duyệt của chúng tôi bằng định dạng endpoint Mistral tiêu chuẩn. Bạn sẽ học cách xác thực, gửi yêu cầu và xử lý phản hồi truyền phát mà không cần cấu hình phức tạp.

URL cơ bản & Xác thực

Để dùng API, hãy trỏ client của bạn đến https://api.mistralapi.top/v1. Xác thực dựa trên token bearer trong tiêu đề Authorization. Bạn tạo khóa này qua trang Lấy khóa API bằng tài khoản Google hoặc email/mật khẩu. Khóa hiển thị ngay khi tạo. Giữ token này an toàn vì nó cấp quyền truy cập đầy đủ vào tín dụng trả trước của bạn. Khác với nhà cung cấp tiêu chuẩn, chúng tôi không yêu cầu số điện thoại hay thẻ tín dụng để kích hoạt tín dụng dùng thử ban đầu.

Dịch vụ của chúng tôi được thiết kế để tích hợp trực tiếp vào các cấu hình client Mistral hoặc OpenAI hiện có. Chỉ cần cập nhật thuộc tính base_url trong phiên bản SDK của bạn. Cấu trúc endpoint khớp với định dạng /v1/chat/completions tiêu chuẩn, đảm bảo mã hiện có của bạn hoạt động mà không cần sửa đổi. Chúng tôi hỗ trợ một ID mô hình duy nhất, uncensored, xử lý tất cả các tác vụ tạo văn bản.

Endpoint Chat Completions

Tương tác cốt lõi diễn ra qua endpoint POST /v1/chat/completions. Bạn gửi một body JSON chứa ID model, mảng messages và các tham số tùy chọn. API trả về phản hồi văn bản hoặc dữ liệu có cấu trúc nếu bạn chỉ định chế độ JSON. Endpoint này là cách chính để tương tác với LLM. Nó hỗ trợ cả yêu cầu đồng bộ tiêu chuẩn và phản hồi truyền phát. Mọi yêu cầu đều tiêu thụ token từ số dư trả trước của bạn dựa trên khối lượng đầu vào và đầu ra.

Lỗi được xử lý qua các mã trạng thái HTTP tiêu chuẩn. Nếu khóa của bạn không hợp lệ, bạn nhận được 401. Nếu bạn hết tín dụng, bạn nhận được 402. Giới hạn tốc độ được áp dụng ở mức 300 yêu cầu mỗi phút và 8 kết nối đồng thời mỗi khóa. Hãy sử dụng ví dụ sau để xác minh kết nối và tính hợp lệ của khóa.

curl https://api.mistralapi.top/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Phản hồi truyền phát (SSE)

Để giảm độ trễ và cải thiện trải nghiệm người dùng, bạn hãy bật chế độ truyền phát (streaming) bằng cách đặt stream: true trong thân yêu cầu. API trả về luồng Sự kiện gửi bởi máy chủ (SSE). Mỗi phần chứa một phản hồi từng phần. Phần cuối cùng bao gồm thống kê sử dụng token đầy đủ cho yêu cầu. Điều này cho phép ứng dụng của bạn hiển thị token khi chúng được tạo ra, thay vì phải chờ đợi quá trình hoàn tất. Truyền phát (streaming) rất lý tưởng cho các giao diện trò chuyện nơi phản hồi ngay lập tức là yếu tố then chốt.

Khi sử dụng truyền phát (streaming), bạn hãy đảm bảo máy khách của mình phân tích cú pháp định dạng SSE đúng cách. Mảng choices trong mỗi phần sẽ chứa nội dung delta. Bạn phải tích lũy các delta này để xây dựng phản hồi đầy đủ. Thống kê sử dụng token chỉ khả dụng trong sự kiện cuối cùng của luồng. Hãy sử dụng phương pháp này để giữ chân người dùng trong khi mô hình xử lý các prompt phức tạp.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Python

from openai import OpenAI

client = OpenAI(base_url="https://api.mistralapi.top/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node.js

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.mistralapi.top/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Hỏi đáp

Đây có phải là API Mistral chính thức không?

Không. Chúng tôi là dịch vụ độc lập mô phỏng cấu trúc endpoint API Mistral. Chúng tôi cung cấp mô hình không kiểm duyệt của riêng mình, không phải các mô hình độc quyền của Mistral. Hãy sử dụng API này nếu bạn muốn tương thích khách hàng giống nhau nhưng với chính sách nội dung và giá cả khác.

Tôi nạp tiền tín dụng như thế nào?

Việc nạp tiền chỉ thực hiện qua tiền điện tử (USDT trên TRC20 hoặc USDC trên Base). Nạp tối thiểu là $10, tối đa là $500. Bạn nhận được bonus 5% cho các lần nạp trên $50 và bonus 10% cho các lần nạp trên $100. Không chấp nhận thẻ tín dụng hoặc PayPal.

Giới hạn cửa sổ ngữ cảnh là bao nhiêu?

Mô hình hỗ trợ cửa sổ ngữ cảnh 100.000 token cho cả prompt và kết quả hoàn thành cộng lại. Lượng output tối đa mỗi yêu cầu là 32.000 token, hoặc 2.048 token nếu bạn không chỉ định tham số <code>max_tokens</code>.

Khóa của bạn chỉ cách một biểu mẫu

Tạo tài khoản, sao chép khóa, thay đổi URL cơ bản. Đó là toàn bộ thiết lập.

Lấy khóa API

Thông số kỹ thuật

Toàn bộ giới hạn và tính năng thực tế của API ở một nơi — hãy kiểm tra trước khi nạp tiền.

MụcGiá trị
Định dạngtương thích OpenAI: mọi SDK OpenAI đều chạy được, chỉ cần đổi base URL và khóa
ID mô hìnhuncensored
Base URLhttps://api.mistralapi.top/v1
EndpointPOST /v1/chat/completions · GET /v1/models
Xác thựcAuthorization: Bearer YOUR_KEY
Gọi hàmcó — tools, tool_choice; phản hồi có tool_calls, kể cả khi streaming; kết quả gửi lại bằng role: tool
Tham sốtemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Streamingcó — server-sent events; phần cuối chứa lượng token đã dùng
Cửa sổ ngữ cảnh100.000 token (đầu vào + đầu ra)
Chế độ JSONresponse_format: {"type": "json_object"}
Đầu ra tối đatối đa phần còn lại của cửa sổ 100.000 token; max_tokens tùy chọn (không giới hạn riêng)
Kích thước yêu cầutối đa 8 MB
Yêu cầu đồng thờitối đa 8 cùng lúc cho mỗi khóa
Header phản hồiX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Giới hạn tốc độ300 yêu cầu mỗi phút cho mỗi khóa
Giá$0,25 cho 1 triệu token đầu vào · $1,00 cho 1 triệu token đầu ra
Thời hạntín dụng đã trả không hết hạn, không đăng ký định kỳ
Thưởng+5% từ $50, +10% từ $100
Tính phítín dụng trả trước theo mức dùng thực tế; lỗi và từ chối miễn phí
Dùng thử miễn phí$0,50 trong 7 ngày, không cần thẻ · Khóa dùng thử: 2 yêu cầu song song, 60 yêu cầu/phút; hạn mức đầy đủ (8 và 300) sau lần nạp đầu
Nạp tiềnUSDT (TRC20) hoặc USDC (Base), số tiền nguyên bất kỳ từ $10 đến $500
Đăng nhậpGoogle hoặc email và mật khẩu
Nội dungcho phép nội dung người lớn; từ chối nội dung tình dục liên quan đến trẻ vị thành niên
Khóamỗi tài khoản một khóa đang hoạt động; khóa mới thay thế khóa cũ

Mã lỗi

Lỗi trả về dạng JSON với type cố định; yêu cầu lỗi hoặc bị từ chối không bị tính phí.

MãLoạiÝ nghĩa
400bad_requestJSON sai, tin nhắn trống, tham số sai hoặc vượt cửa sổ ngữ cảnh
401missing_key · invalid_key · key_revokedthiếu khóa, sai khóa hoặc khóa đã bị thay
402no_credithết tín dụng — nạp tiền là dùng tiếp ngay
403content_blockednội dung tình dục liên quan trẻ vị thành niên — từ chối, không tính phí
404not_foundendpoint không tồn tại
413request_too_largenội dung lớn hơn 8 MB
429rate_limited · concurrencyvượt 300/phút hoặc 8 đồng thời — chờ rồi thử lại
503upstream_busymô hình đang bận — thử lại sau vài giây