Chuyển đổi client của bạn chỉ trong ba dòng
Hướng dẫn nhanh này cho bạn thấy cách tích hợp với API tương thích OpenAI không kiểm duyệt của chúng tôi bằng định dạng endpoint Mistral tiêu chuẩn. Bạn sẽ học cách xác thực, gửi yêu cầu và xử lý phản hồi truyền phát mà không cần cấu hình phức tạp.
URL cơ bản & Xác thực
Để dùng API, hãy trỏ client của bạn đến https://api.mistralapi.top/v1. Xác thực dựa trên token bearer trong tiêu đề Authorization. Bạn tạo khóa này qua trang Lấy khóa API bằng tài khoản Google hoặc email/mật khẩu. Khóa hiển thị ngay khi tạo. Giữ token này an toàn vì nó cấp quyền truy cập đầy đủ vào tín dụng trả trước của bạn. Khác với nhà cung cấp tiêu chuẩn, chúng tôi không yêu cầu số điện thoại hay thẻ tín dụng để kích hoạt tín dụng dùng thử ban đầu.
Dịch vụ của chúng tôi được thiết kế để tích hợp trực tiếp vào các cấu hình client Mistral hoặc OpenAI hiện có. Chỉ cần cập nhật thuộc tính base_url trong phiên bản SDK của bạn. Cấu trúc endpoint khớp với định dạng /v1/chat/completions tiêu chuẩn, đảm bảo mã hiện có của bạn hoạt động mà không cần sửa đổi. Chúng tôi hỗ trợ một ID mô hình duy nhất, uncensored, xử lý tất cả các tác vụ tạo văn bản.
Endpoint Chat Completions
Tương tác cốt lõi diễn ra qua endpoint POST /v1/chat/completions. Bạn gửi một body JSON chứa ID model, mảng messages và các tham số tùy chọn. API trả về phản hồi văn bản hoặc dữ liệu có cấu trúc nếu bạn chỉ định chế độ JSON. Endpoint này là cách chính để tương tác với LLM. Nó hỗ trợ cả yêu cầu đồng bộ tiêu chuẩn và phản hồi truyền phát. Mọi yêu cầu đều tiêu thụ token từ số dư trả trước của bạn dựa trên khối lượng đầu vào và đầu ra.
Lỗi được xử lý qua các mã trạng thái HTTP tiêu chuẩn. Nếu khóa của bạn không hợp lệ, bạn nhận được 401. Nếu bạn hết tín dụng, bạn nhận được 402. Giới hạn tốc độ được áp dụng ở mức 300 yêu cầu mỗi phút và 8 kết nối đồng thời mỗi khóa. Hãy sử dụng ví dụ sau để xác minh kết nối và tính hợp lệ của khóa.
curl https://api.mistralapi.top/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Phản hồi truyền phát (SSE)
Để giảm độ trễ và cải thiện trải nghiệm người dùng, bạn hãy bật chế độ truyền phát (streaming) bằng cách đặt stream: true trong thân yêu cầu. API trả về luồng Sự kiện gửi bởi máy chủ (SSE). Mỗi phần chứa một phản hồi từng phần. Phần cuối cùng bao gồm thống kê sử dụng token đầy đủ cho yêu cầu. Điều này cho phép ứng dụng của bạn hiển thị token khi chúng được tạo ra, thay vì phải chờ đợi quá trình hoàn tất. Truyền phát (streaming) rất lý tưởng cho các giao diện trò chuyện nơi phản hồi ngay lập tức là yếu tố then chốt.
Khi sử dụng truyền phát (streaming), bạn hãy đảm bảo máy khách của mình phân tích cú pháp định dạng SSE đúng cách. Mảng choices trong mỗi phần sẽ chứa nội dung delta. Bạn phải tích lũy các delta này để xây dựng phản hồi đầy đủ. Thống kê sử dụng token chỉ khả dụng trong sự kiện cuối cùng của luồng. Hãy sử dụng phương pháp này để giữ chân người dùng trong khi mô hình xử lý các prompt phức tạp.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Python
from openai import OpenAI
client = OpenAI(base_url="https://api.mistralapi.top/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.mistralapi.top/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Hỏi đáp
Đây có phải là API Mistral chính thức không?
Không. Chúng tôi là dịch vụ độc lập mô phỏng cấu trúc endpoint API Mistral. Chúng tôi cung cấp mô hình không kiểm duyệt của riêng mình, không phải các mô hình độc quyền của Mistral. Hãy sử dụng API này nếu bạn muốn tương thích khách hàng giống nhau nhưng với chính sách nội dung và giá cả khác.
Tôi nạp tiền tín dụng như thế nào?
Việc nạp tiền chỉ thực hiện qua tiền điện tử (USDT trên TRC20 hoặc USDC trên Base). Nạp tối thiểu là $10, tối đa là $500. Bạn nhận được bonus 5% cho các lần nạp trên $50 và bonus 10% cho các lần nạp trên $100. Không chấp nhận thẻ tín dụng hoặc PayPal.
Giới hạn cửa sổ ngữ cảnh là bao nhiêu?
Mô hình hỗ trợ cửa sổ ngữ cảnh 100.000 token cho cả prompt và kết quả hoàn thành cộng lại. Lượng output tối đa mỗi yêu cầu là 32.000 token, hoặc 2.048 token nếu bạn không chỉ định tham số <code>max_tokens</code>.
Khóa của bạn chỉ cách một biểu mẫu
Tạo tài khoản, sao chép khóa, thay đổi URL cơ bản. Đó là toàn bộ thiết lập.
Thông số kỹ thuật
Toàn bộ giới hạn và tính năng thực tế của API ở một nơi — hãy kiểm tra trước khi nạp tiền.
| Mục | Giá trị |
|---|---|
| Định dạng | tương thích OpenAI: mọi SDK OpenAI đều chạy được, chỉ cần đổi base URL và khóa |
| ID mô hình | uncensored |
| Base URL | https://api.mistralapi.top/v1 |
| Endpoint | POST /v1/chat/completions · GET /v1/models |
| Xác thực | Authorization: Bearer YOUR_KEY |
| Gọi hàm | có — tools, tool_choice; phản hồi có tool_calls, kể cả khi streaming; kết quả gửi lại bằng role: tool |
| Tham số | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Streaming | có — server-sent events; phần cuối chứa lượng token đã dùng |
| Cửa sổ ngữ cảnh | 100.000 token (đầu vào + đầu ra) |
| Chế độ JSON | response_format: {"type": "json_object"} |
| Đầu ra tối đa | tối đa phần còn lại của cửa sổ 100.000 token; max_tokens tùy chọn (không giới hạn riêng) |
| Kích thước yêu cầu | tối đa 8 MB |
| Yêu cầu đồng thời | tối đa 8 cùng lúc cho mỗi khóa |
| Header phản hồi | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Giới hạn tốc độ | 300 yêu cầu mỗi phút cho mỗi khóa |
| Giá | $0,25 cho 1 triệu token đầu vào · $1,00 cho 1 triệu token đầu ra |
| Thời hạn | tín dụng đã trả không hết hạn, không đăng ký định kỳ |
| Thưởng | +5% từ $50, +10% từ $100 |
| Tính phí | tín dụng trả trước theo mức dùng thực tế; lỗi và từ chối miễn phí |
| Dùng thử miễn phí | $0,50 trong 7 ngày, không cần thẻ · Khóa dùng thử: 2 yêu cầu song song, 60 yêu cầu/phút; hạn mức đầy đủ (8 và 300) sau lần nạp đầu |
| Nạp tiền | USDT (TRC20) hoặc USDC (Base), số tiền nguyên bất kỳ từ $10 đến $500 |
| Đăng nhập | Google hoặc email và mật khẩu |
| Nội dung | cho phép nội dung người lớn; từ chối nội dung tình dục liên quan đến trẻ vị thành niên |
| Khóa | mỗi tài khoản một khóa đang hoạt động; khóa mới thay thế khóa cũ |
Mã lỗi
Lỗi trả về dạng JSON với type cố định; yêu cầu lỗi hoặc bị từ chối không bị tính phí.
| Mã | Loại | Ý nghĩa |
|---|---|---|
400 | bad_request | JSON sai, tin nhắn trống, tham số sai hoặc vượt cửa sổ ngữ cảnh |
401 | missing_key · invalid_key · key_revoked | thiếu khóa, sai khóa hoặc khóa đã bị thay |
402 | no_credit | hết tín dụng — nạp tiền là dùng tiếp ngay |
403 | content_blocked | nội dung tình dục liên quan trẻ vị thành niên — từ chối, không tính phí |
404 | not_found | endpoint không tồn tại |
413 | request_too_large | nội dung lớn hơn 8 MB |
429 | rate_limited · concurrency | vượt 300/phút hoặc 8 đồng thời — chờ rồi thử lại |
503 | upstream_busy | mô hình đang bận — thử lại sau vài giây |