API MiniMax: pierwsze zapytanie w pięć minut
Uruchom generowanie tekstu bez cenzury w kilka minut. Przewodnik obejmuje URL podstawowy, uwierzytelnianie i konfigurację SDK dla naszego API kompatybilnego z OpenAI.
https://api.minimaxapikey.com/v1uncensored
Zainstaluj SDK OpenAI
Zacznij od zainstalowania oficjalnego SDK OpenAI dla wybranego języka. Biblioteka automatycznie formatuje zapytania i obsługuje strumieniowanie. Upewnij się, że masz zainstalowany Python 3.8+ lub Node.js 18+. Uruchom pip install openai dla Pythona lub npm install openai dla Node. SDK upraszcza interakcję z endpointem /v1/chat/completions. Zarządza nagłówkami, ponownymi próbami i parsowaniem SSE, dzięki czemu możesz skupić się na promptcie. Działa to, ponieważ nasze API jest zgodne ze standardem chat completions OpenAI. Nie potrzebujesz własnej biblioteki klienckiej. Standardowe metody SDK mapują się bezpośrednio na nasze endpointy. Skraca to czas integracji i wykorzystuje istotną wiedzę deweloperów.
Skonfiguruj URL podstawowy i klucz
Ustaw swój klucz API i base URL w zmiennych środowiskowych. Nasz base URL to https://api.minimaxapikey.com/v1. Pozwala to na użycie standardowych klientów OpenAI bez modyfikacji. Utwórz konto, aby wygenerować klucz. Klucz jest wyświetlany natychmiast po rejestracji. Nie jest potrzebna karta. Przechowuj klucz bezpiecznie. Przekaż go jako nagłówek lub zmienną środowiskową. SDK domyślnie używa OPENAI_API_KEY. Możesz nadpisać base URL, aby wskazywał na nasze serwery. Zapewnia to, że wszystkie zapytania trafiają do modelu bez cenzury. Zweryfikuj działanie klucza prostym pingiem. Ten krok zapobiega błędom uwierzytelniania później.
Wyślij podstawowe uzupełnienie czatu
Wyślij pierwsze zapytanie, aby wygenerować tekst. Użyj metody POST na /v1/chat/completions. Określ model jako uncensored. Przekaż tablicę wiadomości z promptem użytkownika. API zwraca token uzupełnienia. To jest główna funkcja generowania tekstu. Obsługuje okno kontekstu 100k. Możesz wysyłać długie promptty lub historię rozmów. Odpowiedź zawiera wygenerowany tekst i zużycie tokenów. Jest to idealne do pisania kreatywnego lub nieograniczonej rozmowy. Upewnij się, że treść jest prawna. Model nie odrzuca tematów dla dorosłych. Blokuje tylko treści seksualne z udziałem małoletnich. Zacznij od prostego testu, aby zweryfikować połączenie.
Włącz strumieniowanie (SSE)
Aby uzyskać wynik w czasie rzeczywistym, włącz strumieniowanie. Ustaw parametr stream na true. API zwraca zdarzenia typu Server-Sent Events (SSE). Każdy fragment zawiera część odpowiedzi. Zmniejsza to postrzeganą latencję. Użytkownicy widzą tekst pojawiający się w miarę jego generowania. SDK automatycznie parsuje fragmenty. Możesz wyświetlać tekst stopniowo w interfejsie użytkownika. Jest to kluczowe dla interfejsów czatu. Strumieniowanie działa z odpowiedziami wszystkich modeli. Nie wpływa na liczenie tokenów. Każdy fragment zawiera dane użycia na końcu. Wykorzystaj to dla lepszych wrażeń użytkownika. Działa to bardziej responsywnie niż oczekiwanie na pełną odpowiedź. Skonfiguruj swojego klienta tak, aby poprawnie buforował fragmenty.
Użyj wywoływania funkcji
Wsparcie dla wyjść strukturalnych z wywoływaniem funkcji. Zdefiniuj narzędzia w ciele zapytania. Model może wywoływać funkcje na podstawie promptu. To umożliwia integrację z systemami zewnętrznymi. Przekaż definicje narzędzi i wiadomości użytkownika. Odpowiedź zawiera obiekt wywołania narzędzia. Wykonaj funkcję i przekaż wyniki z powrotem. To działa ze standardowymi SDK OpenAI. Pozwala na złożone przepływy pracy. Możesz budować agentów lub asystentów. Model utrzymuje kontekst między wywołaniami. To jest potężne do automatyzacji. Upewnij się, że definicje narzędzi są precyzyjne. API obsługuje trasowanie wyjść narzędzi. Utrzymuje spójność rozmowy. Użyj tego do generowania dynamicznej treści.
Sprawdź dostępne modele
Zweryfikuj listę modeli przez GET /v1/models. Ten endpoint zwraca dostępne modele. Nasze API obsługuje jeden model: uncensored. Jest to model o otwartych wagach. Nie jest to GPT, Claude ani Gemini. Odpowiedź potwierdza identyfikator modelu. Użyj tego do debugowania konfiguracji klienta. Upewnij się, że twój kod kieruje się do właściwego modelu. Endpoint jest szybki i niezawodny. Zwraca dane JSON. Możesz je sparsować do wyświetlania w UI. Potwierdza, że twój klucz API jest ważny. Użyj tego do zautomatyzowanych testów zdrowia. Jest częścią standardu OpenAI. Nie jest potrzebna dodatkowa konfiguracja. Zapewnia to kompatybilność z istniejącymi narzędziami.
cURL
curl https://api.minimaxapikey.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Python
from openai import OpenAI
client = OpenAI(base_url="https://api.minimaxapikey.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.minimaxapikey.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Strumieniowanie
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Specyfikacja techniczna
Wszystkie rzeczywiste limity i funkcje API w jednym miejscu — sprawdź je przed doładowaniem.
| Element | Wartość |
|---|---|
| Format API | zgodne z OpenAI: działa każdy SDK OpenAI — zmień base URL i klucz |
| ID modelu | uncensored |
| Base URL | https://api.minimaxapikey.com/v1 |
| Endpointy | POST /v1/chat/completions · GET /v1/models |
| Uwierzytelnianie | Authorization: Bearer YOUR_KEY |
| Parametry | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Tryb JSON | response_format: {"type": "json_object"} |
| Okno kontekstu | 100 000 tokenów (wejście + odpowiedź) |
| Strumieniowanie | tak — server-sent events; ostatni fragment zawiera zużycie tokenów |
| Wywoływanie funkcji | tak — tools, tool_choice; odpowiedź zawiera tool_calls, także w strumieniu; wyniki jako role: tool |
| Maks. odpowiedź | do reszty okna 100 000 tokenów; max_tokens opcjonalne (bez osobnego limitu) |
| Równoległe zapytania | do 8 jednocześnie na klucz |
| Nagłówki odpowiedzi | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Limit zapytań | 300 zapytań na minutę na klucz |
| Rozmiar zapytania | do 8 MB |
| Rozliczenie | przedpłacony kredyt według rzeczywistego zużycia; błędy i odmowy są darmowe |
| Ważność | opłacony kredyt nie wygasa, bez subskrypcji |
| Darmowy kredyt | $0,50 na 7 dni, bez karty · Klucz próbny: 2 równoległe żądania, 60 na minutę; pełne limity (8 i 300) po pierwszym doładowaniu |
| Cena | $0,25 za 1 mln tokenów wejścia · $1,00 za 1 mln tokenów wyjścia |
| Bonus | +5% od $50, +10% od $100 |
| Doładowanie | USDT (TRC20) lub USDC (Base), dowolna pełna kwota od $10 do $500 |
| Logowanie | Google albo e-mail i hasło |
| Klucze | jeden aktywny klucz na konto; nowy zastępuje stary |
| Treści | treści dla dorosłych dozwolone; treści seksualne z udziałem nieletnich są odrzucane |
Kody błędów
Błędy wracają jako JSON ze stałym type; nieudane i odrzucone zapytania są bezpłatne.
| Kod | Typ | Znaczenie |
|---|---|---|
400 | bad_request | błędny JSON, puste wiadomości, zły parametr lub za długi kontekst |
401 | missing_key · invalid_key · key_revoked | brak klucza, zły klucz lub klucz zastąpiony nowym |
402 | no_credit | brak kredytu — doładuj, działa od razu |
403 | content_blocked | treści seksualne z nieletnimi — odmowa, bez opłaty |
404 | not_found | nieznany endpoint |
413 | request_too_large | treść większa niż 8 MB |
429 | rate_limited · concurrency | ponad 300/min lub 8 równolegle — odczekaj i ponów |
503 | upstream_busy | model zajęty — ponów za kilka sekund |
Pytania i odpowiedzi
Co się stanie, jeśli przekroczę limit zapytań?
Otrzymasz błąd 429. Limit wynosi 300 zapytań na minutę na klucz. Zatrzymaj się i ponów próbę po zresetowaniu okna. Możesz wygenerować klucz ponownie, aby uzyskać nowy, jeśli zajdzie taka potrzeba.
Dlaczego otrzymuję błąd 401?
Twój klucz API jest nieprawidłowy lub brakuje go. Sprawdź, czy skopiowałeś klucz poprawnie. Upewnij się, że URL podstawowy jest ustawiony na nasz endpoint. Klucze są wyświetlane natychmiast po rejestracji.
Jak działa cennik?
Przedpłacony kredyt pay-as-you-go. $0,25 za 1M tokenów wejściowych, $1,00 za 1M tokenów wyjściowych. Bez opłat miesięcznych. Kredyt nigdy nie wygasa. Doładowania od $10.
Twój klucz jest o jeden formularz stąd
Utwórz konto, skopiuj klucz, zmień URL podstawowy. To cała konfiguracja.