API MiniMax: primeira requisição em cinco minutos
Faça sua primeira geração de texto sem censura funcionar em minutos. Este guia cobre a URL base, autenticação e configuração de SDK para nossa API compatível com OpenAI.
https://api.minimaxapikey.com/v1uncensored
Instale o SDK da OpenAI
Comece instalando o SDK oficial da OpenAI para sua linguagem preferida. A biblioteca cuida automaticamente do formato das requisições e do streaming. Certifique-se de ter Python 3.8+ ou Node.js 18+ instalados. Execute pip install openai para Python ou npm install openai para Node. O SDK simplifica a interação com o endpoint /v1/chat/completions. Ele gerencia cabeçalhos, novas tentativas e análise de SSE para que você possa focar no prompt. Isso funciona porque nossa API segue o padrão de chat completions da OpenAI. Você não precisa de uma biblioteca cliente personalizada. Os métodos padrão do SDK mapeiam diretamente para nossos endpoints. Isso reduz o tempo de integração e aproveita o conhecimento existente dos desenvolvedores.
Configure sua URL base e chave
Defina sua chave de API e URL base nas variáveis de ambiente. Nossa URL base é https://api.minimaxapikey.com/v1. Isso permite que você use clientes padrão da OpenAI sem modificações. Crie uma conta para gerar sua chave. A chave é exibida imediatamente após o cadastro. Nenhum cartão é necessário para o teste. Armazene a chave com segurança. Passe-a como cabeçalho ou variável de ambiente. O SDK usa OPENAI_API_KEY por padrão. Você pode substituir a URL base para apontar para nossos servidores. Isso garante que todas as requisições vão para o modelo sem censura. Verifique se sua chave funciona com um ping simples. Esta etapa evita erros de autenticação mais tarde.
Envie uma conclusão de chat básica
Faça sua primeira requisição para gerar texto. Use o método POST em /v1/chat/completions. Especifique o modelo como uncensored. Passe um array de mensagens com um prompt do usuário. A API retorna um token de conclusão. Esta é a funcionalidade principal de geração de texto. Suporta janela de contexto de 100k. Você pode enviar prompts longos ou histórico de conversas. A resposta inclui o texto gerado e o uso de tokens. Isso é ideal para escrita criativa ou diálogos sem restrições. Certifique-se de que o conteúdo seja legal. O modelo não recusa tópicos adultos. Ele apenas bloqueia conteúdo sexual envolvendo menores. Comece de forma simples para verificar a conectividade.
Ative o streaming (SSE)
Para saída em tempo real, ative o streaming. Defina o parâmetro stream como true. A API retorna Server-Sent Events (SSE). Cada chunk contém parte da resposta. Isso reduz a latência percebida. Os usuários veem o texto aparecer conforme é gerado. O SDK faz a análise de chunks automaticamente. Você pode exibir o texto incrementalmente em uma interface. Isso é crucial para interfaces de chat. O streaming funciona com todas as respostas do modelo. Não afeta a contagem de tokens. Cada chunk inclui dados de uso no final. Use isso para uma melhor experiência do usuário. Parece mais responsivo do que esperar pela resposta completa. Configure seu cliente para armazenar os chunks corretamente.
Use chamada de funções/ferramentas
Suporte a saídas estruturadas com chamada de funções. Defina ferramentas no corpo da requisição. O modelo pode chamar funções com base no prompt. Isso permite integração com sistemas externos. Passe definições de ferramentas e mensagens do usuário. A resposta inclui um objeto de chamada de ferramenta. Execute a função e envie os resultados de volta. Isso funciona com SDKs padrão da OpenAI. Permite fluxos de trabalho complexos. Você pode construir agentes ou assistentes. O modelo mantém o contexto entre chamadas. Isso é poderoso para automação. Certifique-se de que suas definições de ferramentas sejam precisas. A API gerencia o roteamento das saídas das ferramentas. Mantém a conversa coerente. Use isso para geração de conteúdo dinâmico.
Verifique os modelos disponíveis
Verifique a lista de modelos via GET /v1/models. Este endpoint retorna os modelos disponíveis. Nossa API oferece um único modelo: uncensored. É um modelo de pesos abertos. Não é GPT, Claude ou Gemini. A resposta confirma o ID do modelo. Use isso para depurar configurações do cliente. Certifique-se de que seu código aponte para o modelo correto. O endpoint é rápido e confiável. Retorna dados JSON. Você pode analisar isso para exibições na interface. Confirma se sua chave de API é válida. Use isso para verificações de saúde automatizadas. Faz parte do padrão OpenAI. Nenhuma configuração extra é necessária. Isso garante compatibilidade com ferramentas existentes.
cURL
curl https://api.minimaxapikey.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Python
from openai import OpenAI
client = OpenAI(base_url="https://api.minimaxapikey.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.minimaxapikey.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Streaming
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Recursos e limites
Todos os limites e recursos reais da API em um só lugar — confira antes de recarregar.
| Item | Valor |
|---|---|
| Formato | compatível com OpenAI: qualquer SDK da OpenAI funciona trocando a base URL e a chave |
| ID do modelo | uncensored |
| Base URL | https://api.minimaxapikey.com/v1 |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Autenticação | Authorization: Bearer YOUR_KEY |
| Parâmetros | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Modo JSON | response_format: {"type": "json_object"} |
| Janela de contexto | 100.000 tokens (entrada + saída) |
| Streaming | sim — server-sent events; o último bloco traz o uso de tokens |
| Chamada de funções | sim — tools, tool_choice; resposta com tool_calls, inclusive em streaming; resultados como role: tool |
| Saída máxima | até o restante da janela de 100.000 tokens; max_tokens opcional (sem limite separado) |
| Concorrência | 8 requisições ao mesmo tempo por chave |
| Cabeçalhos | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Limite de taxa | 300 requisições por minuto por chave |
| Tamanho | até 8 MB por requisição |
| Cobrança | crédito pré-pago pelo uso real; erros e recusas são grátis |
| Validade | crédito pago não expira, sem assinatura |
| Teste grátis | $0,50 por 7 dias, sem cartão · Chave de teste: 2 requisições paralelas, 60 por minuto; limites totais (8 e 300) após a primeira recarga |
| Preço | $0,25 por 1M tokens de entrada · $1,00 por 1M de saída |
| Bônus | +5% a partir de $50, +10% a partir de $100 |
| Recarga | USDT (TRC20) ou USDC (Base), qualquer valor inteiro de $10 a $500 |
| Login | Google ou e-mail e senha |
| Chaves | uma chave ativa por conta; uma nova substitui a anterior |
| Conteúdo | conteúdo adulto permitido; conteúdo sexual com menores é recusado |
Códigos de erro
Erros chegam em JSON com um type fixo; requisições com falha ou recusadas não são cobradas.
| Código | Tipo | Significado |
|---|---|---|
400 | bad_request | JSON inválido, mensagens vazias, parâmetro errado ou contexto longo demais |
401 | missing_key · invalid_key · key_revoked | chave ausente, errada ou substituída |
402 | no_credit | sem crédito — recarregue e continue na hora |
403 | content_blocked | conteúdo sexual com menores — recusado, sem cobrança |
404 | not_found | endpoint desconhecido |
413 | request_too_large | corpo acima de 8 MB |
429 | rate_limited · concurrency | acima de 300/min ou 8 em paralelo — aguarde e tente de novo |
503 | upstream_busy | modelo ocupado — tente em alguns segundos |
Perguntas e respostas
O que acontece se eu exceder o limite de requisições?
Você receberá um erro 429. O limite é de 300 requisições por minuto por chave. Pause e tente novamente após a reinicialização da janela. Você pode regenerar sua chave para obter uma nova, se necessário.
Por que recebo um erro 401?
Sua chave de API é inválida ou está ausente. Verifique se copiou a chave corretamente. Certifique-se de que a URL base está definida para nosso endpoint. As chaves são exibidas imediatamente após o cadastro.
Como funciona a tabela de preços?
Crédito pré-pago com pagamento por uso. $0,25 por 1M de tokens de entrada, $1,00 por 1M de tokens de saída. Sem mensalidades. O crédito nunca expira. Recargas a partir de $10.
Sua chave está a um formulário de distância
Crie uma conta, copie a chave, altere a URL base. Essa é toda a configuração.