ES ▾
Obtener clave de API

gpt5apikey.comInicio rápido para usuarios de GPT 5

Inicio rápido para usuarios de GPT 5

Comienza con la API de LLM sin censura configurando tu URL base y clave de API. Usa los endpoints estándar compatibles con OpenAI para enviar texto, transmitir respuestas o llamar a funciones con cero sobrecarga de configuración.

URL basehttps://api.gpt5apikey.com/v1

gpt5apikey.com/docs/

Autenticación: uso de tu clave de API

Para comenzar, necesitas una clave de API desde el panel de tu cuenta. El gpt 5 api usa autenticación con token Bearer estándar. Incluye tu clave en el encabezado Authorization como Bearer YOUR_API_KEY. Esta clave otorga acceso al único modelo sin censura a través de la URL base https://api.gpt5apikey.com/v1. Si pierdes tu clave, puedes regenerarla en cualquier momento, lo que invalida inmediatamente la anterior. No es necesario vincular una tarjeta de crédito para el crédito de prueba inicial, que proporciona $0.50 válidos por 7 días.

Endpoint: POST /v1/chat/completions

Envía tu prompt al endpoint de finalizaciones de chat. La API acepta cargas útiles JSON estándar de OpenAI. Asegúrate de establecer el campo model en uncensored. El sistema espera un array de messages que contenga el historial de tu conversación. Este endpoint admite tanto peticiones sincrónicas como asíncronas, facilitando la integración en flujos de trabajo existentes sin cambiar tu biblioteca cliente.

curl https://api.gpt5apikey.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

La respuesta devuelve un objeto JSON que contiene el texto generado, estadísticas de uso de tokens y razones de finalización. Esta estructura refleja el formato de respuesta estándar de OpenAI, permitiéndote usar cualquier SDK o cliente HTTP compatible sin lógica de análisis personalizada.

Integración con SDK de Python

Usar el SDK oficial de Python es sencillo. Establece el base_url a nuestro endpoint y proporciona tu clave de API. La biblioteca maneja la serialización y el manejo de errores automáticamente. Puedes pasar todo el historial de tu conversación como una lista de diccionarios de mensajes. La API procesa la entrada y devuelve el completado del modelo.

from openai import OpenAI

client = OpenAI(base_url="https://api.gpt5apikey.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Este enfoque funciona de manera idéntica para prompts simples y conversaciones de múltiples turnos. El SDK gestiona eficientemente el grupo de conexiones HTTP, asegurando latencia mínima para peticiones posteriores. También puedes pasar parámetros adicionales como temperature o max_tokens para controlar el comportamiento de la salida.

Integración con SDK de Node.js

Para desarrolladores de JavaScript, el SDK de Node.js sigue el mismo patrón. Inicializa el cliente con tu URL base y clave. La API admite definiciones de herramientas estándar, permitiéndote definir funciones que el modelo puede llamar. Esto es útil para generar datos estructurados o desencadenar acciones externas basadas en la entrada del usuario.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.gpt5apikey.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

El entorno de Node.js maneja operaciones asíncronas de forma natural. Puedes encadenar peticiones o ejecutarlas en paralelo según las necesidades de tu aplicación. El SDK proporciona definiciones de tipos si usas TypeScript, asegurando una mejor experiencia para el desarrollador durante el desarrollo.

Soporte para respuestas en streaming

Habilita el streaming estableciendo stream: true en tu petición. La API devuelve un flujo de Server-Sent Events (SSE). Cada fragmento contiene una respuesta parcial, lo que te permite mostrar texto al usuario a medida que se genera. Esto mejora la latencia percibida, especialmente para respuestas largas. La respuesta en streaming incluye datos de uso de tokens en el último fragmento.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Maneja el flujo leyendo fragmentos hasta que finalice la respuesta. El manejo de errores es crucial; si la conexión se cae, es posible que debas reintentar o manejar la salida parcial. El formato de streaming es compatible con la mayoría de clientes HTTP y SDKs modernos que admiten SSE.

Límites de peticiones, errores y contexto

Cada clave de API está limitada a 300 peticiones por minuto. Si excedes este límite, recibirás un código de estado 429. El cuerpo de la petición no debe exceder 8 MB. Los errores de autenticación devuelven un código de estado 401 si la clave no es válida o ha caducado. Si tu crédito prepago se agota, recibirás un código de estado 402. El modelo admite una ventana de contexto de 100.000 tokens, incluyendo tanto la entrada como la salida. Planifica el tamaño de tu prompt en consecuencia para evitar truncamientos. El modelo no rechaza temas adultos lícitos o controversiales, proporcionando una experiencia sin censura real.

Especificaciones técnicas

Todos los límites y funciones reales de la API en un solo lugar: revísalos antes de recargar.

ElementoValor
Formatocompatible con OpenAI: cualquier SDK de OpenAI funciona cambiando la base URL y la clave
ID del modelouncensored
AutenticaciónAuthorization: Bearer YOUR_KEY
Base URLhttps://api.gpt5apikey.com/v1
EndpointsPOST /v1/chat/completions · GET /v1/models
Modo JSONresponse_format: {"type": "json_object"}
Streamingsí: server-sent events; el último fragmento incluye el uso de tokens
Llamadas a funcionessí: tools, tool_choice; la respuesta trae tool_calls, también en streaming; resultados como role: tool
Ventana de contexto100.000 tokens (entrada + salida)
Parámetrostemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Salida máximahasta el resto de la ventana de 100.000 tokens; max_tokens opcional (sin límite aparte)
Tamaño de peticiónhasta 8 MB
Concurrencia8 peticiones a la vez por clave
CabecerasX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Límite de peticiones300 por minuto por clave
RecargaUSDT (TRC20) o USDC (Base), cualquier importe entero de $10 a $500
Precio$0,25 por 1M tokens de entrada · $1,00 por 1M de salida
Caducidadel crédito pagado no caduca, sin suscripción
Prueba gratis$0,50 durante 7 días, sin tarjeta · Clave de prueba: 2 solicitudes paralelas, 60 por minuto; límites completos (8 y 300) tras la primera recarga
Bono+5 % desde $50, +10 % desde $100
Facturacióncrédito prepago por uso real; errores y rechazos no se cobran
Contenidocontenido adulto permitido; se rechaza el contenido sexual con menores
AccesoGoogle o correo y contraseña
Clavesuna clave activa por cuenta; una nueva reemplaza a la anterior

Códigos de error

Los errores llegan como JSON con un type fijo; las peticiones fallidas o rechazadas no se cobran.

CódigoTipoSignificado
400bad_requestJSON inválido, mensajes vacíos, parámetro incorrecto o contexto demasiado largo
401missing_key · invalid_key · key_revokedfalta la clave, es incorrecta o fue reemplazada
402no_creditsin crédito: recarga y sigue al instante
403content_blockedcontenido sexual con menores: rechazado, no se cobra
404not_foundendpoint desconocido
413request_too_largecuerpo mayor de 8 MB
429rate_limited · concurrencymás de 300/min o 8 en paralelo: espera y reintenta
503upstream_busymodelo ocupado: reintenta en unos segundos

Preguntas y respuestas

¿Cuál es el ID del modelo sin censura?

El ID del modelo es "uncensored". Debes especificarlo en tus peticiones para usar nuestro modelo de pesos abiertos ajustado.

¿La API admite llamadas a funciones?

Sí, el endpoint admite llamadas a herramientas y funciones. Puedes definir funciones en tu petición y el modelo devolverá datos estructurados para ejecutarlas.

¿Qué sucede si se agota mi crédito prepago?

Recibirás un error 402. Puedes recargar tu cuenta con un mínimo de $10 mediante criptomonedas (USDT o USDC). Los créditos no caducan.

Tu clave está a un formulario de distancia

Crea una cuenta, copia la clave, cambia la URL base. Eso es toda la configuración.

Obtener clave de API