gpt5apikey.com/Inicio rápido para usuarios de GPT 5
Inicio rápido para usuarios de GPT 5
Comienza con la API de LLM sin censura configurando tu URL base y clave de API. Usa los endpoints estándar compatibles con OpenAI para enviar texto, transmitir respuestas o llamar a funciones con cero sobrecarga de configuración.
URL basehttps://api.gpt5apikey.com/v1
Autenticación: uso de tu clave de API
Para comenzar, necesitas una clave de API desde el panel de tu cuenta. El gpt 5 api usa autenticación con token Bearer estándar. Incluye tu clave en el encabezado Authorization como Bearer YOUR_API_KEY. Esta clave otorga acceso al único modelo sin censura a través de la URL base https://api.gpt5apikey.com/v1. Si pierdes tu clave, puedes regenerarla en cualquier momento, lo que invalida inmediatamente la anterior. No es necesario vincular una tarjeta de crédito para el crédito de prueba inicial, que proporciona $0.50 válidos por 7 días.
Endpoint: POST /v1/chat/completions
Envía tu prompt al endpoint de finalizaciones de chat. La API acepta cargas útiles JSON estándar de OpenAI. Asegúrate de establecer el campo model en uncensored. El sistema espera un array de messages que contenga el historial de tu conversación. Este endpoint admite tanto peticiones sincrónicas como asíncronas, facilitando la integración en flujos de trabajo existentes sin cambiar tu biblioteca cliente.
curl https://api.gpt5apikey.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
La respuesta devuelve un objeto JSON que contiene el texto generado, estadísticas de uso de tokens y razones de finalización. Esta estructura refleja el formato de respuesta estándar de OpenAI, permitiéndote usar cualquier SDK o cliente HTTP compatible sin lógica de análisis personalizada.
Integración con SDK de Python
Usar el SDK oficial de Python es sencillo. Establece el base_url a nuestro endpoint y proporciona tu clave de API. La biblioteca maneja la serialización y el manejo de errores automáticamente. Puedes pasar todo el historial de tu conversación como una lista de diccionarios de mensajes. La API procesa la entrada y devuelve el completado del modelo.
from openai import OpenAI
client = OpenAI(base_url="https://api.gpt5apikey.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Este enfoque funciona de manera idéntica para prompts simples y conversaciones de múltiples turnos. El SDK gestiona eficientemente el grupo de conexiones HTTP, asegurando latencia mínima para peticiones posteriores. También puedes pasar parámetros adicionales como temperature o max_tokens para controlar el comportamiento de la salida.
Integración con SDK de Node.js
Para desarrolladores de JavaScript, el SDK de Node.js sigue el mismo patrón. Inicializa el cliente con tu URL base y clave. La API admite definiciones de herramientas estándar, permitiéndote definir funciones que el modelo puede llamar. Esto es útil para generar datos estructurados o desencadenar acciones externas basadas en la entrada del usuario.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.gpt5apikey.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
El entorno de Node.js maneja operaciones asíncronas de forma natural. Puedes encadenar peticiones o ejecutarlas en paralelo según las necesidades de tu aplicación. El SDK proporciona definiciones de tipos si usas TypeScript, asegurando una mejor experiencia para el desarrollador durante el desarrollo.
Soporte para respuestas en streaming
Habilita el streaming estableciendo stream: true en tu petición. La API devuelve un flujo de Server-Sent Events (SSE). Cada fragmento contiene una respuesta parcial, lo que te permite mostrar texto al usuario a medida que se genera. Esto mejora la latencia percibida, especialmente para respuestas largas. La respuesta en streaming incluye datos de uso de tokens en el último fragmento.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Maneja el flujo leyendo fragmentos hasta que finalice la respuesta. El manejo de errores es crucial; si la conexión se cae, es posible que debas reintentar o manejar la salida parcial. El formato de streaming es compatible con la mayoría de clientes HTTP y SDKs modernos que admiten SSE.
Límites de peticiones, errores y contexto
Cada clave de API está limitada a 300 peticiones por minuto. Si excedes este límite, recibirás un código de estado 429. El cuerpo de la petición no debe exceder 8 MB. Los errores de autenticación devuelven un código de estado 401 si la clave no es válida o ha caducado. Si tu crédito prepago se agota, recibirás un código de estado 402. El modelo admite una ventana de contexto de 100.000 tokens, incluyendo tanto la entrada como la salida. Planifica el tamaño de tu prompt en consecuencia para evitar truncamientos. El modelo no rechaza temas adultos lícitos o controversiales, proporcionando una experiencia sin censura real.
Especificaciones técnicas
Todos los límites y funciones reales de la API en un solo lugar: revísalos antes de recargar.
| Elemento | Valor |
|---|---|
| Formato | compatible con OpenAI: cualquier SDK de OpenAI funciona cambiando la base URL y la clave |
| ID del modelo | uncensored |
| Autenticación | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.gpt5apikey.com/v1 |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Modo JSON | response_format: {"type": "json_object"} |
| Streaming | sí: server-sent events; el último fragmento incluye el uso de tokens |
| Llamadas a funciones | sí: tools, tool_choice; la respuesta trae tool_calls, también en streaming; resultados como role: tool |
| Ventana de contexto | 100.000 tokens (entrada + salida) |
| Parámetros | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Salida máxima | hasta el resto de la ventana de 100.000 tokens; max_tokens opcional (sin límite aparte) |
| Tamaño de petición | hasta 8 MB |
| Concurrencia | 8 peticiones a la vez por clave |
| Cabeceras | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Límite de peticiones | 300 por minuto por clave |
| Recarga | USDT (TRC20) o USDC (Base), cualquier importe entero de $10 a $500 |
| Precio | $0,25 por 1M tokens de entrada · $1,00 por 1M de salida |
| Caducidad | el crédito pagado no caduca, sin suscripción |
| Prueba gratis | $0,50 durante 7 días, sin tarjeta · Clave de prueba: 2 solicitudes paralelas, 60 por minuto; límites completos (8 y 300) tras la primera recarga |
| Bono | +5 % desde $50, +10 % desde $100 |
| Facturación | crédito prepago por uso real; errores y rechazos no se cobran |
| Contenido | contenido adulto permitido; se rechaza el contenido sexual con menores |
| Acceso | Google o correo y contraseña |
| Claves | una clave activa por cuenta; una nueva reemplaza a la anterior |
Códigos de error
Los errores llegan como JSON con un type fijo; las peticiones fallidas o rechazadas no se cobran.
| Código | Tipo | Significado |
|---|---|---|
400 | bad_request | JSON inválido, mensajes vacíos, parámetro incorrecto o contexto demasiado largo |
401 | missing_key · invalid_key · key_revoked | falta la clave, es incorrecta o fue reemplazada |
402 | no_credit | sin crédito: recarga y sigue al instante |
403 | content_blocked | contenido sexual con menores: rechazado, no se cobra |
404 | not_found | endpoint desconocido |
413 | request_too_large | cuerpo mayor de 8 MB |
429 | rate_limited · concurrency | más de 300/min o 8 en paralelo: espera y reintenta |
503 | upstream_busy | modelo ocupado: reintenta en unos segundos |
Preguntas y respuestas
¿Cuál es el ID del modelo sin censura?
El ID del modelo es "uncensored". Debes especificarlo en tus peticiones para usar nuestro modelo de pesos abiertos ajustado.
¿La API admite llamadas a funciones?
Sí, el endpoint admite llamadas a herramientas y funciones. Puedes definir funciones en tu petición y el modelo devolverá datos estructurados para ejecutarlas.
¿Qué sucede si se agota mi crédito prepago?
Recibirás un error 402. Puedes recargar tu cuenta con un mínimo de $10 mediante criptomonedas (USDT o USDC). Los créditos no caducan.
Tu clave está a un formulario de distancia
Crea una cuenta, copia la clave, cambia la URL base. Eso es toda la configuración.