Compatible con la API de OpenAI

Inteligencia artificial servida como API

Transcripción, voz y conversación sobre infraestructura propia. Apunte cualquier SDK de OpenAI a esta dirección y funciona: los mismos endpoints, los mismos cuerpos, los mismos errores.

https://cocora.supercomputo.cl/v1
Consultando el estado de la plataforma…

Tres servicios, una sola clave

Cada nombre de modelo es estable. Por dentro se resuelve contra infraestructura propia o, si hace falta, contra un proveedor externo — sin que el cliente cambie una línea.

Transcripción

Audio a texto, con detección de idioma y formato JSON o texto plano.

POST /v1/audio/transcriptions
◆ cocora-escucha

Síntesis de voz

Texto a audio en español natural, con control de voz y velocidad.

POST /v1/audio/speech
◆ cocora-voz

IA conversacional

Chat con tools, formato de respuesta y streaming por SSE.

POST /v1/chat/completions
◆ cocora-chat

Empezar es cambiar una URL

Su clave va en la cabecera Authorization, igual que en OpenAI.

# Transcribir un audio
curl https://cocora.supercomputo.cl/v1/audio/transcriptions \
  -H "Authorization: Bearer sk-cocora-..." \
  -F "file=@reunion.mp3" \
  -F "model=cocora-escucha" \
  -F "language=es"

# Sintetizar voz
curl https://cocora.supercomputo.cl/v1/audio/speech \
  -H "Authorization: Bearer sk-cocora-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"cocora-voz","input":"Hola, esta es una prueba.","voice":"es_MX-claude-high"}' \
  --output salida.wav

Qué pasa detrás de cada llamada

El nombre del modelo que usted escribe no es el que corre por dentro. Esa distancia es la que permite mover cargas sin avisar a nadie.

1

Se valida la clave

Sólo se guarda su huella. Cada clave ve los modelos que tiene habilitados y nada más.

2

Se resuelve el modelo

cocora-escucha se traduce al motor concreto que va a atender, con su nombre real y sus parámetros.

3

Se conmuta si hace falta

Si el motor propio no responde a tiempo, la llamada pasa al siguiente de la cadena. Automático.

4

Se anota el consumo

Cliente, modelo, backend, duración y estado. Fuera del camino de la petición, para no costarle latencia.