Gwenlake API

Una única API compatible con OpenAI para chat, embeddings, reranking y audio. Desplegamos para usted modelos open source sobre infraestructura soberana y los operamos: las GPU, el escalado, las actualizaciones. Sus aplicaciones solo ven un endpoint.

Cuatro capacidades, un solo endpoint

Un pipeline de recuperación necesita más que un modelo de chat. Todo lo que hace falta se sirve desde la misma API, con la misma clave y la misma cuota.

  • Chat y completado

    LLM open source servidos con streaming, llamada a herramientas y salida estructurada, en el formato compatible con OpenAI que sus bibliotecas ya hablan.

  • Embeddings

    Vectorice documentos y consultas con los modelos de embedding que prefiera, sobre la misma infraestructura soberana que el resto.

  • Reranking

    Reordene los pasajes recuperados según su relevancia real, el paso que convierte un pipeline RAG mediocre en uno utilizable.

  • Audio

    Transcripción de las llamadas, reuniones y grabaciones, que guardan tanto conocimiento suyo como sus documentos.

Ningún tercero por medio

La inferencia privada no es una casilla que marcamos. Es la razón de ser del servicio.

  • Modelos de pesos abiertos

    Desplegados y operados sobre infraestructura soberana.

  • Endpoints dedicados

    Aislados por organización y por proyecto.

  • Nada entrena a un modelo

    Sus prompts y documentos nunca se usan para entrenar el modelo de nadie.

  • Retención cero

    Para las cargas que no deben dejar ningún payload.

Solo modelos que hemos probado

En esta API no se ejecuta nada que no hayamos evaluado nosotros mismos. O sale de nuestra propia investigación, o es un modelo de pesos abiertos que hemos medido, desplegado y operado antes de ofrecerlo.

  • Nuestro propio trabajo

    Los algoritmos y los modelos que desarrollamos nosotros mismos, fruto de la investigación que mantenemos junto a los proyectos de clientes.

  • Pesos abiertos, medidos

    Los modelos open source y de pesos abiertos se miden sobre tareas reales antes de entrar en el catálogo, y se vuelven a medir cuando llega una versión nueva.

  • Sin cajas negras

    Nada se redirige a un modelo que no podamos inspeccionar, alojar y explicar. Si no podemos ejecutarlo nosotros mismos, no lo ofrecemos.

  • Un catálogo que puede seguir

    El catálogo es configuración, no código: añadimos, versionamos y retiramos modelos sin que sus aplicaciones cambien una línea, y le avisamos cuando alguno se mueve.

Apunte ahí su aplicación

Si su código ya habla la API de OpenAI, pasar a un endpoint soberano se reduce a una URL base y una clave. Díganos qué está ejecutando y lo dimensionamos con usted.