Gwenlake API
Una única API compatible con OpenAI para chat, embeddings, reranking y audio. Desplegamos para usted modelos open source sobre infraestructura soberana y los operamos: las GPU, el escalado, las actualizaciones. Sus aplicaciones solo ven un endpoint.
Cuatro capacidades, un solo endpoint
Un pipeline de recuperación necesita más que un modelo de chat. Todo lo que hace falta se sirve desde la misma API, con la misma clave y la misma cuota.
Chat y completado
LLM open source servidos con streaming, llamada a herramientas y salida estructurada, en el formato compatible con OpenAI que sus bibliotecas ya hablan.
Embeddings
Vectorice documentos y consultas con los modelos de embedding que prefiera, sobre la misma infraestructura soberana que el resto.
Reranking
Reordene los pasajes recuperados según su relevancia real, el paso que convierte un pipeline RAG mediocre en uno utilizable.
Audio
Transcripción de las llamadas, reuniones y grabaciones, que guardan tanto conocimiento suyo como sus documentos.
Ningún tercero por medio
La inferencia privada no es una casilla que marcamos. Es la razón de ser del servicio.
Modelos de pesos abiertos
Desplegados y operados sobre infraestructura soberana.
Endpoints dedicados
Aislados por organización y por proyecto.
Nada entrena a un modelo
Sus prompts y documentos nunca se usan para entrenar el modelo de nadie.
Retención cero
Para las cargas que no deben dejar ningún payload.
Solo modelos que hemos probado
En esta API no se ejecuta nada que no hayamos evaluado nosotros mismos. O sale de nuestra propia investigación, o es un modelo de pesos abiertos que hemos medido, desplegado y operado antes de ofrecerlo.
Nuestro propio trabajo
Los algoritmos y los modelos que desarrollamos nosotros mismos, fruto de la investigación que mantenemos junto a los proyectos de clientes.
Pesos abiertos, medidos
Los modelos open source y de pesos abiertos se miden sobre tareas reales antes de entrar en el catálogo, y se vuelven a medir cuando llega una versión nueva.
Sin cajas negras
Nada se redirige a un modelo que no podamos inspeccionar, alojar y explicar. Si no podemos ejecutarlo nosotros mismos, no lo ofrecemos.
Un catálogo que puede seguir
El catálogo es configuración, no código: añadimos, versionamos y retiramos modelos sin que sus aplicaciones cambien una línea, y le avisamos cuando alguno se mueve.
Apunte ahí su aplicación
Si su código ya habla la API de OpenAI, pasar a un endpoint soberano se reduce a una URL base y una clave. Díganos qué está ejecutando y lo dimensionamos con usted.