Gwenlake API

Un’unica API compatibile con OpenAI per chat, embedding, reranking e audio. Mettiamo in esercizio per voi modelli open source su un’infrastruttura sovrana e li gestiamo: le GPU, la scalabilità, gli aggiornamenti. Le vostre applicazioni vedono soltanto un endpoint.

Quattro capacità, un solo endpoint

Una pipeline di ricerca ha bisogno di più di un modello di chat. Tutto ciò che serve è servito dalla stessa API, con la stessa chiave e la stessa quota.

  • Chat e completamento

    LLM open source serviti con streaming, chiamata di strumenti e output strutturato, nel formato compatibile con OpenAI che le vostre librerie parlano già.

  • Embedding

    Vettorializzate documenti e query con i modelli di embedding che preferite, sulla stessa infrastruttura sovrana del resto.

  • Reranking

    Riordinate i passaggi recuperati secondo la pertinenza reale, il passaggio che trasforma una pipeline RAG mediocre in una utilizzabile.

  • Audio

    Trascrizione di chiamate, riunioni e registrazioni, che custodiscono tanta della vostra conoscenza quanto i documenti.

Nessun terzo lungo il percorso

L’inferenza privata non è un’opzione da spuntare. È la ragione per cui il servizio esiste.

  • Modelli a pesi aperti

    Distribuiti e gestiti su infrastruttura sovrana.

  • Endpoint dedicati

    Isolati per organizzazione e per progetto.

  • Nulla addestra un modello

    I vostri prompt e documenti non vengono mai usati per addestrare il modello di nessuno.

  • Retention zero

    Per i carichi che non devono lasciare alcun payload.

Solo modelli che abbiamo testato

Su questa API non gira nulla che non abbiamo valutato noi stessi. O il modello nasce dalla nostra ricerca, oppure è un modello a pesi aperti che abbiamo misurato, installato e gestito prima di metterlo a catalogo.

  • Il nostro lavoro

    Gli algoritmi e i modelli che sviluppiamo noi stessi, frutto della ricerca che portiamo avanti accanto ai progetti per i clienti.

  • Pesi aperti, misurati

    I modelli open source e a pesi aperti vengono misurati su compiti reali prima di entrare a catalogo, e misurati di nuovo a ogni nuova versione.

  • Nessuna scatola nera

    Nulla viene inoltrato a un modello che non possiamo ispezionare, ospitare e spiegare. Se non riusciamo a farlo girare noi stessi, non lo proponiamo.

  • Un catalogo leggibile

    Il catalogo è configurazione, non codice: aggiungiamo, versioniamo e ritiriamo modelli senza che le vostre applicazioni cambino una riga, e vi avvisiamo quando uno di essi si sposta.

Puntateci la vostra applicazione

Se il vostro codice parla già l’API OpenAI, passare a un endpoint sovrano si riduce a un URL di base e a una chiave. Diteci che cosa eseguite e lo dimensioniamo con voi.