Gwenlake API
Un’unica API compatibile con OpenAI per chat, embedding, reranking e audio. Mettiamo in esercizio per voi modelli open source su un’infrastruttura sovrana e li gestiamo: le GPU, la scalabilità, gli aggiornamenti. Le vostre applicazioni vedono soltanto un endpoint.
Quattro capacità, un solo endpoint
Una pipeline di ricerca ha bisogno di più di un modello di chat. Tutto ciò che serve è servito dalla stessa API, con la stessa chiave e la stessa quota.
Chat e completamento
LLM open source serviti con streaming, chiamata di strumenti e output strutturato, nel formato compatibile con OpenAI che le vostre librerie parlano già.
Embedding
Vettorializzate documenti e query con i modelli di embedding che preferite, sulla stessa infrastruttura sovrana del resto.
Reranking
Riordinate i passaggi recuperati secondo la pertinenza reale, il passaggio che trasforma una pipeline RAG mediocre in una utilizzabile.
Audio
Trascrizione di chiamate, riunioni e registrazioni, che custodiscono tanta della vostra conoscenza quanto i documenti.
Nessun terzo lungo il percorso
L’inferenza privata non è un’opzione da spuntare. È la ragione per cui il servizio esiste.
Modelli a pesi aperti
Distribuiti e gestiti su infrastruttura sovrana.
Endpoint dedicati
Isolati per organizzazione e per progetto.
Nulla addestra un modello
I vostri prompt e documenti non vengono mai usati per addestrare il modello di nessuno.
Retention zero
Per i carichi che non devono lasciare alcun payload.
Solo modelli che abbiamo testato
Su questa API non gira nulla che non abbiamo valutato noi stessi. O il modello nasce dalla nostra ricerca, oppure è un modello a pesi aperti che abbiamo misurato, installato e gestito prima di metterlo a catalogo.
Il nostro lavoro
Gli algoritmi e i modelli che sviluppiamo noi stessi, frutto della ricerca che portiamo avanti accanto ai progetti per i clienti.
Pesi aperti, misurati
I modelli open source e a pesi aperti vengono misurati su compiti reali prima di entrare a catalogo, e misurati di nuovo a ogni nuova versione.
Nessuna scatola nera
Nulla viene inoltrato a un modello che non possiamo ispezionare, ospitare e spiegare. Se non riusciamo a farlo girare noi stessi, non lo proponiamo.
Un catalogo leggibile
Il catalogo è configurazione, non codice: aggiungiamo, versioniamo e ritiriamo modelli senza che le vostre applicazioni cambino una riga, e vi avvisiamo quando uno di essi si sposta.
Puntateci la vostra applicazione
Se il vostro codice parla già l’API OpenAI, passare a un endpoint sovrano si riduce a un URL di base e a una chiave. Diteci che cosa eseguite e lo dimensioniamo con voi.