Ollama — il motore
Scarica e serve modelli aperti in locale tramite una semplice API. I modelli vivono in un volume, così sopravvivono ai riavvii. Parla con internet solo per scaricare un modello.
Secretia è composto da tre pezzi collegati tra loro: Ollama esegue i modelli, Open WebUI è la chat e un piccolo livello nginx gli dà l’identità di Escriba. Tutto gira sul tuo server.
Internet ─► secretia (nginx, public) ─► open-webui (internal) ─► ollama (internal) branding + magenta accent chat, users, OIDC local modelsOllama — il motore
Scarica e serve modelli aperti in locale tramite una semplice API. I modelli vivono in un volume, così sopravvivono ai riavvii. Parla con internet solo per scaricare un modello.
Open WebUI — il front
L’interfaccia di chat: conversazioni, utenti, selettore di modelli, input multimodale e OIDC
nativo. Punta a Ollama tramite OLLAMA_BASE_URL.
Il livello di branding
Un piccolo reverse-proxy nginx sta davanti e inietta il CSS di Secretia — la tipografia Inter e l’accento magenta — e serve il logo, senza forkare l’interfaccia di Open WebUI.
Federazione con Lockatus
L’OIDC integrato di Open WebUI è collegato a Lockatus: registra secretia (redirect URI +
matrice di accessi) e la famiglia accede una sola volta, con 2FA e ruoli per app.
L’aspetto di Escriba qui è a livello di branding, non un re-skin completo. Il nome, il logo e l’accento sono nostri; l’interfaccia sottostante è il design proprio di Open WebUI. L’accento viene iniettato come CSS dal livello nginx — robusto per i ritocchi sicuri (tipografia, link, focus, la barra superiore) e best-effort per la ricolorazione più profonda, che potrebbe richiedere una modifica quando Open WebUI cambia il proprio markup. Un re-skin completo al pixel perfetto significherebbe forkare e mantenere a mano la loro interfaccia — costoso e fragile — quindi non lo facciamo.
Scarica quello che si adatta al tuo hardware:
llama3.1:8b — un solido e leggero modello di chat generico.qwen2.5:7b — una valida alternativa.llava:7b — multimodale: legge testo e immagini.Un modello da 7–8B pesa circa 4–5 GB. Girano su CPU; una GPU è enormemente più veloce.