Ollama — le moteur
Récupère et sert des modèles ouverts en local via une API simple. Les modèles résident dans un volume, ils survivent donc aux redémarrages. Il ne dialogue avec internet que pour télécharger un modèle.
Secretia, ce sont trois pièces reliées entre elles : Ollama fait tourner les modèles, Open WebUI est le chat, et une petite couche nginx lui donne l’identité Escriba. Tout s’exécute sur votre propre serveur.
Internet ─► secretia (nginx, public) ─► open-webui (internal) ─► ollama (internal) branding + magenta accent chat, users, OIDC local modelsOllama — le moteur
Récupère et sert des modèles ouverts en local via une API simple. Les modèles résident dans un volume, ils survivent donc aux redémarrages. Il ne dialogue avec internet que pour télécharger un modèle.
Open WebUI — l'interface
L’interface de chat : conversations, utilisateurs, sélecteur de modèles, entrée multimodale et OIDC natif.
Elle pointe vers Ollama via OLLAMA_BASE_URL.
La couche d'identité
Un minuscule reverse-proxy nginx se place devant et injecte le CSS de Secretia — la typographie Inter et l’accent magenta — et sert le logo, sans forker l’interface d’Open WebUI.
Fédération Lockatus
L’OIDC intégré d’Open WebUI est relié à Lockatus : enregistrez secretia (URI de redirection + matrice
d’accès) et la famille se connecte une seule fois, avec la double authentification et des rôles par application.
L’apparence Escriba ici relève du niveau identité, ce n’est pas un re-skin complet. Le nom, le logo et l’accent sont les nôtres ; l’interface en dessous reste le design propre à Open WebUI. L’accent est injecté en CSS par la couche nginx — robuste pour les touches sûres (typographie, liens, focus, la barre supérieure), et au mieux pour les recolorations plus profondes, qui peuvent nécessiter un ajustement lorsqu’Open WebUI change son balisage. Un re-skin complet au pixel près impliquerait de forker et de maintenir leur interface à la main — coûteux et fragile — alors nous ne le faisons pas.
Récupérez ce qui convient à votre matériel :
llama3.1:8b — un modèle de chat généraliste solide et léger.qwen2.5:7b — une alternative robuste.llava:7b — multimodal : lit le texte et les images.Un modèle de 7–8 B pèse environ 4–5 Go. Ils tournent sur CPU ; un GPU est nettement plus rapide.