Ollama——引擎
在本地通过一套简单的 API 拉取并提供开放模型。模型存放于一个卷中,因此能在重启后留存。 它只在下载模型时才与互联网通信。
Secretia 是三个部件连缀而成:Ollama 运行模型、Open WebUI 是聊天界面、一个小巧的 nginx 层赋予它 Escriba 的身份标识。一切都运行在你自己的服务器上。
Internet ─► secretia (nginx, public) ─► open-webui (internal) ─► ollama (internal) branding + magenta accent chat, users, OIDC local modelsOllama——引擎
在本地通过一套简单的 API 拉取并提供开放模型。模型存放于一个卷中,因此能在重启后留存。 它只在下载模型时才与互联网通信。
Open WebUI——前端
聊天界面:对话、用户、模型选择器、多模态输入以及原生 OIDC。它通过
OLLAMA_BASE_URL 指向 Ollama。
品牌层
一个微型的 nginx 反向代理坐镇前端,注入 Secretia 的 CSS——Inter 字体排印与品红强调色—— 并提供标识,而无需 fork Open WebUI 的界面。
Lockatus 联合
Open WebUI 内置的 OIDC 与 Lockatus 连通:注册 secretia(重定向 URI + 访问
矩阵),家族便能一次登录,带有双因素认证与按应用分配的角色。
这里的 Escriba 外观是品牌层面的,而非彻底的换肤。名称、标识和强调色是我们的; 其下的界面则是 Open WebUI 自己的设计。强调色由 nginx 层以 CSS 形式注入——对于稳妥的 改动(字体排印、链接、焦点、顶栏)非常牢靠,而对于更深层的重新着色则是尽力而为, 当 Open WebUI 变更其标记结构时可能需要微调。一次彻底的像素级换肤将意味着 fork 并手工 维护它们的界面——既昂贵又脆弱——所以我们不这么做。
拉取任何适合你硬件的模型:
llama3.1:8b —— 一个扎实、轻量的通用聊天模型。qwen2.5:7b —— 一个强劲的替代选择。llava:7b —— 多模态:可读取文本和图像。一个 7–8B 模型重约 4–5 GB。它们能在 CPU 上运行;有 GPU 则快得多。