Ollama o un endpoint compatible funcionando solo en la red interna y una política de usuarios definida.
Open WebUI: una interfaz de IA local para equipos y empresas
Open WebUI coloca una experiencia de chat sobre Ollama y otros proveedores. Puede funcionar autoalojado, admite usuarios, permisos y documentos, pero una instalación de producción requiere versiones fijadas, copias, TLS, control de acceso y una política de datos.
Qué necesitas antes y cómo sabrás que has terminado
Ejecuta la guía sobre un entorno de prueba. No avances a producción hasta obtener la salida verificable y documentar la reversión.
Desplegar una interfaz multiusuario con registro cerrado, TLS y una separación clara entre interfaz y permisos documentales.
Continúa con la etapa relacionada y conserva comandos, versiones, métricas y responsables.
Abrir el siguiente paso →Hardware para servir Open WebUI a un equipo
La concurrencia, la caché y el modelo determinan si basta una estación o necesitas una plataforma profesional.
NVIDIA DGX Spark
Referencia NVIDIA con 128 GB coherentes para modelos y contextos que exceden la VRAM habitual.
Compra enTienda Ietres
ASUS Ascent GX10
La misma clase de capacidad GB10 con tres escalones de almacenamiento y chasis ASUS.
Lenovo ThinkStation PGX
Plataforma GB10 de Lenovo con varias referencias; el almacenamiento es la diferencia principal verificada.
RTX PRO 6000 Blackwell
Prioriza velocidad y concurrencia cuando la carga completa cabe en la VRAM disponible.
Compra enIetres Informática
Ollama sirve modelos; Open WebUI sirve a los usuarios
En cotidiano: Ollama es el motor en la sala de máquinas; Open WebUI es la recepción con la que trabaja tu equipo — cada persona con su usuario, sus conversaciones y los documentos de empresa consultables. Para la plantilla es "nuestro ChatGPT"; que detrás haya un Spark es un detalle técnico.
Ollama expone un motor y una API. Open WebUI añade conversaciones, historial, perfiles, gestión de modelos, carga de archivos, bases de conocimiento y una interfaz web. Esta separación permite actualizar la experiencia de usuario sin cambiar el motor de inferencia.
La plataforma es agnóstica de proveedor: puede conectarse a Ollama, endpoints compatibles con OpenAI y otros servicios. Esa flexibilidad también introduce un requisito de gobierno. Un administrador debe decidir qué proveedores están autorizados, qué modelos puede usar cada grupo y qué datos pueden salir de la red.
Open WebUI se describe como plataforma autoalojada y preparada para funcionar completamente sin conexión. Para que eso sea cierto en tu despliegue, descarga antes las imágenes y modelos, desactiva conectores externos, bloquea salida no necesaria y prueba el sistema en una red aislada.
Una capa frontal, una capa de aplicación y una capa de modelos
- Capa frontal: proxy inverso, certificado, autenticación corporativa cuando corresponda, límites de solicitud y cabeceras de seguridad.
- Open WebUI: usuarios, roles, conversaciones, documentos, configuración de proveedores y volumen persistente.
- Motor: Ollama o endpoints compatibles en una red no accesible directamente por los usuarios.
- Datos: volúmenes separados para conversaciones, ficheros, índices y copias; cifrado y retención definidos.
- Observabilidad: métricas de salud y errores sin recopilar contenido completo por defecto.
Prueba rápida y patrón de producción
La documentación oficial ofrece un arranque rápido con Docker. Para producción, no dependas de una etiqueta móvil como main; fija una versión estable que hayas probado.
docker run -d --name open-webui --restart unless-stopped -p 127.0.0.1:3000:8080 --add-host=host.docker.internal:host-gateway -v open-webui:/app/backend/data ghcr.io/open-webui/open-webui:<VERSION-ESTABLE>
El enlace a 127.0.0.1 evita exponer el contenedor directamente. El proxy inverso publica el servicio con TLS y autenticación. Si Open WebUI y Ollama están en contenedores separados, utiliza una red privada y no abras Ollama al resto de la LAN.
Licencia y edición: revisa las condiciones vigentes de Open WebUI y de cualquier función empresarial antes de desplegar. No presupongas que todas las capacidades de identidad, soporte o gobierno pertenecen a la misma edición.
Roles, grupos y mínimo privilegio
Open WebUI incorpora control de acceso basado en roles. La configuración debe empezar con usuarios pendientes o sin permisos amplios y habilitar únicamente lo necesario.
Configuración y proveedores
Muy pocas cuentas, autenticación reforzada y uso separado de la cuenta diaria.
Modelos y conocimiento autorizados
Acceso por grupo, sin gestión de proveedores ni carga indiscriminada de herramientas.
Sin acceso hasta aprobación
Evita el alta abierta y revisa identidad, departamento y finalidad antes de habilitar.
Las herramientas, la búsqueda web, la ejecución de código y los conectores aumentan la superficie de riesgo. Desactívalos por defecto y evalúa cada uno. Un chat sin herramientas no tiene el mismo perfil que un agente capaz de acceder a sistemas.
Conocimiento compartido con permisos y trazabilidad
Open WebUI puede adjuntar archivos y crear bases de conocimiento para recuperación. La calidad depende de extracción, fragmentación, embeddings, filtros y permisos. Una respuesta con citas no es correcta por el mero hecho de mostrar una referencia.
- Clasifica la fuente. Separa documentación pública, interna, confidencial y datos personales.
- Aplica permisos antes de recuperar. El buscador no debe entregar fragmentos que el usuario no puede consultar.
- Conserva versión y procedencia. Cada fragmento necesita documento, revisión y ubicación.
- Exige abstención. El modelo debe indicar cuándo el material recuperado no respalda una respuesta.
- Evalúa con preguntas reales. Mide recuperación y generación por separado.
La arquitectura completa está en RAG con los datos de tu empresa.
Controles antes de abrir el servicio
- Versión de Open WebUI e imágenes fijadas
- Volumen persistente incluido en copias verificadas
- TLS, identidad y roles configurados
- Ollama no accesible directamente por usuarios
- Proveedores externos bloqueados o autorizados
- Retención y borrado de conversaciones definidos
- Límites de tamaño, contexto y concurrencia
- Procedimiento de actualización y reversión probado
- Aviso de uso y canal para ejercer derechos
El despliegue local facilita control de residencia, pero no sustituye el análisis descrito en IA local y RGPD.
Desplegar Open WebUI y conectarlo a Ollama sin publicar servicios internos
Open WebUI es una aplicación multiusuario. Aunque la primera prueba se ejecute en un único equipo, conviene separar su interfaz, su almacenamiento y el servidor de modelos. El navegador se conecta a Open WebUI; Open WebUI se conecta a Ollama por una red interna; Ollama no necesita quedar expuesto a los usuarios.
Navegador → HTTPS → Open WebUI → red interna → Ollama → GPU
↓
usuarios, chats y conocimiento
Contenedor único
Sirve para validar interfaz y conexión. Publica el puerto solo en localhost y conserva los datos en un volumen. No lo presentes como patrón final para un equipo completo.
docker run -d \ -p 127.0.0.1:3000:8080 \ -v open-webui:/app/backend/data \ --name open-webui \ ghcr.io/open-webui/open-webui:main
Proxy, identidad y copias
Coloca un proxy HTTPS delante, fija una versión, limita registros, protege secretos y realiza copias del volumen. Separa Ollama y Open WebUI mediante una red privada o reglas de firewall.
- Arranca Ollama y comprueba su API. Haz la prueba desde el host o contenedor que ejecutará Open WebUI, no solo desde tu terminal personal.
- Crea un volumen persistente. Usuarios, configuración y conversaciones no deben depender de la capa efímera del contenedor.
- Fija la URL de Ollama. En contenedores,
localhostapunta al propio contenedor; utiliza el nombre interno o la dirección permitida. - Crea la primera cuenta administrativa. Hazlo antes de abrir el servicio a otros usuarios y desactiva el alta libre si no corresponde.
- Prueba un modelo pequeño. Verifica respuesta, streaming, contexto y errores antes de añadir proveedores o herramientas.
- Publica mediante HTTPS. No expongas directamente el puerto de desarrollo a Internet.
- Documenta la versión y copia. Antes de actualizar, conserva base de datos, configuración y un procedimiento de reversión.
No utilices la etiqueta flotante de una imagen en un entorno crítico. Fija una versión probada, revisa cambios y actualiza primero una instancia de ensayo.
Primer administrador, altas, modelos y conexiones
La configuración de conexión a Ollama o a otros proveedores es de instancia y afecta a los usuarios que puedan acceder a esos modelos. No mezcles una prueba personal con claves de producción. Decide desde el principio quién administra proveedores, quién crea conocimiento y quién solo conversa.
| Decisión | Configuración recomendada | Prueba |
|---|---|---|
| Registro de usuarios | Cerrado o pendiente de aprobación | Una cuenta nueva no accede hasta ser aceptada |
| Proveedores | Solo conexiones autorizadas | No aparecen modelos cloud por error |
| Modelos | Lista aprobada por grupo | Un usuario no ve modelos de otro ámbito |
| Herramientas | Desactivadas por defecto | Solo se muestran en flujos evaluados |
| Conocimiento | Propietario y permisos por colección | Prueba cruzada entre perfiles |
| Historial | Retención y borrado definidos | El usuario conoce y puede gestionar sus chats |
Conectar Ollama cuando ambos están en Docker
Coloca los contenedores en una red interna y utiliza el nombre del servicio. Publica Open WebUI al proxy; Ollama puede quedar sin puerto público. Si Ollama está en el host, habilita solo la ruta necesaria y comprueba firewall. Cambiar OLLAMA_HOST a todas las interfaces no añade autenticación.
Confirmar que la petición sigue siendo local
Selecciona un modelo descargado localmente, desactiva conexiones no utilizadas y observa los registros de Ollama mientras respondes. Una interfaz local puede conectarse a un proveedor externo si está configurado; la ubicación de la página no demuestra la ubicación de la inferencia.
Construir roles y grupos desde el mínimo privilegio
Open WebUI distingue roles y permisos granulares. Utilízalos como una capa de aplicación, pero conserva las autorizaciones de datos también en el sistema de origen y en el proceso de recuperación. Un grupo de interfaz no debe ser la única protección de un repositorio sensible.
Configuración
Gestiona conexiones, versiones, altas y políticas. Esta cuenta no debería utilizarse para conversación diaria.
Modelo y conocimiento
Publica recursos de un ámbito concreto sin obtener control sobre toda la instancia.
Uso autorizado
Accede únicamente a modelos, herramientas y colecciones necesarias para su función.
- Enumera capacidades: chat, subir archivos, compartir, crear conocimiento, usar herramientas y administrar.
- Asigna cada capacidad a un rol o grupo, no a personas de forma improvisada.
- Prueba altas, cambios de grupo y bajas.
- Comprueba que enlaces compartidos no atraviesan permisos.
- Revisa periódicamente cuentas, sesiones y recursos públicos.
El estado «pendiente» es útil para impedir acceso hasta la aprobación. También debes definir cómo se revocan sesiones cuando una persona cambia de función o abandona la organización.
Crear una colección útil, probar recuperación y ajustar el contexto
La función de conocimiento permite adjuntar documentos y recuperar fragmentos durante el chat. Para una prueba, empieza con pocos archivos bien estructurados. Para empresa, aplica el método completo de RAG con permisos y evaluación.
- Crea una colección por finalidad. No mezcles manuales públicos, políticas internas y documentos restringidos.
- Sube una muestra limpia. Comprueba que el texto, tablas y títulos se han extraído correctamente.
- Selecciona un modelo de embeddings. Registra cuál se usa; cambiarlo puede exigir reindexar.
- Añade metadatos y propietario. Identifica versión y vigencia fuera del nombre del archivo.
- Prueba la búsqueda. Formula preguntas con respuesta, sin respuesta y con términos exactos.
- Revisa los fragmentos recuperados. Antes de juzgar al modelo, confirma que recibió la evidencia.
- Ajusta contexto. Un contexto demasiado pequeño puede recortar fragmentos; uno excesivo consume memoria y prefill.
- Exige citas y abstención. El usuario necesita comprobar de dónde procede la respuesta.
Ollama y el contexto: configura una ventana suficiente para instrucciones, historial y fragmentos. Aumentarla consume más memoria; mide la configuración efectiva y no solo el máximo de la familia.
Cuándo no utilizar el modo de documento rápido
Si existen permisos por usuario, muchas versiones, actualización continua o requisitos de auditoría, utiliza una canalización RAG administrada. El chat con archivos es adecuado para una prueba individual; no sustituye gobierno documental.
Añadir capacidades sin convertir cada conversación en una ejecución privilegiada
Open WebUI puede integrar herramientas, funciones y conexiones externas. Cada extensión amplía la superficie de ataque y el recorrido de los datos. El modelo propone utilizarla; la aplicación y el servicio remoto deben aplicar permisos.
- Finalidad concreta y propietario
- Entradas y salidas tipadas
- Dominios o recursos permitidos
- Credencial de mínimo privilegio
- Tiempo máximo, cuota y límite de pasos
- Aprobación para acciones relevantes
- Registro y procedimiento de desactivación
Los protocolos de herramientas facilitan conexión, pero no hacen segura una herramienta. Revisa el servidor, los comandos expuestos y su autenticación. No permitas una terminal general, acceso al sistema de archivos completo o peticiones arbitrarias desde una instancia multiusuario.
Proteger identidad, red, datos y ciclo de actualización
| Área | Control | Comprobación |
|---|---|---|
| Red | HTTPS, proxy, firewall y Ollama interno | Solo el proxy es accesible desde la red de usuarios |
| Identidad | Alta cerrada, roles y sesiones | Revocación inmediata y bloqueo de fuerza bruta |
| Secretos | Variables o gestor de secretos | No aparecen en HTML, logs ni copias sin cifrar |
| Datos | Volumen protegido y retención | Restauración probada y borrado aplicable |
| Modelos | Proveedores permitidos | No existe salida cloud no documentada |
| Extensiones | Lista aprobada y versiones fijadas | Sin instalación libre por usuarios |
| Actualización | Ensayo, copia y reversión | Pruebas funcionales y de permisos antes de publicar |
| Registro | Eventos proporcionales y alertas | No se almacena contenido sensible sin finalidad |
Variables de seguridad que debes decidir antes de abrir usuarios
Fija estos valores en la versión que hayas probado y confirma su valor efectivo en el panel de administración. Algunas opciones son persistentes y un valor guardado en la base puede prevalecer sobre el entorno después del primer arranque.
WEBUI_URL=https://ia.intranet.ejemplo
ENABLE_SIGNUP=False
ENABLE_PASSWORD_VALIDATION=True
WEBUI_SESSION_COOKIE_SECURE=True
WEBUI_SESSION_COOKIE_SAME_SITE=strict
JWT_EXPIRES_IN=24h
CORS_ALLOW_ORIGIN=https://ia.intranet.ejemplo- URL y CORS: declara únicamente los orígenes reales. No mantengas
*cuando la instancia tiene usuarios o herramientas. - Cookies: exige
Securesobre HTTPS. Si utilizas OAuth u OIDC, prueba el callback;SameSite=strictpuede impedirlo y puede ser necesariolax. - Sesiones: evita tokens sin caducidad. Sin un backend de revocación compartido, cerrar sesión o cambiar la contraseña puede no invalidar inmediatamente un token ya emitido; acorta su vida y evalúa Redis para producción.
- Clave de firma: conserva
WEBUI_SECRET_KEYentre reinicios y réplicas. Rotarla invalida sesiones, por lo que necesita un procedimiento. - Altas: comprueba el estado efectivo de
ENABLE_SIGNUPy prueba una cuenta nueva desde una sesión privada.
Limita cabeceras de proxy, tamaño de subida, tiempo de petición y tipos de archivo. Analiza archivos antes de procesarlos y ejecuta la aplicación con un usuario sin privilegios. Las copias deben incluir datos persistentes y configuración, no solo la imagen del contenedor.
Resolver conexión, contexto y rendimiento siguiendo una secuencia
| Síntoma | Primera comprobación | Siguiente paso |
|---|---|---|
| No aparecen modelos | URL de Ollama desde el contenedor | Red, DNS interno, firewall y permisos |
| El chat responde pero RAG ignora documentos | Fragmentos recuperados y contexto efectivo | Embeddings, top-k, segmentación y ventana |
| Primera respuesta muy lenta | Modelo cargado y tiempo de prefill | Residencia, contexto, disco y descarga a CPU |
| Varios usuarios bloquean el servicio | Cola, memoria y sesiones concurrentes | Réplicas, límites o modelo más pequeño |
| Un usuario ve un recurso incorrecto | Roles, grupos y recurso compartido | Retirar acceso, revisar registros y probar perfiles |
| Actualización rompe una función | Versión, migración y logs | Revertir volumen y aplicación según procedimiento |
Mide Open WebUI y el servidor de modelos por separado. Una interfaz rápida no reduce el tiempo de inferencia; una GPU libre no corrige una base de datos lenta. Registra latencia de aplicación, cola, carga, prefill y generación.
Dimensiona por modelo, contexto y usuarios
Prueba la carga con el número de sesiones previsto. Una GPU rápida gana cuando todo cabe; DGX Spark aporta memoria y DGX Station amplía la escala multiusuario.
Convierte el chat local en un servicio administrado
Empieza con pocos modelos, permisos mínimos y una base de conocimiento pequeña. Mide calidad y uso antes de ampliar herramientas o datos.
Diseñar el RAGMide esta carga y elige el equipo con datos
Ejecuta una prueba representativa, registra memoria y tiempo, y utiliza el recomendador para comparar una GPU rápida con una plataforma de memoria coherente.
- 01
Define la carga
Concreta tarea, familia de modelo, contexto, lote y usuarios simultáneos.
Aclarar el caso de uso → - 02
Dimensiona memoria
Compara VRAM, memoria coherente, velocidad y margen de crecimiento.
Usar el recomendador de hardware → - 03
Compra en la tienda
Abre la ficha comercial para consultar configuración, precio cerrado, disponibilidad y condiciones vigentes.
Contacto y disponibilidad →
RTX PRO 6000 · 96 GB
Prioriza una GPU profesional para inferencia, imagen, vídeo o serving cuando el modelo y el contexto caben en sus 96 GB de VRAM.
Ver ficha profesional →NVIDIA DGX Spark · 128 GB
Considera memoria unificada para desarrollo CUDA y cargas que superan la VRAM de una GPU, aceptando que capacidad no equivale siempre a más velocidad.
Ver ficha y comprar →Recomendador de hardware
Responde cinco preguntas y compara el equipo actual, una GPU NVIDIA, la RTX PRO 6000 y sistemas GB10 como DGX Spark, ASUS Ascent GX10 o Lenovo ThinkStation PGX.
Comparar opciones →aisupercomputers.es aporta guías y herramientas de decisión. La compra, el precio cerrado en la ficha y el soporte comercial desde España se gestionan en las tiendas del grupo Ietres.
- Un modelo más grande: solo en pareja — dos unidades con su cable directo (hasta 405B). El "en serie" de 3 o 4 no existe.
- Más usuarios o más trabajo: las que quieras — 4, 50, 500 — en estrella a un switch, cada una con el modelo completo y un repartidor delante.
- Para recordar: dos se funden; los demás se suman. Guía completa de clústeres →
Respuestas directas
¿Open WebUI sustituye a Ollama?
No. Ollama sirve y gestiona modelos; Open WebUI añade una interfaz, usuarios, conversaciones, documentos, permisos e integración con varios proveedores.
¿Puede funcionar sin Internet?
La plataforma está diseñada para poder operar de forma autoalojada y sin conexión, siempre que modelos, imágenes y dependencias ya estén disponibles y no se activen funciones externas.
¿Es adecuado para varios usuarios?
Admite usuarios, roles y permisos. Una implantación de empresa debe revisar además identidad, copias, retención, aislamiento de datos, registros, límites y edición o licencia aplicable.
¿Debo usar la etiqueta main en producción?
No es recomendable depender de una etiqueta móvil. Fija una versión estable probada, conserva la imagen anterior y actualiza primero en un entorno de validación.
¿Open WebUI garantiza el cumplimiento del RGPD?
No. El autoalojamiento facilita control técnico, pero la organización sigue siendo responsable de finalidad, base jurídica, minimización, seguridad, información, derechos y retención.
¿Puede conectarse a modelos cloud?
Sí. Es agnóstico de proveedor y admite Ollama, APIs compatibles y otros servicios. Para un entorno solo local hay que limitar proveedores, red y credenciales.