Configuración avanzada: lo que la plataforma no protege
El panel del laboratorio deja elegir casi todo: tamaño y ruta de cada volumen, cuántos notebooks abrir con el presupuesto, qué borrar. La plataforma solo fija tres cosas: la clase de disco, el tope de recursos de la talla y la VRAM que ve cada proceso. Todo lo demás es decisión tuya, y algunas decisiones no avisan cuando salen mal. Esta página reúne los casos vistos en instalaciones reales. La razón de cada uno está en Cómo funciona un laboratorio por dentro: presupuesto contado sobre límites, VRAM fraccionada por memoria y unidades de Kubernetes.
1. La ruta de montaje del volumen de trabajo
Qué puedes hacer: al crear el notebook, cambiar dónde se monta el Workspace Volume (por defecto /home/jovyan).
Qué pasa: el entorno siempre abre y guarda en /home/jovyan. Si el volumen está en otra ruta, tu trabajo va al disco temporal del contenedor. Se ve normal durante días y se pierde entero en el primer reinicio (detener, mantenimiento, falla del nodo). No hay recuperación.
Qué hacer: deja la ruta por defecto. Una carpeta con tu nombre va dentro: /home/jovyan/mi-nombre. Detalle en El notebook perdió los archivos al reiniciar.
2. Gastar todo el presupuesto en un solo notebook
Qué puedes hacer: la talla es un presupuesto divisible: un notebook grande o varios pequeños, hasta el tope.
Qué pasa: cada notebook cuesta un poco más de lo que pides (unos 0.2 CPU y 0.25 GB de sobrecarga por notebook), y el laboratorio necesita reservar unos 0.4 CPU y 1.25 GB para sus propias piezas, sobre todo el explorador de archivos de Volumes. Si tu notebook se lleva todo, el explorador nunca abre (se queda en 0/1 sin mensaje) y un segundo notebook se rechaza. Si pides recursos personalizados exactamente en el máximo, el propio notebook no arranca.
Así se reparte el presupuesto de una talla M:
Qué hacer: con talla S, un notebook de 1 CPU y 4 GB; con M, hasta 4 CPU y 16 GB; con L, hasta 8 CPU y 32 GB. Con recursos personalizados, quédate al menos 0.5 CPU y 1.5 GB por debajo del Máximo que muestra el formulario.
| Talla | Notebook recomendado | Presupuesto total del laboratorio | VRAM |
|---|---|---|---|
| S | 1 CPU / 4 GB | 2 CPU / 6 GB | 2 GB |
| M | 4 CPU / 16 GB | 5 CPU / 18 GB | 12 GB |
| L | 8 CPU / 32 GB | 9 CPU / 34 GB | 24 GB |
Los valores son los de la instalación de referencia; los tuyos aparecen en los chips del laboratorio y en GET /workbenches/v1/plan.
2b. El máximo del formulario no es el máximo de un notebook
Qué puedes hacer: crear el laboratorio con Recursos personalizados escribiendo exactamente el valor que muestra Máximo (por ejemplo, Memoria 64Gi) y después un notebook con esos mismos 64 GB.
Qué pasa: el máximo del formulario es el presupuesto del laboratorio entero. Un notebook nunca puede ocuparlo completo, porque su propio contenedor lleva una sobrecarga fija (unos 0.25 GB de memoria y 0.2 CPU) que también se cobra al presupuesto. El notebook queda en 0/1 y el laboratorio muestra "El notebook pedía más de lo que permite tu talla", aunque la suma parezca exacta.
Caso visto en Ibero el 2026-08-24 con un laboratorio creado al tope de 64 GB. La solución inmediata fue bajar el notebook a 63 GB; la de fondo, que Saptiva ajuste el máximo del Cliente para que incluya la sobrecarga (Cuotas de laboratorios).
Qué hacer: si necesitas el máximo, pídelo para el laboratorio y crea el notebook 1 GB y 0.5 CPU por debajo. Si el trabajo de verdad requiere los 64 GB en un solo proceso, el administrador debe pedir a Saptiva un techo mayor.
3. La GPU que ves no es la tarjeta completa
Qué puedes hacer: pedir 1 GPU en un notebook, un entrenamiento o un experimento.
Qué pasa: la plataforma recorta la memoria de GPU a la VRAM de tu talla. nvidia-smi y torch.cuda.mem_get_info() muestran 12 GB en una talla M aunque la tarjeta tenga 96. El cómputo, en cambio, se comparte con otros laboratorios de la misma tarjeta: el rendimiento varía según quién más esté ejecutando. Un segundo proceso con GPU en el mismo laboratorio se rechaza por cuota mientras el primero la tenga.
Si creaste el laboratorio con Recursos personalizados y dejaste VRAM vacía, el laboratorio no tiene GPU: cualquier notebook o trabajo que pida una se rechaza, aunque haya tarjetas libres en el Cliente.
Qué hacer: dimensiona el modelo y el batch_size a la VRAM de la talla, no a la de la tarjeta. Para entrenar con más memoria, sube de talla (crea otro laboratorio y monta el volumen de datos), no pidas 2 GPUs.
4. Clases de disco distintas de la permitida
Qué puedes hacer: elegir la clase de almacenamiento al crear un volumen (desde el formulario del notebook, desde Volumes o desde un archivo aplicado a mano).
Qué pasa: cualquier clase distinta de la permitida se rechaza en silencio: el volumen nunca se crea y el notebook se queda en 0/1. Solo la tarjeta del laboratorio en Studio muestra el motivo.
Qué hacer: no toques la clase. El tamaño sí es tuyo.
5. Borrar
- Eliminar un laboratorio destruye sus volúmenes en el acto. No hay papelera, retención ni copia previa.
- Eliminar un notebook ofrece borrar también su volumen. Desmárcalo si quieres conservar los datos.
- Un volumen en uso por un notebook no se puede borrar; detén o elimina el notebook primero.
6. Archivos subidos por el explorador de Volumes
Los archivos subidos con el explorador (icono de lupa) antes del 20 de agosto de 2026 quedaron con un dueño distinto al del notebook: se pueden leer pero no borrar ni renombrar desde él. Muévelos con el mismo explorador o trabaja con una copia. Los subidos después no tienen este problema.
7. Paquetes y estado
pip install fuera de /home/jovyan, variables, kernels y procesos en segundo plano se pierden al reiniciar. Instala en el volumen (pip install --user con HOME=/home/jovyan o un entorno virtual dentro del volumen) y mantén un requirements.txt ahí. Un entrenamiento largo va como trabajo del laboratorio, no como celda (Entrenamiento).
8. Compartir se hace desde Studio
El panel del laboratorio no ofrece Manage Contributors: el acceso lo administra Studio (Compartir un laboratorio). Lo que sí es compartido con todo el Cliente son los pipelines subidos en la pestaña Shared y los nombres, parámetros y métricas de cualquier pipeline (Pipelines).
Los números de la interfaz y lo que miden
Cuatro pantallas muestran recursos de laboratorio y no miden lo mismo. Leerlas como si fueran intercambiables es el origen de la mayoría de los reportes "la interfaz dice X pero no puedo usar X".
| Dónde | Qué mide | Trampa habitual |
|---|---|---|
| Máximo del formulario Nuevo laboratorio | Techo del presupuesto por recurso, definido por Saptiva para el Cliente. | No es el máximo de un notebook (caso 2b). |
| Chips del laboratorio en Studio | Uso comprometido / tope, sumando notebooks, trabajos y piezas del laboratorio. | La VRAM aparece completa (24576 / 24576) en cuanto un notebook con GPU arranca, aunque no ejecute nada: es reserva, no uso. En 2.49 la memoria en uso sale sin normalizar. |
| Panel de infraestructura (administradores) | Reservada vs. en uso vs. disponible en las GPUs del Cliente. | Un laboratorio encendido reserva la VRAM de su talla aunque su GPU esté ociosa; solo eliminarlo o bajarlo de talla la devuelve. |
| Formulario New notebook | Lo que pide ese notebook. | Se cobra con sobrecarga (caso 2). Sin VRAM en el laboratorio, cualquier GPU pedida se rechaza (caso 3). |
nvidia-smi en el notebook | VRAM que ve el proceso, recortada a la talla. | Muestra 12 GB en una talla M aunque la tarjeta tenga 96 (caso 3). |
| Almacenamiento en los chips | Volúmenes de la clase permitida. | Un volumen en otra clase no cuenta y además no se crea (caso 4). |