Elegir una plantilla
Una plantilla es la receta desde la que arranca su instancia: la imagen y su etiqueta, el modo de lanzamiento, las variables de entorno, los puertos, un script de inicio opcional y las restricciones de máquina que la receta necesita. Elija una en la página de despliegue, justo después de elegir el hardware.
Plantillas del sistema y las suyas
| Curada (del sistema) | Privada | Pública | |
|---|---|---|---|
| Quién la mantiene | Superheat | Su organización | La organización propietaria |
| Quién puede verla | Todos | Solo su organización | Todos |
| Quién puede editarla | Nadie: es inmutable a través de la API | La organización propietaria | La organización propietaria |
| Distintivo en la tarjeta | Curada | Un icono de candado | Pública |
Empiece con una plantilla curada. Son las que ofrece de forma predeterminada el selector de despliegue, y la mayoría lleva una etiqueta [Automatic] —mostrada como un distintivo Automatic— que se resuelve en el lanzamiento a una etiqueta de imagen que coincide con la versión de CUDA de la máquina que eligió.
Cree la suya cuando necesite una imagen específica, sus propias variables de entorno, puertos adicionales o un script de inicio. Duplicar, en cualquier plantilla, la copia a su organización como una plantilla privada que puede editar: los valores secretos y las credenciales de registros privados no se copian entre organizaciones, así que vuelve a introducir los suyos. Consulte Crear una plantilla.
Las pestañas
La página Plantillas divide la galería en cinco pestañas.
| Pestaña | Qué lista | Orden |
|---|---|---|
| Recomendadas | Plantillas curadas de Superheat | El orden curado y luego el nombre |
| Mis plantillas | Plantillas propiedad de su organización, privadas y públicas | Editadas más recientemente primero |
| Mis recientes | Plantillas desde las que su organización ya ha desplegado | Lanzadas más recientemente primero |
| Populares | Plantillas curadas y públicas | Número de lanzamientos, de mayor a menor |
| Serverless | Nada todavía: un marcador de posición para endpoints de escalado automático y pago por solicitud | — |
Debajo de las pestañas hay un cuadro de búsqueda, que coincide con el nombre, la descripción y la imagen, y una fila de chips de faceta: SSH, Jupyter, args y VM para el modo de lanzamiento, ARM para la arquitectura, y mínimos de CUDA 11.8, 12.1 y 12.4. Los chips se activan y desactivan; hacer clic en un chip activo lo borra. La pestaña Serverless los oculta, ya que no hay nada que filtrar.
Cada tarjeta lleva el nombre de la plantilla, su referencia de imagen, un distintivo de modo de lanzamiento, distintivos derivados como CUDA 12.4, Automatic o ARM, y un número de lanzamientos. Al abrir una tarjeta se muestra la receta completa: imagen, ajustes de Jupyter, entorno, puertos, argumentos, script de inicio, restricciones de máquina y readme. Los valores de entorno marcados como secretos permanecen enmascarados a menos que su organización sea la propietaria de la plantilla.
Llevar una plantilla a la página de despliegue
El selector de la página de despliegue lista las plantillas curadas, así que una plantilla privada suya no aparecerá ahí por sí sola. Láncela desde la galería: pulse Lanzar en la tarjeta o en su diálogo de detalle, elija hardware en el mercado, y la plantilla viaja con usted. Queda fijada al principio del selector y preseleccionada, siempre que encaje con la máquina que eligió.
Cómo funciona la comprobación de compatibilidad
Una vez elegida una oferta, todas las plantillas del selector se comprueban contra esa máquina. Las incompatibles se atenúan y no se pueden pulsar; al pasar el cursor sobre una se muestra el motivo. La página preselecciona la plantilla desde la que lanzó en la galería si la pasa; si no, la primera que la pase.
Si nada del selector encaja con la máquina, aparece un panel de error junto al botón de despliegue que dice "La plantilla no se ejecutará en esta máquina", con el motivo y el consejo de elegir una plantilla compatible o una GPU distinta. El botón de despliegue permanece deshabilitado hasta que lo haga.
Las comprobaciones se ejecutan en este orden, y el primer fallo es el motivo que ve.
| Comprobación | Falla cuando | Qué se le indica |
|---|---|---|
| Disponibilidad | La plantilla está marcada como próximamente | Esta plantilla aún no está disponible para lanzarse |
| Arquitectura | La plantilla declara una arquitectura distinta de amd64/x86_64 | Necesita hardware ARM (arm64); los hosts de Superheat son x86_64 |
| Virtualización | El modo de lanzamiento es vm, o la plantilla requiere un host con capacidad de VM, y la oferta no lo es | Esta máquina no tiene capacidad de VM |
| CUDA (demasiado antigua) | El cuda_min de la plantilla es superior al CUDA máx. de la máquina | Necesita CUDA ≥ 12.4; esta máquina tiene 12.1 |
| CUDA (demasiado nueva) | El cuda_max de la plantilla es inferior al CUDA máx. de la máquina | Fija una pila CUDA más antigua (admite hasta 12.4); esta máquina tiene 12.8 |
| VRAM | La VRAM mínima de la plantilla es superior a la VRAM por tarjeta de la oferta | Necesita ≥ 48 GB de VRAM; esta máquina tiene 24 GB |
Dos detalles que conviene conocer:
- La comprobación de VRAM se hace contra la VRAM por tarjeta, no contra el total del bloque. Un bloque de 4× tarjetas de 24 GB no satisface un requisito de 48 GB.
- El tamaño de disco recomendado de una plantilla es una sugerencia, no una restricción. Aparece entre las restricciones de máquina de la plantilla como "N GB de disco sugeridos", la comprobación de compatibilidad lo ignora y el deslizante de disco de la página de despliegue no lo adopta: el deslizante empieza en su propio valor predeterminado.
La comprobación es una comodidad, no el punto donde se aplica la regla. La API aplica la misma regla para las plantillas de VM y rechaza una plantilla de VM en una máquina sin capacidad de VM con un 422, tanto si la solicitud vino de la consola como de su propio código.
Los modos de lanzamiento ssh y jupyter tienen un requisito adicional que no forma parte de esta comprobación: la imagen tiene que derivar de la imagen base de Superheat, porque una imagen estándar no trae servidor SSH ni JupyterLab que iniciar. args y vm ejecutan cualquier imagen. Consulte Modos de lanzamiento e Imagen base.
Qué significa "próximamente"
Algunas plantillas se publican antes de que exista su vía de ejecución. Llevan un distintivo Próximamente, y la comprobación de compatibilidad las rechaza en todas las máquinas, así que nunca pueden llegar a un despliegue. En la tarjeta, el botón Lanzar está deshabilitado con el tooltip "La ejecución llegará en una versión posterior."; en el diálogo de detalle el mismo botón está deshabilitado y dice Próximamente.
La pestaña Serverless es la misma idea a escala de galería: es un marcador de posición para una función que todavía se está construyendo y siempre vuelve vacía. Aún no hay nada filtrable ni lanzable en ella.
Las plantillas marcadas como próximamente siguen siendo legibles —abra una para inspeccionar su imagen, entorno y puertos— y puede duplicar una en su organización. Un duplicado conserva la marca, así que la copia tampoco se lanzará.