Este manual está disponible por ahora en inglés y chino simplificado. Versión en inglés · Versión en chino simplificado
Documentación
Skye Desk manual
Everything Skye Desk does and how to use it – from shooting your photos to using the finished LoRA. Each feature shows its status; only features in the current build have steps.
01
Primeros pasos
This chapter gets Skye Desk open on your Mac and explains projects and the workspace.
Download and first open
The first public build is not out yet; join the waitlist to get one email when it is. When it is out:
- Download Skye Desk from the Download page.
- Drag Skye Desk into Applications.
- Open it. If macOS says it cannot check the app, open System Settings › Privacy & Security.
- Scroll to Security and click Open Anyway next to Skye Desk, then confirm.
- From then on Skye Desk opens normally.
Until the build is signed by Apple, macOS asks once. For Apple silicon Macs; system requirements will be confirmed with the first build; Intel Macs are not tested yet.
Workspace and projects
A workspace is a folder on your Mac that holds your projects. A project is one subject – one product, one character, one style – with its images, captions and training runs. Everything stays as ordinary files in that folder.
A first walk-through
- Create a project and give it a trigger word (a made-up word such as prodshoot).
- Drop 15–30 photos on the Dataset page.
- Write a caption for each image, starting with the trigger word.
- Export a training ZIP, or try a run in demo mode.
- Compare the samples in a blind test.
02
Preparing your images
This chapter covers the photos a LoRA learns from: shooting them, choosing them and importing them.
Shoot with your phone
Most people do not need AI pictures to start – 20 to 30 good phone photos of your subject are enough.
How many photos
| Product, Character | 15–30 |
| Ropa | 20–40 |
| Comida | 15–25 |
| Estilo | 30 or more |
| A real person (only with their consent) | 20–40 |
| Effect, Material, Interior, Packaging | 20–30 |
Vary everything except the subject
- Angles: front, three-quarter, side, back, from above, and a few close-ups.
- Backgrounds: change them 3–5 times. One background in every photo gets learnt as part of the subject.
- Light: daylight by a window, shade, a lamp – not all the same.
- Distance: wide, medium and detail shots.
Phone settings
- Main camera at 1×; not the ultra-wide lens (it bends shapes).
- Portrait mode off, filters off, beauty effects off.
- Tap to focus on the subject; wipe the lens first.
- Keep the highest resolution; HEIC is fine.
Avoid
- Other brands’ logos and any text you do not want learnt.
- Fingers over the subject; your reflection in shiny surfaces.
- Near-identical shots – ten photos from the same spot teach less than three different ones.
Tips by kind
- Producto
- Turn it a little between shots; include the logo side, the back and the base; one close-up of any engraving or label.
- Ropa
- Use a dress form or a hanger, then a few worn shots (face out of frame is fine); include cuffs, collar, buttons and the fabric up close.
- Character / figure
- Front, three-quarter, side, back; the face and any markings close up; keep the same lighting.
- Comida
- Shoot within minutes, before it changes; top-down, 45° and side; one shot cut open if the inside matters.
- Interior
- Corners and straight-on walls at eye height; daylight and lamp light; avoid people walking through.
- Estilo
- Many different subjects in the same style – the subjects should vary, the style should not.
- A real person
- Written consent first. Varied expressions, light and clothes; no other people in frame.
Get them onto your Mac
- Select the photos on your iPhone and share with AirDrop to your Mac.
- They land in Downloads.
- Drag them onto the Dataset page.
A shooting checklist inside the app, which shows what is still missing after import, is Previsto.
Use photos you already have
Pick sharp photos of the subject from different occasions; drop blurry ones, heavy filters and screenshots. 15–30 good photos beat 100 similar ones.
Use AI-generated or reference images
You can also build a dataset from pictures you generated, for example from a design sheet. Check each one for drift – a changed logo or pattern is learnt too.
Working with reference images directly, without training, is the Reference Kit: Previsto.
Importing
¿Cómo importo imágenes? Disponible ahora
- Empieza con 15 a 30 imágenes de un mismo sujeto, desde distintos ángulos.
- Haz clic en Import (importar) o arrastra imágenes, carpetas o un ZIP.
- Busca por nombre o descripción para encontrar cualquier imagen.
- Abre la vista general del Dataset (conjunto de datos) para ver huecos y desequilibrios.
- Escribe la descripción (caption), el texto que describe la imagen, en el panel de la derecha.
Supported: PNG, JPG, WebP, BMP, HEIC and TIFF images, folders, ZIP files, and same-name TXT or JSON captions. iPhone HEIC photos import as they are.
Suelta o pega en cualquier sitio En la próxima beta
Suelta en la cuadrícula, en un proyecto de la barra lateral, en la página Projects (proyectos) o en Home (inicio), o pega con ⌘V. Mantén ⌥ para mover en lugar de copiar. Los duplicados se detectan antes de copiar nada y la importación se puede deshacer.
Not in the current build yet – no steps until it is.
03
Organising your dataset
This chapter keeps the dataset tidy so the LoRA learns the right things.
Previsualiza con Space Disponible ahora
- Select an image and press Space.
- Use ← y → to move between images.
- Press Space again to close.
Descripciones faltantes señaladas Disponible ahora
- Look for the marked images in the grid.
- Choose the Missing captions filter to see only those.
- Write or import the captions.
Un dataset que funciona como Finder En la próxima beta
Pulsa Return para renombrar, ⌘⌫ para mover a la Papelera (con deshacer) y usa las mismas etiquetas de color que en Finder. Los cambios que hagas en Finder aparecen al instante.
Not in the current build yet – no steps until it is.
Renombrar en lote En la próxima beta
Elige un patrón y ve cada nombre nuevo antes de aplicarlo. Las descripciones también se renombran, y un solo deshacer restaura el lote.
Not in the current build yet – no steps until it is.
Revisión del dataset En la próxima beta
Se marcan las imágenes sin palabra activadora, demasiado pequeñas para entrenar, con proporciones raras o casi idénticas a otra, con una solución junto a cada una. Las casi duplicadas se pueden detectar por contenido con un modelo que se ejecuta en tu Mac (solo se descarga si aceptas); las imágenes nunca se suben.
Not in the current build yet – no steps until it is.
Busca en todos los proyectos desde Inicio En la próxima beta
Busca en todos los proyectos por descripción, nombre de archivo o prompt. Cada proyecto muestra su siguiente paso.
Not in the current build yet – no steps until it is.
04
Writing captions
This chapter explains what to write – and what to leave out.
Leave out what you want the LoRA to learn. Write what should stay changeable. Start every caption with your trigger word.
Consejos de descripción para cada tipo
- Personaje
- Describe: pose, vista (frontal, lateral), fondo, iluminación, sobre qué está apoyado.
Omite: el aspecto propio del personaje (forma, colores, cara, marcas), para que lo lleve la palabra activadora. - Producto
- Describe: ángulo, fondo, superficie, iluminación, objetos cercanos.
Omite: la forma del producto, la zona del logo, el estampado y los materiales. - Ropa
- Describe: cómo se presenta (maniquí, percha, flat lay), ángulo, fondo.
Omite: corte, tejido, costuras, botones, color. - Estilo
- Describe: el motivo de cada imagen (un árbol, una casa, un barco).
Omite: el estilo en sí: capas de papel, sombras suaves, blanco sobre blanco. - Efecto
- Describe: el objeto de base (una piña, una llave) y su entorno.
Omite: el efecto: cristales de escarcha, brillo, desgaste. - Material
- Describe: qué forma toma el material y cómo está iluminado.
Omite: la textura y el color del material. - Interior
- Describe: distribución de la sala, muebles, posición de la cámara, hora del día.
Omite: acabado de paredes, suelo, paleta de colores, calidad de la luz. - Comida
- Describe: plato, mesa, ángulo, si está cortado.
Omite: el plato en sí: masa, disposición de la fruta, colores. - Envase
- Describe: lo que lo rodea, superficie, ángulo, iluminación.
Omite: la forma del frasco o la caja, la zona de la etiqueta, el tapón y el color.
The trigger word
A short made-up word that calls up your subject, such as prodshoot. Spell it the same way in every caption.
Revisión de la palabra activadora En la próxima beta
Las distintas grafías de tu palabra activadora (la que invoca a tu sujeto) se detectan y corrigen en un paso.
Not in the current build yet – no steps until it is.
¿Cómo corrijo descripciones en bloque? Disponible ahora
- Abre Caption tools (herramientas de descripción) › Find and replace (buscar y reemplazar).
- Escribe las palabras que quieres buscar.
- Escribe cómo deben quedar.
- Haz clic en Preview y revisa cada fila de antes/después.
- Haz clic en Apply. Undo restaura todo el lote.
Mira el equilibrio de etiquetas Disponible ahora
- Open Dataset overview.
- Read the share of images for each tag.
- Click a tag to see those images, and fix captions that lean one way.
¿Cómo obtengo descripciones de mi propia IA? Disponible ahora
- Exporta todas las imágenes y pide a cualquier IA un .txt para cada una.
- Elige Import › Import Caption Pack y selecciona el archivo.
- Comprueba que Write to muestra el proyecto correcto.
- Revisa las filas: las MATCH se escribirán, las SKIP no.
- Haz clic en Write captions.
Panel de etiquetas para todo el dataset En la próxima beta
Mira cada etiqueta y cuántas veces se usa; luego añádela, quítala o renómbrala en muchas imágenes a la vez, con opción de deshacer.
Not in the current build yet – no steps until it is.
Revisa una a una las descripciones de IA En la próxima beta
Ve cada descripción antigua y nueva lado a lado y quédate solo con las que marques. Antes se hace una copia de seguridad.
Not in the current build yet – no steps until it is.
05
Training
This chapter turns the dataset into a LoRA – and explains what is real and what is simulated today.
In the current build, training runs in demo mode: no GPU is rented and nothing is charged.
¿Cómo exporto un ZIP de entrenamiento? Disponible ahora
- Da una descripción a cada imagen; las vacías bloquean la exportación.
- Abre el menú File.
- Elige Export Training Package o pulsa ⌘⇧E.
- Descomprime: 01.png queda junto a 01.txt.
- ¿Entrenas con kohya (otro entrenador)? Pon los archivos en una carpeta adicional con el número de repeticiones en el nombre, como espera kohya.
Modo demo
¿Cómo inicio un entrenamiento? Disponible ahora
- Define los pasos (cuántas rondas de aprendizaje).
- Elige la GPU en la nube: un ordenador potente que alquilas en línea.
- Revisa la estimación de tiempo y coste.
- Haz clic en Start training. En esta beta el entrenamiento es simulado y no cuesta nada.
Ajustes predefinidos y lista de control En la próxima beta
Elige el tipo de LoRA para obtener ajustes listos y una lista de control antes de cada ejecución. La lista da consejos, no una puntuación.
Not in the current build yet – no steps until it is.
Entrenamiento en RunPod con un clic Durante la beta
Elige lo más barato o lo más rápido; Skye Desk escoge una GPU disponible y muestra la estimación antes de alquilar nada.
Not in the current build yet – no steps until it is.
Límite de gasto y parada automática Durante la beta
Fija un límite para cada ejecución. La GPU se detiene cuando termina el entrenamiento, queda inactiva o llega al límite.
Not in the current build yet – no steps until it is.
Retoma donde se detuvo Durante la beta
Si eso pasa, el entrenamiento sigue desde el último paso guardado en una GPU nueva.
Not in the current build yet – no steps until it is.
Connecting Runpod
Real training on Runpod is Durante la beta. You will need a Runpod account with credit and an API key, pasted on the Connections page.
Simple and advanced modes
Simple mode asks for the kind, base model and budget; advanced mode shows every setting with an explanation. Previsto
Using reference images
Reference Kit: usa imágenes de referencia en vez de entrenar Previsto
Crea un conjunto de referencia a partir de una hoja de diseño, revísalo y úsalo con herramientas de imagen que admiten imágenes de referencia, o deja que Skye Desk compare ambos caminos y te sugiera uno.
Not in the current build yet – no steps until it is.
Creator mode (modo creador)
Creator mode (modo creador) Previsto
Un espacio de trabajo más sencillo en torno a un personaje y su serie, para blogueros, influencers de IA y creadores de vídeos cortos.
Not in the current build yet – no steps until it is.
06
Generating and comparing
This chapter makes new pictures with your LoRA and helps you keep the best version.
¿Cómo traigo de vuelta los resultados de ComfyUI? Disponible ahora
- Elige un número de imagen.
- Escribe su prompt y su prompt negativo.
- Copia el flujo de trabajo y ejecútalo en ComfyUI.
- Nombra cada resultado con su número de imagen y luego usa Import.
¿Cómo comparo checkpoints? Disponible ahora
- Abre la prueba a ciegas desde las muestras de un entrenamiento.
- Elige la mejor imagen de cada par A/B.
- Haz clic en Stop here and see results para ver la clasificación.
- ¿Te equivocaste? Usa Undo last vote.
Compara ejecuciones y fija la LoRA final En la próxima beta
En la página Projects (proyectos), compara dos entrenamientos lado a lado y marca uno como la LoRA final, con su modelo base a la vista.
Not in the current build yet – no steps until it is.
Workflows encontrados en tus imágenes En la próxima beta
Skye Desk lee el workflow de ComfyUI guardado en tus imágenes y las agrupa por modelo base (el modelo de IA al que se suma tu LoRA).
Not in the current build yet – no steps until it is.
Usa un prompt como borrador de descripción En la próxima beta
Inserta en la descripción el prompt guardado en la imagen y luego edítalo.
Not in the current build yet – no steps until it is.
Envía prompts a ComfyUI Durante la beta
Envía todos los números de imagen a ComfyUI a la vez, cada uno con sus prompts.
Not in the current build yet – no steps until it is.
Revisa cada resultado en busca de desvíos Previsto
Cada imagen nueva se compara con tu sujeto; las que se desvían o muestran texto o un logo sueltos se marcan para que decidas si conservarlas o descartarlas.
Not in the current build yet – no steps until it is.
Página Workflows (flujos de trabajo): suelta una imagen para encontrar su workflow Previsto
Suelta imágenes, archivos JSON o un ZIP en la página Workflows (flujos de trabajo); cada workflow se detecta, se nombra y se compara con los que ya tienes.
Not in the current build yet – no steps until it is.
07
Exporting and using your LoRA
This chapter covers where the finished LoRA lives and how to use it.
Today you train with your own tool (AI Toolkit or OneTrainer) from the training ZIP; the LoRA file (.safetensors) appears in that tool’s output folder.
- Copy the .safetensors file into ComfyUI/models/loras.
- In ComfyUI, add a Load LoRA node after the model loader.
- Choose your file and start with a strength of 0.7–1.0.
- Put the trigger word at the start of your prompt.
Base model licences differ: some do not allow commercial use of what you make. Check the licence of the base model before you sell or publish.
Compara ejecuciones y fija la LoRA final En la próxima beta
En la página Projects (proyectos), compara dos entrenamientos lado a lado y marca uno como la LoRA final, con su modelo base a la vista.
Not in the current build yet – no steps until it is.
08
Keeping your files safe
This chapter explains where your files are and how changes can be undone.
- Images and captions are ordinary files in your workspace folder; captions sit next to images as .txt files.
- Bulk changes show a preview first and can be undone as a whole.
- Back up the workspace folder like any other folder (Time Machine works).
09
Privacy and consent
This chapter covers what leaves your Mac and whose pictures you may train on.
- Your images stay on your Mac. Nothing is uploaded unless you start a cloud run.
- Train on a real person only with that person’s written consent, and never on minors.
- Do not train on other people’s copyrighted work or likeness without permission.
10
Referencia
Shortcuts, words and fixes in one place.
Atajos de teclado
- ⌘1–⌘8 abren las páginas de la barra lateral, de arriba abajo.
- ⌘K encuentra cualquier página, acción o proyecto.
- Space muestra una vista previa de la imagen seleccionada; ← y → pasan de una imagen a otra.
- ⌘, abre Settings (ajustes); ⌘⇧F abre buscar y reemplazar en las descripciones.
Glosario
- LoRA
- Un pequeño archivo complementario que enseña a un modelo de imagen de IA un sujeto, como tu personaje, producto o estilo.
- Descripción
- El texto que describe una imagen. La IA aprende de las imágenes y sus descripciones a la vez.
- Etiqueta
- Una frase corta dentro de una descripción, como “vista frontal” o “fondo de estudio blanco”.
- Palabra activadora
- Una palabra inventada, como wren, que invoca tu sujeto al crear nuevas imágenes.
- Modelo base
- El modelo de imagen de IA al que se añade tu LoRA. Una LoRA solo funciona con la familia de modelos base con la que se entrenó.
- Checkpoint
- Una copia guardada de la LoRA a mitad del entrenamiento. Comparar checkpoints muestra qué paso se ve mejor.
- GPU en la nube
- Un ordenador potente que alquilas en línea por horas para entrenar.
- ComfyUI
- Una app gratuita para crear imágenes con modelos de IA. Skye Desk prepara los prompts; ComfyUI crea las imágenes.
- AI Toolkit, OneTrainer
- Programas de entrenamiento gratuitos. Skye Desk prepara los archivos que necesitan.
Troubleshooting
- macOS says it cannot check the app
- System Settings › Privacy & Security › Open Anyway (see chapter 01).
- Export is blocked
- Every image needs a caption; use the Missing captions filter.
- Imported captions did not match
- Caption files must share the image’s file name (01.png ↔ 01.txt).
- The LoRA learnt the background
- Re-shoot with 3–5 different backgrounds, or describe the background in each caption.
Nothing found. Try another word.