Founding Member: $499/mes de por vida
Micare
Trabajo con agentes

Estudio de Imágenes con IA (referencia y edición)

Skill que le da a tu asistente un laboratorio de imágenes con IA: genera, edita e itera imágenes usando Google Gemini (el modelo apodado "Nano Banana Pro") a través de su SDK oficial. Su especialidad es la consistencia visual —mantener el mismo personaje o producto entre escenas a partir de una imagen de referencia— y la edición iterativa sin volver a subir la imagen cada vez. Trae una anatomía de prompt de 12 elementos para resultados con acabado editorial, una matriz de decisión de costo para no gastar de más, y scripts listos para correr. Tú pones tu clave de Google; la semilla pone el método y las herramientas.

SkillPremiumTrabajo con agentesorquestacion de diseno

🌱 Empieza aquí · Estudio de Imágenes con IA

Esta semilla le da a tu asistente un estudio de imágenes: genera, edita e itera imágenes con Google Gemini. Su magia es mantener al mismo personaje o producto consistente entre escenas (a partir de una foto de referencia) y dejarte editar sin volver a subir la imagen cada vez. Tú solo pones tu clave gratuita de Google; la semilla pone el método y las herramientas.

Para instalarla

Abre esta carpeta con Claude Code o Cowork y dile a tu asistente:

"Siembra esta semilla 🌱"

Con eso basta de tu parte. Tu asistente hace todo lo técnico y, en un momento, te va a pedir una sola cosa: tu clave de API de Google (te explicamos abajo cómo sacarla en dos minutos, es gratis para empezar). Vas a ver algunas palabras en inglés en la pantalla; ni caso, él te guía.

¿Otras formas de pedírselo? "instala esta semilla", "pon a funcionar el estudio de imágenes", "haz el setup de esto". Te entiende igual.

Lo único que necesitas conseguir tú: la clave de Google (2 min)

  1. Entra a https://aistudio.google.com/apikey con tu cuenta de Google.
  2. Dale a "Create API key" y copia la clave (empieza con AIza...).
  3. Guárdala; tu asistente te va a decir dónde pegarla. Es tu clave privada: no la compartas ni la subas a ningún lado.

Para el asistente que siembra 🤖

Esto es un skill (habilidad) con scripts de Node.js, no un hook. No hay que tocar settings.json ni hacer chmod sobre los .md: los skills se descubren solos desde la carpeta de habilidades. Sí hay que instalar una dependencia de Node. Usa $HOME siempre; no inventes rutas.

1. Copia el skill a la carpeta de habilidades

El skill vive en su propia subcarpeta, con references/ y scripts/.

Claude Code / Cowork (macOS o Linux):

DEST="$HOME/.claude/skills/gemini-image-studio"
mkdir -p "$DEST/references" "$DEST/scripts"
cp kernel/SKILL.md "$DEST/SKILL.md"
cp kernel/references/*.md "$DEST/references/"
cp kernel/scripts/*.mjs kernel/scripts/package.json "$DEST/scripts/"

Windows (Git Bash / WSL): misma ruta lógica ~/.claude/skills/gemini-image-studio/. En Windows nativo, el equivalente es %USERPROFILE%\.claude\skills\gemini-image-studio\.

Cowork: si las habilidades del usuario viven en otra carpeta, copia ahí los mismos archivos, respetando las subcarpetas references/ y scripts/.

2. Instala la dependencia de Node (el SDK de Google)

Los scripts usan el SDK oficial @google/genai. Con ESM en Windows, la instalación DEBE ser local a scripts/ (NODE_PATH global no resuelve para ESM):

cd "$HOME/.claude/skills/gemini-image-studio/scripts"
npm install

Requiere Node.js ≥ 20. Verifica con node --version.

3. Configura la clave de API

Pídele al usuario su clave de Google AI Studio (paso "2 min" de arriba) y ayúdalo a exportarla como variable de entorno GEMINI_API_KEY. Lo más portable:

export GEMINI_API_KEY="la-clave-del-usuario"

Para que persista, agrégala al perfil del shell (~/.zshrc, ~/.bashrc) o a la configuración de variables de entorno de la plataforma. Nunca la escribas dentro de un archivo del skill ni la subas a ningún repositorio.

4. Verificación post-siembra (obligatoria)

a) Los archivos quedaron en su sitio:

ls "$HOME/.claude/skills/gemini-image-studio/" \
   "$HOME/.claude/skills/gemini-image-studio/references/" \
   "$HOME/.claude/skills/gemini-image-studio/scripts/"
grep -m1 "^name:" "$HOME/.claude/skills/gemini-image-studio/SKILL.md"

Debes ver SKILL.md, las cuatro guías en references/, los scripts .mjs con su package.json en scripts/, y name: gemini-image-studio.

b) La prueba de humo (genera una imagen de verdad):

cd "$HOME/.claude/skills/gemini-image-studio/scripts"
node generate.mjs --prompt "minimal abstract test, soft pastel" --aspect "1:1" --out ./smoke.png
ls -la ./smoke.png

Debe crear smoke.png de unos 200-800 KB. Si falla con "GEMINI_API_KEY not set", la clave no quedó exportada (repite el paso 3). Si falla al importar @google/genai, faltó el npm install (repite el paso 2).

Cuando ambas partes pasen, avísale al usuario en una línea qué gana con esto.


✅ ¿Cómo sé que funcionó?

De ahora en adelante, cuando le pidas a tu asistente una imagen con un personaje o producto que debe verse igual en varias escenas, o quieras retocar una imagen sin rehacerla, va a usar este estudio. Le das una foto de referencia y te la coloca en la escena que pidas, con la misma cara. Le dices "cámbiale el fondo" y cambia solo eso. Y te va a cuidar el bolsillo: cuando un motor más barato haga el trabajo, te lo va a decir en lugar de gastar de más.

No tienes que aprender nada técnico. Solo vas a notar que tus imágenes salen consistentes, editables y con tu estilo. Eso es todo. 🌱

Inspiración y crédito

Fuentes y patrones abiertos que inspiraron esta semilla. Nos gusta reconocer de dónde vienen las buenas ideas.

  • Google Gemini (los modelos de imagen "gemini-3-pro-image" / "Nano Banana Pro" y "gemini-2.5-flash-image") y su SDK oficial de Node.js "@google/genai", ambos de Google y sujetos a sus propios términos de uso. La semilla NO incluye ninguna clave de API: el usuario usa su propia cuenta de Google AI Studio. Los scripts son una implementación propia del método sobre ese SDK público, no código de Google.
  • Se mencionan, solo como ejemplos de la categoría "modelo de texto-a-imagen más económico" dentro de la matriz de costo, servicios comerciales de terceros como Recraft y OpenAI (gpt-image), cada uno con sus propios términos. La semilla no incluye claves ni código de ninguno; solo el criterio para decidir cuándo conviene un motor u otro.
  • La "anatomía de prompt de 12 elementos" y las reglas de iluminación y óptica (distancia focal en milímetros, apertura, temperatura de color) se basan en terminología de fotografía y cinematografía de dominio público; la redacción y la organización del método son propias.

¿Quieres implementarla con acompañamiento?

Agenda una asesoría directa con JP y aterrízala en tu caso · desde $600 MXN.

Agendar una asesoría