La fotografía gastronómica profesional suele ser demasiado cara para los restaurantes pequeños: una sesión con fotógrafo, estilista y luces puede costar cientos de euros, y el gasto se repite cada vez que cambia la carta. El resultado suele ser fotos oscuras hechas con el móvil, imágenes poco atractivas en delivery e Instagram abandonado.
Este caso práctico presenta “Food Menu Glow-Up”, un lienzo reutilizable de Zoviz Canvas que transforma una foto móvil en tres activos: una imagen de menú con calidad de estudio, un vídeo para stories y textos para la carta, delivery y redes. Lo probamos con The Corner Kitchen, un pub ficticio, y una foto con poca luz de una hamburguesa con patatas. Aquí verás el resultado, los prompts de cada nodo y cómo ejecutarlo.
De una foto móvil a un menú completo
Una sola foto móvil puede convertirse en una imagen gastronómica profesional, un vídeo para stories y textos listos para el menú, delivery y redes sociales. El flujo mejora la presentación del plato, mantiene una identidad coherente y reduce el tiempo y coste de crear contenido para restaurantes pequeños y locales.
Para acceder a todos los prompts y conocer los detalles del proceso, sigue leyendo el artículo.
Qué genera este lienzo a partir de una sola foto
Todo el flujo empieza con una única imagen. A la izquierda, la foto de entrada tal cual salió del móvil; a la derecha, la fotografía gastronómica generada:
Para reutilizar una fotografía de un plato en menús, delivery y redes sociales, conviene aislarlo con precisión. Sigue esta guía para quitar el fondo de una imagen
1. La foto de menú con calidad de estudio.
El mismo plato, con los mismos componentes y la misma ración, pero emplatado sobre vajilla acorde al estilo del local, con iluminación de fotografía de alimentos profesional y un fondo desenfocado de ambiente de pub. Nada se ha inventado: ni un ingrediente nuevo, ni una guarnición que no estuviera en la foto original.
2. Un vídeo para stories.
El nodo de vídeo anima la foto de estudio: un lento acercamiento cinematográfico, un suave giro alrededor del plato, vapor subiendo, salsas brillando y un pequeño movimiento natural, con sonido ambiente de cocina. Perfecto para Instagram stories, Reels o TikTok.
3. El kit de textos del menú.
Un segundo nodo LLM lee la descripción del plato y las imágenes, y escribe los textos. Esta fue la salida real de nuestra ejecución (el lienzo trabaja en inglés; con un plato descrito en español, la salida sale en español):
DISH NAME
The Corner Kitchen Glazed Crispy Burger
SHORT DESCRIPTION
(Instagram Story)Golden, flame-grilled brioche meets a gloriously crispy glazed patty, fresh lettuce, a pot of velvety garlic aioli, and a bucket of thick-cut fries. Cozy never looked this good. 🍔🔥
DELIVERY APP DESCRIPTION
A toasted brioche bun cradling a crispy, golden-glazed patty layered with fresh lettuce — finished with a drizzle of glaze and served alongside a generous bucket of thick-cut fries and a creamy garlic aioli for dipping. Your favourite corner of the pub, delivered straight to your door.
ALLERGEN CALLOUT
Contains: gluten, eggs. Ask about allergens before ordering.
Cómo está construido el flujo, nodo a nodo
Zoviz Canvas es un lienzo visual de flujos de IA: conectas notas de prompt, imágenes, nodos LLM, nodos de generación de imagen y nodos de vídeo sobre un tablero infinito, y cada nodo alimenta al siguiente. Este lienzo usa un puñado de nodos muy bien atados entre sí.
La iluminación no es el único elemento que vuelve apetecible una fotografía: la paleta también modifica la percepción del plato. Conoce el significado de los colores en branding
El nodo IMAGE contiene tu foto original. Alimenta al LLM estilista, al nodo de imagen y, a través de la foto generada, al vídeo. Esa conexión constante con la foto real es lo que mantiene el resultado honesto.
La nota DISH BRIEF es el único texto que necesitas editar. Describe el plato con sus ingredientes reales. La nuestra decía (traducida; en el lienzo está en inglés):
Prompt · dish brief
DISH BRIEF: Plato: hamburguesa crujiente glaseada en pan brioche a la parrilla con lechuga, servida con un cubo de patatas fritas gruesas y un bote de alioli. Ingredientes clave: pan brioche, carne crujiente glaseada, lechuga fresca, patatas gruesas, alioli de ajo. Cocina: gastropub. Restaurante: The Corner Kitchen. Ambiente: pub acogedor e informal. Plataforma: Instagram story y app de delivery. IMPORTANTE: la foto estilizada debe ser honesta, mismo plato, mismos componentes y ración, solo mejoran el emplatado, el fondo y la iluminación.
El LLM estilista es el cerebro del lienzo. Recibe la descripción y la foto real, y escribe un único prompt de generación de imagen para la foto de estudio. Su prompt de sistema es corto y estricto:
LLM estilista · prompt de sistema (original)
You are a food stylist and photographer. Your entire reply is always ONE single paragraph image generation prompt, nothing else. Never invent ingredients that are not in the photo.
Es decir: actúa como estilista y fotógrafo gastronómico, responde solo con un párrafo de prompt y nunca inventa ingredientes que no estén en la foto. Su prompt de tarea remata el control:
LLM estilista · prompt de tarea (original)
You receive a dish brief and a real phone photo of the dish. Write ONE image generation prompt for the styled menu hero shot: the EXACT same dish with the same components, toppings and portion as the photo, nothing added or removed, re-plated beautifully on serving ware that fits the restaurant vibe, appetizing food photography lighting (soft directional light, gentle highlights on textures), a shallow depth of field background matching the vibe (rustic wood, marble, linen), tiny authentic garnish details only if visible in the original, steam only if the dish is served hot, square 1:1 crop, professional food photography, photorealistic.
En nuestra ejecución, el estilista produjo un párrafo describiendo la hamburguesa sobre un plato de cerámica rústica con borde de cobre, el pan brioche dorado con marcas de parrilla sujeto con un palillo de bambú, las patatas en un cubo metálico plateado, el alioli en un bote de cerámica con borde azul, todo sobre madera de nogal oscuro, con luz lateral cálida, ángulo cenital de 45 grados y fondo de pub con bokeh suave.
El nodo de generación de imagen toma ese prompt más la foto original como referencia y renderiza la foto de menú. Puedes elegir el modelo (Gemini 3 Pro Image, GPT-Image-2 o Zoviz Image Generate), el formato (de 1:1 a 21:9, incluidos los verticales) y la resolución (1K, 2K o 4K).
El nodo de vídeo anima la foto generada con un prompt fijo que no hace falta tocar:
Prompt · vídeo para stories (original)
Bring this studio food photo to life for a social story. Keep the dish, plating and background exactly as the photo, nothing added or removed. Cinematic slow push in toward the dish, then a gentle drift around it, warm steam rising if the dish is hot, sauces and textures glistening as light shimmers across them, one tiny natural motion like a garnish settling or a fry shifting, shallow depth of field breathing slightly. Rich appetizing colors, premium restaurant story feel, smooth loop friendly motion. Ambient kitchen sound with a soft sizzle, no speech, no text overlays.
La clave está en la primera frase: mantener el plato, el emplatado y el fondo exactamente como en la foto, sin añadir ni quitar nada. El movimiento es de cámara y de detalles (vapor, brillos, una patata que se asienta), no del contenido.
El LLM de textos escribe el kit del menú. Su prompt de sistema le prohíbe inventar: "You are a restaurant menu copywriter. Your entire reply is always exactly the labeled sections requested, nothing else. Never invent ingredients not visible in the photo or listed in the brief." Y su tarea pide exactamente estas secciones: descripción para app de delivery de menos de 160 caracteres mencionando solo ingredientes reales visibles, descripción de 2 a 3 frases para la carta impresa o web, tres captions con tonos variados para redes y 8 hashtags que mezclan la cocina, el plato y etiquetas locales de comida.
Cómo ejecutarlo tú mismo, paso a paso
El lienzo lleva una nota de instrucciones fijada al tablero bajo el título "NO PHOTOGRAPHERS NEEDED" (no hacen falta fotógrafos), y el flujo la sigue al pie de la letra:
- Sube la foto de tu plato al nodo IMAGE. Vale una foto normal de móvil; cuanto más completa se vea la ración, mejor.
- Rellena el DISH BRIEF con los ingredientes reales: el plato, los ingredientes clave, el tipo de cocina, el nombre del restaurante, el ambiente y la plataforma de destino.
- Ejecuta el LLM estilista y después el nodo de imagen (unos 7 créditos en total) y COMPRUEBA que la foto generada sigue siendo fiel a tu plato antes de continuar.
- Ejecuta el LLM de textos (1 crédito) y el nodo de vídeo al final (unos 40 créditos).
La regla de oro de la propia nota: cada vez que cambies la foto o la descripción, vuelve a ejecutar primero el LLM estilista antes del nodo de imagen; si no, obtendrás el plato anterior otra vez. Y un consejo de formatos que también viene en la nota: para cartas y apps de delivery deja la imagen en 1:1, y para Instagram stories pon el nodo de imagen en 9:16 el vídeo seguirá ese formato automáticamente.
Una ejecución completa cuesta unos 48 créditos, de los cuales unos 40 son el vídeo. El hábito práctico: itera sobre la foto hasta quedarte satisfecho y renderiza el vídeo una sola vez al final.
Por qué la restricción de "mismo plato" lo cambia todo
El gran miedo de cualquier restaurante con la IA es razonable: que la foto venda algo que la cocina no sirve. Un generador de imágenes cualquiera, ante "hamburguesa gourmet", te devuelve una hamburguesa inventada con ingredientes que no existen en tu carta. Eso en el mejor de los casos es confuso y en el peor te cuesta reseñas negativas y devoluciones en las apps de delivery.
Este flujo ataca el problema en tres capas. El LLM estilista tiene prohibido inventar ingredientes que no estén en la foto. El nodo de imagen recibe tu foto real como referencia, no solo un texto. Y el vídeo debe mantener el plato, el emplatado y el fondo exactamente como en la foto generada. El resultado es fotografía de alimentos aspiracional pero honesta: tu plato de verdad, en su mejor día.
La misma honestidad se traslada a los textos: la descripción de la app solo puede mencionar ingredientes reales y visibles, e incluye el aviso de alérgenos.
Para quién es esto
Lo ejecutamos como ejemplo de marketing para restaurantes de tipo pub, pero la descripción del plato es genérica a propósito. Cualquier negocio de comida puede reutilizar el mismo lienzo cambiando una foto y un párrafo: cafeterías y brunch, pizzerías, dark kitchens que viven de las fotos del delivery, pastelerías, food trucks, menús del día que cambian cada semana o restaurantes que renuevan carta por temporada.
Como el lienzo es reutilizable, fotografiar toda una carta se convierte en una rutina: foto del plato, dos minutos de brief, ejecutar los nodos en orden y pasar al siguiente plato. Si buscas un caso real de IA para restaurantes que puedas copiar hoy mismo, este es de los más directos.
Preguntas frecuentes
Se puede hacer fotografía gastronómica con IA sin fotógrafo?
Sí, con matices. Este flujo no crea el plato desde cero: parte de una foto real hecha con el móvil y mejora el emplatado, el fondo y la iluminación manteniendo los mismos componentes. Necesitas una foto de partida decente, no un estudio.
Las fotos de comida generadas sirven para apps de delivery?
Sí. El formato 1:1 que genera el nodo de imagen es el estándar de las apps, y el prompt del estilista está escrito para que el plato mostrado coincida con el plato servido, que es lo que exigen las políticas de las plataformas. La responsabilidad final de que la imagen represente tu producto sigue siendo tuya.
Cuánto cuesta generar la foto, el vídeo y los textos?
Unos 48 créditos de Zoviz por plato completo: unos 7 para el prompt del estilista más la foto, 1 para los textos y unos 40 para el vídeo. Si no necesitas vídeo, la foto y los textos salen por menos de 10 créditos.
Qué formato uso para cada canal?
1:1 para la carta digital y las apps de delivery, 9:16 para Instagram stories, Reels y TikTok. Basta cambiar el formato en el nodo de imagen; el vídeo hereda el formato automáticamente.
El resultado es siempre idéntico a mi plato?
Debes comprobarlo: el propio flujo incluye ese paso. Si la foto generada añade o cambia algo, ajusta el DISH BRIEF (por ejemplo, listando los ingredientes con más precisión) y vuelve a ejecutar el LLM estilista y el nodo de imagen.