IA en Delivery propio: descripciones con Gemini y vídeos con Veo

IA en Delivery propio: descripciones de platos con Google Gemini, vídeos con Veo, prompt editable, asistente de la carta y registro de uso.

Actualizado el 14 min de lectura Ficha de la integración

Google Gemini y Google Veo son la inteligencia artificial del delivery propio de Connect Manager, la tienda online conectada con Ágora: Gemini escribe la descripción de un plato a partir de su foto y atiende el asistente «¿Qué te apetece?» de la carta, y Veo genera un vídeo corto del plato para enseñarlo en lugar de la foto. Este manual es para el técnico que lo pone en marcha y lo revisa: qué hace cada botón, qué hace falta, cómo se cambia el prompt de los vídeos y dónde se ve el uso y el coste en «Uso de IA».

Qué hace la integración#

  • Describe un plato con IA: desde la ficha del plato, Gemini mira la foto que ve el cliente (la propia de la tienda o la de Ágora) y escribe una frase corta, como las de una carta. Para que salga con el mismo tono y largo, se le enseñan hasta tres descripciones de la misma carta. El texto se guarda como descripción propia de la tienda.

  • Genera un vídeo del plato: Veo crea, a partir de la foto, un clip de 8 segundos a 720p, en horizontal (16:9) si la foto es apaisada o en vertical (9:16) si es vertical. Se hace en segundo plano y avisa en la campana del panel cuando está.

  • En la tienda, al abrir el plato, el vídeo sale en lugar de la foto: arranca solo, en bucle, sin sonido y con la foto de cartel mientras carga.

  • Cada tienda puede cambiar el prompt con el que se generan sus vídeos, con huecos para el nombre del plato, su descripción y el formato.

  • Asistente «¿Qué te apetece?» en la carta pública: el cliente escribe qué le apetece, para cuántos o qué no puede comer, y el asistente le propone platos de esa carta con su cantidad y un motivo corto; cada propuesta lleva su botón para añadirla a la cesta.

  • El asistente no propone lo que está agotado en el local y tiene instrucciones de no proponer platos con los alérgenos que el cliente evita según la carta, y de avisar cuando un plato no tiene alérgenos informados.

  • Registra cada petición en Configuración → Uso de IA: quién la hizo, qué función, con qué modelo, tokens o segundos de vídeo, coste estimado, estado y duración.

Qué no hace#

  • No toca Ágora: la descripción, la foto y el vídeo propios son solo de la tienda online, y una nueva importación de la carta no los pisa.

  • No trabaja sin foto: si el plato no tiene foto, los botones de describir y de generar vídeo no salen.

  • No genera vídeos de más de 8 segundos (es el tope del modelo), ni varios a la vez para el mismo plato.

  • No reintenta solo un vídeo que falla, porque cada intento cuesta: hay que volver a pulsar el botón.

  • No describe toda la carta de golpe: se hace plato a plato.

  • El asistente no mete nada en la cesta por su cuenta ni inventa platos o precios: propone, la carta valida y el precio que se cobra lo recalcula la tienda.

  • El asistente no se puede apagar en una tienda concreta: sale en todas en cuanto la plataforma tiene la clave de Gemini.

  • El coste que enseña el panel es una estimación con tarifas públicas; la factura real la emite Google.

Requisitos#

  • El delivery propio conectado con Ágora y la carta importada (ver Delivery propio: conectar la tienda online con Ágora).

  • Fotos en los platos: las de la ficha de producto de Ágora que trae la carta digital o una subida en la ficha del plato del panel.

  • La clave de la API de Gemini y los modelos configurados en el servidor de Connect Manager (lo hace FOS). El texto usa un modelo Gemini Flash y el vídeo un modelo Veo de la misma API.

  • Un usuario con el permiso Delivery: Configurar locales, que es el que abre Operación → Cartas, Tienda pública y Uso de IA.

  • Quién hace qué: FOS mantiene la clave y los modelos; el distribuidor o el propio cliente generan y revisan descripciones y vídeos; el cliente aporta las fotos y, si quiere, su prompt de vídeo.

Datos que necesitamos#

DatoQuién lo facilita / dónde se sacaEjemplo o formatoObligatorio
Fotos de los platosCliente: en la ficha de producto de Ágora o subida en la ficha del plato (Operación → Cartas)Imagen apaisada, hasta 4 MB si se sube en el panelSí, para describir o hacer vídeos
Prompt propio para los vídeosCliente (opcional)Texto de hasta 4.000 caracteres con {plato}, {descripcion} y {formato}No (vacío: el de serie)
Vídeo propio, si no se quiere generarClienteMP4, WebM o MOV, en vertical, hasta 50 MBNo
Clave de la API de GeminiFOS (variable del servidor GEMINI_API_KEY)No se pide al clienteSí
Modelo de vídeoFOS (variable DELIVERY_VIDEO_MODEL)Por defecto veo-3.1-generate-previewSí, para los vídeos
Modelo de textoFOS (variable DELIVERY_TEXT_MODEL)Por defecto gemini-2.5-flashNo (tiene valor por defecto)

Configuración paso a paso#

En la plataforma (lo hace FOS)#

  1. Configura GEMINI_API_KEY en el servidor. Sin ella no salen los botones de IA ni el asistente.

  2. Revisa DELIVERY_VIDEO_MODEL (un modelo Veo) y DELIVERY_TEXT_MODEL (un modelo Gemini Flash que lea imágenes). Se cambian sin desplegar.

En Ágora#

  1. Pon las fotos en la ficha de cada producto (la imagen que enseña la carta digital).

  2. Vuelve a traer la carta en el panel para que lleguen las fotos (Operación → Cartas → «Volver a traer»).

En Connect Manager: descripciones con IA#

  1. Ve a Operación → Cartas, elige la carta en el filtro «Carta» y pulsa el plato para abrir su ficha.

  2. En el pie de la ficha, pulsa Describir con IA y confirma con Escribir. En segundos sale el aviso «Descripción escrita» con el texto.

  3. La frase se guarda sola como Descripción propia. Para retocarla, vuelve a abrir la ficha, cámbiala y pulsa Guardar. Si vacías el campo, la tienda vuelve a enseñar la descripción de Ágora.

[!NOTE] «Describir con IA» sustituye la descripción propia que hubiera. El filtro «Con foto» de la tabla te dice qué platos se han quedado sin foto y, por tanto, sin botón.

En Connect Manager: vídeos con Veo#

  1. Opcional: en Configuración → Tienda pública → Vídeo IA escribe el Prompt de la tienda. Puedes usar {plato}, {descripcion} y {formato} («horizontal 16:9» o «vertical 9:16»). Vacío, se usa el de serie, que se enseña de ejemplo en el campo. Volver al de serie borra el texto propio; los vídeos ya generados no cambian.

  2. En Operación → Cartas, abre el plato y pulsa Generar vídeo con IA. El aviso recuerda que son unos 8 segundos, que tarda un par de minutos y que tiene coste por cada vídeo. Confirma con Generar.

  3. Mientras se genera, el botón queda desactivado («Ya hay uno en marcha»). Al terminar llega a la campana «Vídeo listo: …» o «No se ha podido generar el vídeo de …» con el motivo.

  4. El vídeo queda en el campo Vídeo del plato de la ficha. Para quitarlo o cambiarlo por uno propio, vacía o sube otro fichero y pulsa Guardar.

El asistente de la carta#

No tiene nada que configurar en la tienda: aparece como un botón flotante con el texto «¿Qué te apetece?» en la carta de cada local en cuanto la plataforma tiene la clave de Gemini. Usa la carta del local y del canal que esté viendo el cliente.

Revisar el uso#

  1. Ve a Configuración → Uso de IA con el grupo elegido en la cabecera.

  2. Las funciones de la tienda salen como «Descripción del plato (delivery)», «Vídeo del plato (delivery)» y «Asistente de la carta (delivery)».

  3. Filtra por Función, Estado o fechas (Desde y Hasta); la columna «Coste estimado» (en dólares) lleva el total al pie.

Cómo funciona#

La descripción con Gemini#

Al pulsar «Describir con IA», Connect Manager lee la foto del plato desde su propio almacén (no por URL), junta el nombre del plato y hasta tres descripciones de la misma carta y se lo manda a Gemini con instrucciones fijas: una sola frase en castellano, de entre 40 y 110 caracteres, que diga qué lleva y cómo está hecho, solo con lo que se ve en la foto o dice el nombre, sin precios, emojis ni exclamaciones. De la respuesta se queda con la primera línea, sin comillas, recortada a 140 caracteres, y la guarda como descripción propia. Va en la misma petición del panel porque tarda segundos.

sequenceDiagram
    participant U as Panel
    participant C as Connect Manager
    participant G as Gemini
    U->>C: Describir con IA
    C->>C: Foto del plato y hasta 3 descripciones de la carta
    C->>G: Instrucciones, nombre del plato y foto
    G-->>C: Una frase
    C->>C: Primera línea, sin comillas, máximo 140 caracteres
    C->>C: Guarda la descripción propia y apunta el uso
    C-->>U: Descripción escrita

El vídeo con Veo#

El botón marca el plato como «generando» y encola el trabajo. El trabajo descarga la foto, decide el formato por su orientación y la recorta al centro a 16:9 o 9:16 exactos, porque Veo no recorta: si la proporción no encaja, rellena con bandas negras. Después pide el vídeo a la API de Gemini con el prompt de la tienda (o el de serie) y pregunta cada 10 segundos cómo va, hasta 8 minutos. Cuando está, lo descarga, lo guarda y lo deja asignado al plato. Si falla, el plato queda marcado como fallido con el motivo y se avisa a quien pulsó el botón; no se reintenta solo. Cada vídeo queda apuntado en «Uso de IA» con su coste estimado, que es cero si no se llega a generar.

sequenceDiagram
    participant U as Panel
    participant Q as Cola
    participant V as API de Gemini con Veo
    participant S as Almacén de vídeos
    U->>Q: Generar vídeo con IA
    Q->>Q: Descarga la foto y la recorta al formato del vídeo
    Q->>V: Prompt, foto, 8 segundos y 720p
    V-->>Q: Operación en curso
    loop Cada 10 segundos, hasta 8 minutos
        Q->>V: Consulta la operación
    end
    V-->>Q: Vídeo generado
    Q->>S: Guarda el vídeo del plato
    Q-->>U: Campana con Vídeo listo

El asistente «¿Qué te apetece?»#

Cada pregunta viaja a Gemini con la carta del local entera en formato compacto (nombre, precio, descripción, alérgenos, etiquetas y opciones de cada plato), sin lo que esté agotado en ese local, y con los últimos mensajes de la conversación. Gemini devuelve un mensaje corto y una lista de platos con su cantidad. Antes de enseñarla, Connect Manager comprueba cada plato contra la carta: tiene que existir, la cantidad va de 1 a 10, como mucho 6 líneas, y el precio se pone desde la carta. Al pulsar «Añadir», el plato entra en la cesta por el camino normal de la carta; si tiene opciones obligatorias (el punto de la carne), se abre su ficha para que elija el cliente.

sequenceDiagram
    participant C as Cliente
    participant A as Asistente
    participant G as Gemini
    participant K as Carta y cesta
    C->>A: Algo sin gluten para dos
    A->>G: Carta del local sin agotados y conversación
    G-->>A: Mensaje y platos con cantidad
    A->>A: Valida cada plato contra la carta
    A-->>C: Propuesta con botones Añadir
    C->>K: Añadir
    K->>K: Relee el precio y mete el plato en la cesta

Límites del asistente: 15 preguntas cada 10 minutos por conexión, una pregunta de hasta 300 caracteres y una conversación de hasta 12 mensajes que vive en el navegador del cliente (no se guarda). La carta que se le pasa se renueva cada 15 minutos.

Comprobar que funciona#

  1. En Operación → Cartas, abre un plato con foto: deben salir «Describir con IA» y «Generar vídeo con IA» en el pie de la ficha.

  2. Pulsa «Describir con IA»: la frase debe aparecer en la ficha, en el listado y en la tienda.

  3. Pulsa «Generar vídeo con IA» y espera el aviso de la campana. Abre el plato en la tienda: debe verse el vídeo en lugar de la foto.

  4. En la carta pública, pulsa «¿Qué te apetece?», pide algo concreto («dos menús y una bebida sin alcohol») y añade una propuesta a la cesta.

  5. En Configuración → Uso de IA deben aparecer las tres peticiones con su estado «OK».

Errores frecuentes y solución#

SíntomaCausaSolución
No salen los botones de IA en la ficha del platoEl plato no tiene foto, o la plataforma no tiene la clave de Gemini (o el modelo de vídeo, para ese botón)Pon una foto (en Ágora o «Foto propia») o avisa a FOS
«No se ha podido escribir la descripción» con «La IA no ha devuelto ninguna descripción. Prueba otra vez o con otra foto.»Respuesta vacía de GeminiVuelve a intentarlo o cambia la foto
«El plato no tiene foto de la que partir.» (en el vídeo, «El plato ya no tiene foto de la que partir.»)La foto ya no existe en la tienda ni en ÁgoraSube una foto propia o vuelve a traer la carta
«Gemini ha descartado el vídeo por su filtro de contenido. Prueba con otra foto.»El filtro de contenido de Google rechazó el resultadoCambia la foto o suaviza el prompt de la tienda
«Gemini está tardando demasiado en generar el vídeo. Vuelve a intentarlo en un rato.»La operación pasó de 8 minutosVuelve a pulsar más tarde
«Falta la clave de Gemini (GEMINI_API_KEY) o el modelo de vídeo.»Configuración de la plataforma incompletaAvisa a FOS
«No se ha podido pedir el vídeo: …»La API de Gemini rechazó la petición (cuota, modelo no disponible, clave)Pasa el mensaje a FOS
«El vídeo se ha generado pero no se ha podido descargar.»Fallo al bajar el fichero generadoVuelve a generarlo
«Ya hay un vídeo en marcha para este plato»Se pidió otro vídeo antes de terminar el anteriorEspera al aviso de la campana
Al vídeo le falta parte del plato por los bordesLa foto se recorta al centro a 16:9 o 9:16 antes de mandarlaUsa una foto con el plato centrado
El vídeo sale con bandas negrasLa foto no se pudo recortar (formato no legible) y se mandó tal cualPrueba con otra foto en JPG o PNG
El asistente responde «Vamos a dejar descansar al asistente un rato…»Límite de 15 preguntas cada 10 minutos desde esa conexiónEsperar; se libera solo
El asistente dice «Ahora mismo no puedo ayudarte con eso…»Error al llamar a GeminiRevisa en Uso de IA si hay peticiones fallidas y avisa a FOS
El asistente no aparece en la cartaLa plataforma no tiene la clave de GeminiAvisa a FOS

Preguntas frecuentes#

¿Cómo escribo con IA la descripción de un plato en el delivery propio de Ágora?#

En Operación → Cartas abre el plato y pulsa «Describir con IA» en el pie de la ficha. Gemini escribe una frase a partir de la foto y queda como descripción propia de la tienda; en Ágora no cambia nada.

¿Cuánto dura el vídeo del plato y en qué formato sale?#

Unos 8 segundos a 720p, en horizontal 16:9 si la foto es apaisada o en vertical 9:16 si es vertical. En la tienda se reproduce en bucle y sin sonido.

¿Puedo cambiar cómo se generan los vídeos?#

Sí, con el prompt de Configuración → Tienda pública → Vídeo IA. Los vídeos que ya existen no cambian: hay que volver a generarlos plato a plato.

¿Se envían datos de los clientes a la IA?#

Para describir platos y hacer vídeos solo viajan la foto, el nombre del plato y descripciones de la carta. El asistente recibe la carta y lo que el cliente escribe en el chat.

¿Puedo quitar el asistente «¿Qué te apetece?» de una tienda?#

No desde el panel: aparece en todas las tiendas cuando la plataforma tiene la clave de Gemini.

¿Dónde veo cuánto cuesta la IA?#

En Configuración → Uso de IA, con el coste estimado de cada petición en dólares y el total al pie. Es una estimación con tarifas públicas; la factura real la emite Google.

Referencias#

¿Te ha servido este manual? ¡Gracias! Nos ayuda a mejorarlo. No hemos podido guardar tu respuesta. Inténtalo de nuevo.
¿Te has atascado?

910 91 92 11 · Lunes a jueves de 9 a 18 h · viernes de 9 a 15 h

Escríbenos