Aplicaciones multimodales con Gemini 3: visión, audio, vídeo y texto
Gemini 3 es una plataforma de inteligencia artificial multimodal capaz de procesar y razonar sobre imágenes, vídeos, audio y texto.
Esta formación en vivo y dirigida por un instructor (en línea o presencial) está dirigida a profesionales de nivel intermedio que deseen diseñar y desarrollar aplicaciones que aprovechen la inteligencia multimodal de Gemini 3.
Al completar este taller, los participantes estarán capacitados para:
- Integrar puntos finales multimodales de Gemini 3 en flujos de trabajo reales.
- Procesar e interpretar entradas visuales, de audio, de vídeo y de texto en tuberías unificadas.
- Construir prototipos interactivos utilizando prompts multimodales.
- Optimizar las salidas multimodales en términos de rendimiento, precisión y usabilidad.
Formato del curso
- Conferencias guiadas con demostraciones prácticas.
- Ejercicios basados en escenarios y práctica manual.
- Implementación práctica utilizando entornos de desarrollo en vivo.
Opciones de personalización del curso
- Para contenido personalizado o formación basada en proyectos específicos, contáctenos para coordinarlo.
Temario del curso
Introducción a la multimodalidad de Gemini 3
- Capacidades en texto, imágenes, audio y vídeo
- Selección del modelo y descripción general de los puntos finales
- Conceptos clave del razonamiento multimodal
Trabajo con texto e entradas estructuradas
- Estrategias de prompts para generación de texto
- Metadatos, ventanas de contexto y embeddings
- Orquestación basada en texto de tareas multimodales
Comprensión de imágenes y flujos visuales
- Análisis e interpretación de imágenes con Gemini 3
- Creación de herramientas de búsqueda visual y etiquetado
- Construcción de interacciones imagen-a-texto y texto-a-imagen
Procesamiento de entradas de audio
- Flujos de trabajo de reconocimiento y transcripción de voz
- Detección e interpretación de eventos de audio
- Integración del audio con entradas de texto y visuales
Inteligencia de vídeo y análisis de escenas
- Razonamiento de vídeo continuo y fotograma a fotograma
- Construcción de herramientas de resumen y extracción de destacados
- Automatización basada en vídeo y flujos de contenido
Diseño de arquitecturas de aplicaciones multimodales
- Combinación de múltiples tipos de entrada en una sola tubería
- Consideraciones de latencia, costo y computacionales
- Mejores prácticas para sistemas multimodales escalables
Prototipado de aplicaciones multimodales
- Creación práctica de prototipos multimodales
- Iteración rápida mediante ingeniería de prompts
- Pruebas y refinamiento de flujos de experiencia del usuario
Implementación de soluciones multimodales
- Estrategias de implementación y configuración del entorno
- Monitoreo del rendimiento en el mundo real
- Consideraciones de seguridad y cumplimiento normativo
Resumen y próximos pasos
Requerimientos
- Comprensión de conceptos modernos de inteligencia artificial
- Experiencia con Python o JavaScript
- Familiaridad con APIs REST
Público objetivo
- Diseñadores
- Creadores de contenido
- Equipos técnicos de productos
Los cursos públicos requieren más de 5 participantes.
Aplicaciones multimodales con Gemini 3: visión, audio, vídeo y texto - Reserva
Aplicaciones multimodales con Gemini 3: visión, audio, vídeo y texto - Consulta
Aplicaciones multimodales con Gemini 3: visión, audio, vídeo y texto - Solicitud de consultoría
Reseñas (1)
Flujo, vibra y tema en la presentación
Lukasz Kowalczyk - Allegro Sp. z o.o.
Curso - Google Gemini AI for Data Analysis
Traducción Automática
Próximos cursos
Cursos Relacionados
Desarrollo Agénico con Gemini 3 y Google Antigravity
21 HorasGoogle Antigravity es un entorno de desarrollo agénico diseñado para construir agentes autónomos capaces de planificar, razonar, codificar y actuar mediante las capacidades multimodales de Gemini 3.
Esta formación en vivo con instructores (en línea o presencial) está dirigida a profesionales técnicos de nivel avanzado que desean diseñar, construir e implementar agentes autónomos utilizando Gemini 3 y el entorno Antigravity.
Al finalizar esta capacitación, los participantes estarán preparados para:
- Construir flujos de trabajo autónomos que utilicen Gemini 3 para razonamiento, planificación y ejecución.
- Desarrollar agentes en Antigravity capaces de analizar tareas, escribir código e interactuar con herramientas.
- Integrar agentes impulsados por Gemini con sistemas empresariales y API.
- Optimizar el comportamiento, la seguridad y la confiabilidad de los agentes en entornos complejos.
Formato del curso
- Demostraciones expertas combinadas con discusiones interactivas.
- Experimentación práctica en el desarrollo de agentes autónomos.
- Implementación práctica utilizando Antigravity, Gemini 3 y herramientas en la nube complementarias.
Opciones de personalización del curso
- Si su equipo requiere comportamientos de agentes específicos del dominio o integraciones personalizadas, contáctenos para adaptar el programa.
Creación de aplicaciones de IA en el dispositivo con Nano Banana
14 HorasNano Banana es un modelo especializado optimizado para la ejecución rápida y eficiente de IA en el dispositivo (on-device).
Esta capacitación en vivo, dirigida por un instructor (en línea o presencial), está destinada a profesionales de nivel intermedio que deseen diseñar e implementar aplicaciones móviles con IA utilizando Nano Banana, sin depender de la infraestructura de la nube.
Al finalizar este programa, los participantes deberán ser capaces de:
- Implementar modelos de Nano Banana directamente en dispositivos móviles.
- Optimizar las cargas de trabajo de IA para mejorar el rendimiento y la eficiencia energética.
- Integrar funciones de generación de texto e imágenes en aplicaciones móviles.
- Diagnosticar problemas, realizar pruebas de rendimiento (benchmarking) y refinar las tuberías de inferencia en el dispositivo.
Formato del Curso
- Demostraciones guiadas por el instructor y discusión colaborativa.
- Ejercicios prácticos centrados en casos de uso del mundo real.
- Desarrollo y pruebas prácticas dentro de un entorno móvil en vivo.
Opciones de Personalización del Curso
- Si requiere una versión adaptada de este curso, contáctenos para discutir las opciones de personalización.
Optimización de modelos de IA para despliegue en el borde con Nano Banana
14 HorasNano Banana es un marco ligero de IA diseñado para acelerar y comprimir modelos para un despliegue eficiente en dispositivos y en el borde.
Esta capacitación en vivo con instructor (en línea o presencial) está dirigida a profesionales de nivel intermedio a avanzado que deseen optimizar, comprimir y desplegar modelos de IA para entornos de borde utilizando Nano Banana.
Al finalizar el programa, los participantes estarán en capacidad de:
- Aplicar técnicas de compresión y cuantización a modelos de IA.
- Acelerar el rendimiento de inferencia para dispositivos de borde.
- Convertir y desplegar modelos utilizando la cadena de herramientas de Nano Banana.
- Evaluar las compensaciones entre precisión, latencia y uso de recursos.
Formato del curso
- Sesiones técnicas guiadas por un instructor y discusiones orientadas.
- Ejercicios prácticos que utilizan escenarios de IA en el borde del mundo real.
- Implementación práctica utilizando un entorno en vivo configurado.
Opciones de personalización del curso
- Para contenido personalizado o adaptaciones específicas de la organización, comuníquese para coordinar una versión personalizada de este curso.
Maestría en el Modo Deep-Think: Razonamiento Avanzado con Gemini 3
14 HorasGemini 3 es un sistema de IA multimodal avanzado diseñado para respaldar el razonamiento profundo, tareas de alto contexto y flujos de trabajo analíticos extensos.
Esta formación en vivo con instructores (en línea o presencial) está dirigida a profesionales de nivel avanzado que deseen aprovechar el Modo Deep-Think para realizar análisis complejos, modelado y planificación estratégica.
Al completar este curso, los participantes estarán capacitados para:
- Aplicar el Modo Deep-Think para resolver problemas intricados y de múltiples capas.
- Diseñar pipelines de razonamiento que incorporen análisis de contexto extenso.
- Optimizar prompts para tareas de razonamiento iterativo y multisalto.
- Integrar las capacidades de Deep-Think en flujos de trabajo de investigación o producción.
Formato del Curso
- Presentaciones dirigidas por expertos con ejemplos reales.
- Laboratorios prácticos de razonamiento y ejercicios estructurados.
- Desarrollo aplicado utilizando entornos de experimentación en vivo.
Opciones de Personalización del Curso
- Sesiones personalizadas o proyectos de razonamiento profundo específicos para el dominio pueden organizarse bajo solicitud.
Gemini 3 para empresas: razonamiento, planificación y flujos de trabajo multimodales
14 HorasGemini 3 es un modelo de IA multimodal diseñado para realizar razonamientos sobre texto, imágenes e inputs estructurados, con el fin de apoyar flujos de trabajo empresariales complejos.
Esta formación en vivo y dirigida por instructores (en línea o presencial) está orientada a profesionales de nivel intermedio que deseen desarrollar flujos de trabajo impulsados por razonamiento y multimodales, utilizando Gemini 3 dentro de entornos empresariales.
Tras completar este curso, los participantes contarán con las habilidades para:
- Aplicar las capacidades de razonamiento de Gemini 3 a flujos de trabajo de planificación y toma de decisiones en el ámbito empresarial.
- Diseñar procesos multimodales que integren texto, imágenes, documentos y datos tabulares.
- Desarrollar flujos de trabajo empresariales mediante las herramientas AI Studio y Vertex AI.
- Optimizar los resultados gracias a la ingeniería de prompts y técnicas de refinamiento iterativo.
Formato del curso
- Demostraciones guiadas respaldadas por explicaciones de expertos.
- Ejercicios prácticos centrados en el diseño de flujos de trabajo y tareas multimodales.
- Experimentación práctica en entornos de AI Studio o Vertex AI.
Opciones de personalización del curso
- Si su organización requiere escenarios de flujos de trabajo adaptados o ejemplos de integración de datos, contáctenos para ajustar la formación.
Géminis 3 en la búsqueda de Google y el trabajo del conocimiento: uso del modo IA para la productividad
14 HorasGemini 3 es un sistema impulsado por inteligencia artificial que mejora Google Search y la productividad laboral mediante el modo IA.
Esta formación en vivo, impartida por un instructor (en línea o presencial), está dirigida a usuarios de nivel principiante que desean aprovechar Gemini 3 para optimizar la investigación, la planificación, el análisis y el trabajo diario con información.
A lo largo de esta formación, los participantes adquirirán las habilidades necesarias para:
- Utilizar Gemini 3 en modo IA para acelerar la investigación y el descubrimiento de información.
- Aplicar flujos de trabajo asistidos por Gemini para resumir contenido y extraer ideas clave.
- Integrar las funcionalidades de Gemini 3 en tareas cotidianas de productividad.
- Adoptar buenas prácticas para el uso responsable y fiable de herramientas de IA.
Formato del curso
- Presentaciones y demostraciones guiadas por el instructor.
- Ejercicios prácticos estructurados para el desarrollo de habilidades aplicables.
- Aplicaciones reales utilizando escenarios de búsqueda y productividad en tiempo real.
Opciones de personalización del curso
- Para una formación adaptada a tus flujos de trabajo, contáctanos para discutir las opciones de personalización.
Introducción a Google Gemini AI
14 HorasEsta formación en vivo impartida por un instructor en <ubicación> (en línea o presencial) está dirigida a desarrolladores de nivel principiante e intermedio que deseen integrar funcionalidades de IA en sus aplicaciones mediante Google Gemini AI.
Al finalizar esta formación, los participantes podrán:
- Comprender los fundamentos de los modelos de lenguaje grande.
- Configurar y utilizar Google Gemini AI para diversas tareas de IA.
- Implementar transformaciones de texto a texto y de imagen a texto.
- Construir aplicaciones básicas impulsadas por IA.
- Explorar las características avanzadas y opciones de personalización de Google Gemini AI.
Google Gemini AI para la creación de contenido
14 HorasEsta formación en vivo con instructor en Peru (en línea o presencial) está dirigida a creadores de contenido de nivel intermedio que desean utilizar Google Gemini AI para mejorar la calidad y eficiencia de su contenido.
Al finalizar esta formación, los participantes serán capaces de:
- Comprender el papel de la IA en la creación de contenido.
- Configurar y utilizar Google Gemini AI para generar y optimizar contenido.
- Aplicar transformaciones de texto a texto para producir contenido creativo y original.
- Implementar estrategias de SEO utilizando información impulsada por IA.
- Analizar el rendimiento del contenido y adaptar las estrategias mediante Gemini AI.
Google Gemini AI para un Servicio al Cliente Transformador
14 HorasEsta formación en vivo dirigida por un instructor en Peru (en línea o presencial) está dirigida a profesionales del servicio al cliente de nivel intermedio que desean implementar Google Gemini AI en sus operaciones de atención al cliente.
Al finalizar esta capacitación, los participantes serán capaces de:
- Comprender el impacto de la IA en el servicio al cliente.
- Configurar Google Gemini AI para automatizar y personalizar las interacciones con los clientes.
- Utilizar transformaciones de texto a texto y de imagen a texto para mejorar la eficiencia del servicio.
- Desarrollar estrategias impulsadas por IA para el análisis en tiempo real de los comentarios de los clientes.
- Explorar funciones avanzadas para crear una experiencia de servicio al cliente sin interrupciones.
Google Gemini AI para Análisis de Datos
21 HorasEsta formación práctica, impartida por instructores en Peru (en línea o presencial), está dirigida a analistas de datos y profesionales del sector empresarial, desde nivel principiante hasta intermedio, que deseen realizar tareas complejas de análisis de datos de manera más intuitiva en diversas industrias utilizando Google Gemini AI.
Al finalizar esta formación, los participantes podrán:
- Comprender los fundamentos de Google Gemini AI.
- Conectar diversas fuentes de datos con Gemini AI.
- Explorar datos mediante consultas en lenguaje natural.
- Analizar patrones de datos y extraer información relevante.
- Crear visualizaciones de datos impactantes.
- Comunicar eficazmente la información obtenida basada en los datos.
Introducción a Google Gemini AI
14 HorasGoogle Gemini AI es un modelo de lenguaje grande de última generación que ofrece capacidades avanzadas de IA, como comprensión del lenguaje natural, generación de texto y procesamiento multimodal, lo que permite a los desarrolladores construir aplicaciones inteligentes y conscientes del contexto.
Esta formación en vivo impartida por instructores (en línea o presencial) está dirigida a desarrolladores de nivel principiante e intermedio que desean aplicar de manera práctica conceptos de IA utilizando Google Gemini AI mediante proyectos prácticos, ejemplos del mundo real y ejercicios colaborativos.
Al finalizar esta formación, los participantes podrán:
- Configurar y utilizar efectivamente Google Gemini AI y herramientas relacionadas.
- Desarrollar aplicaciones impulsadas por IA utilizando entradas de texto e imagen.
- Aprovechar NotebookLM para flujos de trabajo prácticos de IA y razonamiento basado en documentos.
- Colaborar en grupos pequeños para diseñar e implementar prototipos funcionales de IA.
Formato del curso
- Clase interactiva y discusión guiada.
- Ejercicios prácticos de laboratorio y proyectos colaborativos.
- Tareas prácticas utilizando Google Gemini AI y NotebookLM.
Opciones de personalización del curso
- Para solicitar una formación personalizada para este curso, contáctenos para coordinarlo.
Gemini AI Intermedio para Profesionales del Sector Público
16 HorasEsta formación en vivo con instructor en Peru (en línea o presencial) está dirigida a profesionales del sector público de nivel intermedio que deseen utilizar Gemini para generar contenido de alta calidad, apoyar la investigación y mejorar la productividad a través de interacciones con IA más avanzadas.
Al finalizar esta formación, los participantes podrán:
- Elaborar indicaciones más eficaces y adaptadas a casos de uso específicos.
- Generar contenido original y creativo con Gemini.
- Resumir y comparar información compleja con precisión.
- Utilizar Gemini para lluvia de ideas, planificación y organización eficiente de ideas.
Introducción a Nano Banana: LLMs ligeros para aplicaciones del mundo real
7 HorasNano Banana es un marco de trabajo de modelos de lenguaje grandes (LLM) ligeros, diseñado para un uso eficiente, de bajo costo y real en dispositivos y entornos empresariales.
Esta capacitación en vivo, dirigida por un instructor (en línea o presencial), está dirigida a profesionales de nivel inicial que desean comprender cómo los LLM ligeros pueden implementarse para aplicaciones prácticas, en el dispositivo y eficientes en costos.
Al finalizar este curso, los participantes podrán:
- Explicar los conceptos fundamentales detrás de los LLM ligeros y de Nano Banana.
- Identificar casos de uso adecuados para la implementación de IA en el dispositivo y de bajo costo.
- Evaluar las capacidades de Nano Banana para escenarios de negocio y TI.
- Tomar decisiones informadas sobre las vías de integración en su organización.
Formato del Curso
- Explicaciones del instructor apoyadas por un diálogo interactivo.
- Ejercicios prácticos para reforzar los conceptos clave.
- Exploración práctica de las capacidades de los LLM ligeros.
Opciones de Personalización del Curso
- Para versiones personalizadas de esta capacitación, contáctenos para adaptar el programa.
Nano Banana para desarrolladores de Android: Integración de IA ligera
14 HorasNano Banana es un marco de inteligencia artificial ligero diseñado para la ejecución eficiente de modelos en el dispositivo en Android.
Esta capacitación en vivo, impartida por un instructor (en línea o presencial), está dirigida a desarrolladores de Android de nivel inicial a intermedio que deseen integrar capacidades de IA optimizadas directamente en aplicaciones móviles.
Al completar esta capacitación, los participantes estarán en capacidad de:
- Integrar el SDK de Nano Banana en proyectos de Android Studio.
- Implementar inferencia de IA en tiempo real utilizando las APIs de Nano Banana.
- Optimizar el rendimiento de los modelos para entornos móviles con recursos limitados.
- Aplicar mejores prácticas para una IA en el dispositivo segura y que preserve la privacidad.
Formato del curso
- Presentaciones guiadas y discusiones colaborativas.
- Ejercicios prácticos de código para reforzar los conceptos fundamentales.
- Implementación práctica utilizando ejemplos reales de Android.
Opciones de personalización del curso
- Para versiones a la medida de este curso, por favor comuníquese para coordinar un programa personalizado.
IA con preservación de privacidad en dispositivos móviles con Nano Banana
14 HorasNano Banana es un marco de IA en el dispositivo diseñado para ejecutar modelos de forma local manteniendo un estricto cumplimiento de la privacidad y las normativas.
Esta capacitación en vivo dirigida por un instructor (presencial o en línea) está dirigida a profesionales de nivel principiante a intermedio que deseen implementar funcionalidades de IA con preservación de privacidad en dispositivos móviles utilizando Nano Banana en entornos regulados o sensibles.
Al finalizar esta capacitación, los participantes serán capaces de:
- Desarrollar aplicaciones móviles que procesen datos de manera privada en el dispositivo.
- Integrar Nano Banana para habilitar flujos de trabajo de IA con cumplimiento normativo.
- Aplicar técnicas de mejora de la privacidad, como el anonimato y el procesamiento seguro.
- Evaluar y mitigar los riesgos de privacidad durante el desarrollo de IA móvil.
Formato del Curso
- Instructivas guiadas respaldadas por discusiones y sesiones de preguntas y respuestas.
- Ejercicios prácticos que involucran escenarios de IA móvil centrados en la privacidad.
- Implementación práctica dentro de un entorno de desarrollo real.
Opciones de Personalización del Curso
- Para necesidades específicas de la organización o temas de cumplimiento sectorial, contáctenos para personalizar este programa.