A Próxima Fronteira da Educação Médica: Criando Conteúdo com Veo e Nano Banana
Veo 2, Veo 3 e Nano Banana formam uma tríade de ferramentas do Google capazes de transformar um roteiro em aula em vídeo, com áudio sincronizado e coerência visual entre cenas. Este artigo mostra o workflow prático — do roteiro à distribuição — e onde a maioria dos educadores erra ao pular a etapa que garante precisão anatômica.
📅 Publicado em 09/09/2025
Navegue pelo Artigo
Da tríade tecnológica ao workflow de produção de uma aula do zero
- 1. Introdução: A Tríade Tecnológica para Educadores
- 2. Veo 2 vs. Veo 3: A Evolução dos Vídeos Gerados por IA
- 3. Nano Banana: A Revolução da Coerência Visual em Imagens
- 4. Workflow Integrado: Como Criar uma Aula de Intubação do Zero
- 5. Brainstorming: Ideias Revolucionárias para Conteúdo Médico com IA
- 6. Considerações Finais
1. Introdução: A Tríade Tecnológica para Educadores
Nos últimos meses, o ecossistema de inteligência artificial do Google apresentou três modelos que se destacaram como ferramentas poderosas para a produção de conteúdo educativo na área médica: Veo 2, Veo 3 e Nano Banana. Cada um possui capacidades distintas, mas que se complementam de forma extraordinária. Sua integração tem o potencial de revolucionar a maneira como criamos, compartilhamos e personalizamos o conhecimento em saúde, tornando o ensino mais acessível, visual e eficaz.
2. Veo 2 vs. Veo 3: A Evolução dos Vídeos Gerados por IA
A capacidade de transformar texto em vídeo não é nova, mas a qualidade e as funcionalidades dos modelos Veo representam um salto significativo.
Veo 2: O Diretor de Fotografia Cinematográfico
Lançado em 2024, o Veo 2 impressionou pela sua habilidade de gerar vídeos em altíssima resolução (até 4K) com um notável apelo cinematográfico. Suas principais forças são a simulação realista de luz, profundidade de campo e composição de cena. Ele é ideal para criar vinhetas, introduções de aulas ou cenas que exigem um forte apelo estético e fidelidade visual, embora não possua suporte nativo para áudio.
Veo 3: O Estúdio de Produção Completo
Já o Veo 3, lançado em maio de 2025, marca um salto expressivo: além de manter a qualidade de imagem, o novo modelo traz suporte completo a áudio nativo, incluindo diálogos sincronizados, efeitos sonoros e sons ambientes. Isso torna possível criar vídeos explicativos realistas diretamente a partir do prompt, sem necessidade de edição posterior. Uma versão mais ágil, o Veo 3 Fast, já está disponível na Vertex AI, otimizada para criar vídeos curtos (4 a 8 segundos) com maior velocidade e menor custo, perfeita para pílulas de conhecimento ou conteúdo para redes sociais.
| Recurso | Veo 2 | Veo 3 |
|---|---|---|
| Resolução Máxima | Até 4K | Até 4K |
| Foco Principal | Qualidade cinematográfica e visual | Realismo e produção completa (áudio + vídeo) |
| Suporte a Áudio Nativo | Não | Sim (diálogos, efeitos sonoros, ambiente) |
| Caso de Uso Ideal | Cenas acadêmicas esteticamente refinadas | Vídeos explicativos, simulações com narração |
3. Nano Banana: A Revolução da Coerência Visual em Imagens
O modelo Gemini 2.5 Flash Image, apelidado de Nano Banana, é a mais recente inovação do Google para geração e edição de imagens. Seu grande diferencial é a capacidade de preservar a identidade visual, ou seja, ao alterar um cenário ou expressão facial de um personagem, a IA mantém seus traços e proporções, garantindo coerência em edições sequenciais.
Além disso, o Nano Banana permite fusões de imagens e alteração de estilos visuais com altíssima velocidade. Ele já está integrado a ferramentas como o Google AI Studio e a interface do Gemini, sendo perfeito para criar ilustrações médicas, anatomia detalhada, esquemas de equipamentos ou qualquer conteúdo visual que exija consistência.
4. Workflow Integrado: Como Criar uma Aula de Intubação do Zero
A verdadeira mágica acontece ao integrar esses três modelos em um fluxo de produção eficiente. Vejamos como criar um material educacional sobre intubação orotraqueal:
- Planejamento do Roteiro: O primeiro passo, e o mais crucial, é definir o conteúdo, com a descrição das cenas, diálogos e ações envolvidas.
- Geração de Imagens de Apoio (Nano Banana): Antes do vídeo, crie os elementos visuais estáticos. Use o Nano Banana para gerar imagens detalhadas e consistentes da anatomia das vias aéreas, a posição correta do laringoscópio e as diferentes visualizações glóticas.
- Criação das Cenas com Áudio (Veo 3): Com o roteiro em mãos, use o Veo 3 para gerar as cenas principais, com o médico narrando os passos e incluindo sons de equipamentos e do ambiente hospitalar.
- Cenas Cinemáticas (Veo 2 – Opcional): Para um toque de sofisticação, use o Veo 2 para construir tomadas com ênfase em iluminação ou enquadramento refinado e realismo cinematográfico.
- Montagem e Distribuição: Combine os vídeos do Veo 3 com as imagens do Nano Banana em qualquer editor de vídeo. O resultado é uma aula completa, que pode ser adaptada para formato horizontal (YouTube, aulas) ou vertical (Reels, TikTok).
Este processo estruturado de planejamento e execução é uma reminiscência da “metodologia de prompts” que ensinamos nos cursos AIMED. Assim como na criação de prompts eficazes, um roteiro bem definido é a base para extrair o melhor resultado da inteligência artificial, seja para gerar texto, imagem ou vídeo.
5. Brainstorming: Ideias Revolucionárias para Conteúdo Médico com IA
A combinação dessas ferramentas abre um leque de possibilidades que vão muito além dos tutoriais. Aqui estão algumas ideias para revolucionar a educação médica:
- Simulações de Procedimentos Interativos: Crie vídeos curtos de diferentes etapas de um procedimento (ex: sutura, acesso venoso central). O aluno assiste ao passo 1 (Veo 3), responde a uma pergunta de múltipla escolha e, dependendo da resposta, é direcionado para o vídeo da consequência correta ou incorreta.
- “Paciente Virtual” para Ensino de Comunicação: Use o Nano Banana para criar um personagem (paciente) com identidade visual consistente. Em seguida, use o Veo 3 para gerar cenários de interação, como “dar más notícias” ou “explicar um diagnóstico complexo”. A IA pode gerar múltiplas versões da reação do paciente, treinando as soft skills dos estudantes.
- Visualização de Fisiologia e Farmacologia: Utilize o Veo 2 para criar animações cinematográficas e visualmente impressionantes de processos moleculares, como a propagação de um potencial de ação ou o mecanismo de ação de um fármaco em seu receptor.
- Atualizações Científicas em Minutos: Transforme o resumo de um artigo científico importante em um vídeo curto e explicativo. O Veo 3 pode gerar um “apresentador virtual” que narra as principais descobertas, enquanto o Nano Banana cria gráficos e esquemas para ilustrar os dados.
💡 Ideia do Dr. Mbula (Fora do Padrão)
Imagine integrar estas ferramentas para criar “Casos Clínicos Vivos”. A cada semana, um novo caso é apresentado como um vídeo curto (Veo 3), acompanhado de exames de imagem gerados (Nano Banana). Os alunos dos cursos AIMED poderiam aplicar as técnicas de análise de evidências e a metodologia da “Teoria do Contrário” que aprendem para discutir o caso em nosso grupo exclusivo, transformando o aprendizado em uma experiência contínua, colaborativa e gamificada.
Leva Isso Para a Sua Prática de Ensino
A metodologia de prompts estruturados que sustenta esse workflow é ensinada a fundo nos cursos AIMED. Aprenda a extrair o melhor de cada ferramenta de IA generativa.
6. Considerações Finais
A tríade tecnológica composta por Veo 2, Veo 3 e Nano Banana oferece a educadores, equipes clínicas e instituições de ensino a capacidade de desenvolver materiais de alta qualidade com uma velocidade e personalização sem precedentes. Esses recursos marcam o início de uma nova era no ensino médico, onde a IA não substitui o professor, mas atua como uma poderosa ferramenta para potencializá-lo, tornando o conhecimento mais acessível, visual e impactante.
💡 Connecting the Dots: O detalhe que a maioria dos educadores vai pular neste artigo é a ordem de produção sugerida — imagem estática primeiro (Nano Banana), vídeo depois (Veo 3). Isso não é preferência estética, é engenharia de consistência: gerar a anatomia correta primeiro como imagem fixa, e só depois usar essa imagem como âncora visual para o vídeo, é o que evita o problema clássico de vídeo gerado por IA em conteúdo médico — a anatomia que muda sutilmente de frame para frame, invisível num primeiro olhar, mas grosseira para quem já viu a estrutura real na sala de cirurgia. Quem pular a etapa da imagem-âncora e for direto para o vídeo vai produzir material visualmente impressionante e clinicamente impreciso, exatamente o tipo de erro que passa despercebido pelo educador e é pego pelo aluno mais atento.
The Next Frontier in Medical Education: Creating Content with Veo and Nano Banana
Veo 2, Veo 3, and Nano Banana form a trio of Google tools able to turn a script into a lesson video, with synchronized audio and visual consistency across scenes. This article walks through the practical workflow — from script to distribution — and where most educators go wrong by skipping the step that guarantees anatomical accuracy.
📅 Published September 9, 2025
Table of Contents
From the technological triad to the workflow for producing a lesson from scratch
- 1. Introduction: The Technological Triad for Educators
- 2. Veo 2 vs. Veo 3: The Evolution of AI-Generated Videos
- 3. Nano Banana: The Revolution of Visual Coherence in Images
- 4. Integrated Workflow: How to Create a Tracheal Intubation Lesson from Scratch
- 5. Brainstorming: Revolutionary Ideas for AI-Powered Medical Content
- 6. Final Considerations
1. Introduction: The Technological Triad for Educators
In recent months, Google’s artificial intelligence ecosystem has introduced three models that stand out as powerful tools for producing high-quality educational content in the medical field: Veo 2, Veo 3, and Nano Banana. Each has distinct yet complementary capabilities. Their integration has the potential to revolutionize how we create, share, and personalize knowledge in healthcare, making education more accessible, visual, and effective.
2. Veo 2 vs. Veo 3: The Evolution of AI-Generated Videos
The ability to turn text into video is not new, but the quality and features of the Veo models represent a significant leap forward.
Veo 2: The Cinematographic Director
Launched in 2024, Veo 2 stood out for its ability to generate very high-resolution videos (up to 4K) with a remarkable cinematic appeal. Its main strengths are the realistic simulation of light, depth of field, and scene composition. It is ideal for creating vignettes, lecture introductions, or scenes that require strong aesthetic appeal and visual fidelity, although it lacks native audio support.
Veo 3: The Complete Production Studio
Veo 3, released in May 2025, marks an expressive leap: while maintaining the image quality, the new model brings full native audio support, including synchronized dialogues, sound effects, and ambient sounds. This makes it possible to create realistic explanatory videos with speech and sound directly from the prompt, without the need for post-production editing. A leaner version, Veo 3 Fast, is already available in Vertex AI, optimized for creating short videos (4 to 8 seconds) with greater speed and lower cost, perfect for knowledge pills or social media content.
| Feature | Veo 2 | Veo 3 |
|---|---|---|
| Max Resolution | Up to 4K | Up to 4K |
| Main Focus | Cinematic and visual quality | Realism and full production (audio + video) |
| Native Audio Support | No | Yes (dialogues, sound effects, ambient) |
| Ideal Use Case | Aesthetically refined academic scenes | Explanatory videos, simulations with narration |
3. Nano Banana: The Revolution of Visual Coherence in Images
The Gemini 2.5 Flash Image model, nicknamed Nano Banana, is Google’s latest innovation in AI image generation and editing. Its main differentiator is the ability to preserve visual identity; that is, when changing a character’s scenery, clothing, or facial expression, the AI maintains their features and proportions, ensuring consistency in sequential edits.
Additionally, Nano Banana allows for image merging, multi-turn editing, and changing visual styles with extremely high speed and quality. It is already integrated into tools like Google AI Studio and the Gemini interface, making it perfect for creating custom medical images, anatomies, equipment diagrams, or realistic visual representations of fictional patients.
4. Integrated Workflow: How to Create a Tracheal Intubation Lesson from Scratch
The real magic happens when these three models are integrated into an efficient production workflow. Let’s see how to create an educational material on orotracheal intubation:
- Script Planning: The first and most crucial step is to define the educational content, with a description of the scenes, dialogues, equipment, and actions involved in the procedure.
- Generate Support Images (Nano Banana): Before the video, create the static visual elements. Use Nano Banana to generate detailed images of the airway anatomy, correct laryngoscope positions, and glottic visualization.
- Create Scenes with Audio (Veo 3): With the script in hand, use Veo 3 to generate short videos, with the doctor performing the intubation and narrating the steps, including sounds of equipment and the hospital environment.
- Cinematic Scenes (Veo 2 – Optional): For a more sophisticated touch, with an emphasis on refined lighting or framing, Veo 2 can be used to build these scenes with cinematic realism.
- Final Assembly and Distribution: The images from Nano Banana can be incorporated into the videos generated with Veo 3, creating a cohesive educational video that can be published in horizontal (for lessons) or vertical (for Reels and TikTok) format.
This structured process of planning and execution is reminiscent of the “prompt methodology” we teach in the AIMED courses. Just as in creating effective prompts, a well-defined script is the foundation for extracting the best results from artificial intelligence, whether for generating text, images, or video.
5. Brainstorming: Revolutionary Ideas for AI-Powered Medical Content
The combination of these tools opens up a range of possibilities far beyond simple tutorials. Here are some ideas to revolutionize medical education:
- Interactive Procedure Simulations: Create short videos of different steps of a procedure (e.g., suturing, central venous access). The student watches step 1 (Veo 3), answers a multiple-choice question, and, depending on the answer, is directed to the video showing the correct or incorrect consequence.
- “Virtual Patient” for Communication Skills Training: Use Nano Banana to create a patient character with a consistent visual identity. Then, use Veo 3 to generate interaction scenarios, such as “breaking bad news” or “explaining a complex diagnosis.” The AI can generate multiple versions of the patient’s reaction, training students’ soft skills.
- Dynamic Anatomy and Physiology Visualization: Use Veo 2 to create cinematic, visually stunning animations of molecular processes, such as the propagation of an action potential or the mechanism of action of a drug on its receptor.
- Scientific Updates in Minutes: Turn the abstract of an important scientific article into a short, explanatory video. Veo 3 can generate a “virtual presenter” who narrates the main findings, while Nano Banana creates graphs and diagrams to illustrate the data.
💡 Dr. Mbula’s Idea (Outside the Box)
Imagine integrating these tools to create “Living Clinical Cases.” Each week, a new case is presented as a short video (Veo 3), accompanied by generated imaging studies (Nano Banana). Students of the AIMED courses could apply the evidence analysis techniques and the “Contrary Theory” methodology they learn to discuss the case in our exclusive group, turning learning into a continuous, collaborative, and gamified experience.
Bring This to Your Teaching Practice
The structured-prompt methodology behind this workflow is taught in depth in the AIMED courses. Learn to get the best out of every generative AI tool.
6. Final Considerations
This technological triad allows teachers, clinical teams, and educational institutions to develop interactive lessons, simulation videos, explanations for patients, or internal training with unprecedented speed, visual fidelity, and personalization. These resources represent the beginning of a new era in medical education—one where artificial intelligence does not replace the teacher but empowers them, allowing knowledge to be accessible, visual, attractive, and effective.
💡 Connecting the Dots: The detail most educators will skip in this article is the suggested production order — static image first (Nano Banana), video second (Veo 3). That is not an aesthetic preference, it is consistency engineering: generating correct anatomy first as a fixed image, then using that image as a visual anchor for the video, is what prevents the classic failure of AI-generated video in medical content — anatomy that subtly shifts frame to frame, invisible at first glance, but glaring to anyone who has actually seen the real structure in the operating room. Anyone who skips the anchor-image step and goes straight to video will produce material that looks impressive and is clinically imprecise — exactly the kind of error that slips past the educator and gets caught by the sharpest student in the room.
◆ Novidades
- A Semana em Que a IA Começou a Agir — GPT‑6 Astra, Claude Fable 5.1 e a Fronteira Antes da AGI
- O Software Que Muda Depois de Aprovado — e o Vão Entre o CFM e a ANVISA Que Ninguém Nomeou
- Memória Inteligente: o que a ciência da aprendizagem realmente sustenta
Próxima turma: 19 e 20 de setembro de 2026, em Goiânia.

