Pipeline de Vídeo Codex Google-Nativo: Nano Banana 2 Lite + Gemini Omni Flash (2026)

Nano Banana 2 Lite + Gemini Omni Flash + Drive — pipeline de vídeo Google-nativo completo no Codex. Uma chave de API, de imagem a vídeo com refinamento conversacional, tudo pelo terminal.

by AnyCap

Se o seu fluxo de trabalho no Codex funciona inteiramente com modelos Google, você não precisa misturar ecossistemas. O AnyCap oferece um pipeline Google-nativo completo dentro do Codex — uma chave de API, dois modelos, do início ao fim, de imagem estática a vídeo final.

O pipeline: Nano Banana 2 Lite para geração de imagem → Gemini Omni Flash para geração de vídeo e refinamento conversacional → Drive para armazenamento e compartilhamento.

As três etapas são executadas a partir do mesmo CLI anycap dentro da sua sessão de terminal no Codex.

O Pipeline em Três Comandos

# Step 1: Generate a keyframe image with Nano Banana 2 Lite (Gemini 3.1 Flash-Lite Image)
anycap image generate \
  --model nano-banana-2-lite \
  --prompt "Minimal product hero: dark card UI, floating interface elements, soft blue glow, professional" \
  -o keyframe.jpg

# Step 2: Animate with Gemini Omni Flash
anycap video generate \
  --model gemini-omni-flash-preview \
  --mode image-to-video \
  --param images=./keyframe.jpg \
  --prompt "Subtle parallax motion, interface elements drift gently, ambient light shift" \
  -o hero-v1.mp4

# Step 3: Upload to Drive
anycap drive upload hero-v1.mp4 --name "product-hero" --share

Três comandos. Um ecossistema. Sem contas separadas.

Por que o Modelo Google-Nativo Importa no Codex

Coerência visual entre as etapas. Nano Banana 2 Lite e Gemini Omni Flash pertencem à mesma família de modelos do Google. O estilo visual, a linguagem de cores e o caráter de renderização se mantêm consistentes na transição de imagem para vídeo, sem necessidade de engenharia de prompt para alinhar a estética entre fornecedores diferentes.

Refinamento conversacional após a geração. Depois que o Gemini Omni Flash anima o seu keyframe, você pode refiná-lo em linguagem natural — "desacelere o movimento", "adicione mais calor", "pause no final" — sem precisar gerar do zero novamente. Nenhum outro modelo no catálogo oferece isso em cima de um pipeline de imagem para vídeo.

Autenticação única, cobrança unificada. Uma chave de API do anycap cobre tanto o Nano Banana 2 Lite quanto o Gemini Omni Flash. Sem conta separada no Google AI Studio, sem credenciais do Vertex AI, sem segundo painel de cobrança.

Referência de Modelos

Função Modelo Flag AnyCap
Geração de imagem Nano Banana 2 Lite --model nano-banana-2-lite
Geração de vídeo Gemini Omni Flash --model gemini-omni-flash-preview
Edição conversacional Gemini Omni Flash anycap video edit --model gemini-omni-flash-preview
Armazenamento e compartilhamento AnyCap Drive anycap drive upload

O Pipeline Completo com Refinamento Conversacional

A etapa de imagem para vídeo é apenas o começo. Após gerar a primeira passagem de vídeo, o Gemini Omni Flash permite refiná-lo em linguagem natural:

# Generate keyframe
anycap image generate \
  --model nano-banana-2-lite \
  --prompt "SaaS feature launch: dashboard UI, highlighted new feature panel, professional dark mode" \
  -o feature-hero.jpg

# First video pass
anycap video generate \
  --model gemini-omni-flash-preview \
  --mode image-to-video \
  --param images=./feature-hero.jpg \
  --prompt "Smooth reveal of the feature panel, professional product demo pacing" \
  -o feature-v1.mp4

# Conversational refinement pass 1
anycap video edit \
  --input feature-v1.mp4 \
  --instruction "Slow the reveal slightly and add a brief pause at peak exposure of the panel" \
  --model gemini-omni-flash-preview \
  -o feature-v2.mp4

# Conversational refinement pass 2
anycap video edit \
  --input feature-v2.mp4 \
  --instruction "Warm the color grade and add a subtle vignette at the edges" \
  --model gemini-omni-flash-preview \
  -o feature-v3.mp4

# Upload final version
anycap drive upload feature-v3.mp4 --name "feature-launch-hero" --share

A direção criativa é descoberta e refinada por meio da edição conversacional — e o clipe final é entregue ao Drive com um link para compartilhamento.

Um Script de Automação Completo para o Codex

Aqui está um pipeline de automação completo que um agente do Codex pode executar como etapa pós-implantação:

#!/bin/bash
# Google-native Codex video pipeline
# Usage: bash google-pipeline.sh "feature name" "visual description"

FEATURE="$1"
VISUAL="${2:-clean SaaS dashboard, dark mode, minimal UI}"

echo "🖼️  Generating keyframe with Nano Banana 2 Lite..."
anycap image generate \
  --model nano-banana-2-lite \
  --prompt "${VISUAL}, professional product hero composition" \
  -o /tmp/keyframe.jpg

echo "🎬 Animating with Gemini Omni Flash..."
anycap video generate \
  --model gemini-omni-flash-preview \
  --mode image-to-video \
  --param images=/tmp/keyframe.jpg \
  --prompt "${FEATURE} feature reveal, smooth animation, professional product demo" \
  -o /tmp/v1.mp4

echo "✏️  Refining: slowing motion and warming tone..."
anycap video edit \
  --input /tmp/v1.mp4 \
  --instruction "Slow the reveal motion slightly and warm the color grade" \
  --model gemini-omni-flash-preview \
  -o /tmp/final.mp4

echo "☁️  Uploading to Drive..."
LINK=$(anycap drive upload /tmp/final.mp4 --name "${FEATURE}-launch-video" --share)
echo "✅ Done: ${LINK}"

Execute assim: bash google-pipeline.sh "analytics-v2" "SaaS analytics dashboard, data visualization cards"

O Codex aciona esse script após cada implantação de funcionalidade — sem intervenção humana, devolvendo um link de vídeo compartilhável.

Quando Usar o Pipeline Google-Nativo vs Modelos Mistos

Use o pipeline Google-nativo quando:

  • Você quiser coerência visual entre imagem e vídeo sem alinhamento de prompt entre fornecedores
  • Você estiver em um fluxo de trabalho criativo iterativo onde a edição conversacional economiza tempo
  • Você preferir minimizar o número de fornecedores de modelos no seu stack
  • Você já estiver usando o Nano Banana 2 Lite para outras tarefas de geração de imagem no Codex

Use um pipeline misto quando:

  • Você precisar do teto de qualidade mais alto do Veo 3.1 para entregas finais (use o Nano Banana 2 Lite para o keyframe e o Veo 3.1 para o vídeo)
  • O clipe precisar ter mais de 8 segundos (troque para o Kling 3 na etapa de vídeo)
  • Você precisar de fotorrealismo máximo para sujeitos humanos (Sora 2 Pro na etapa de vídeo)

O pipeline Google-nativo não é a única resposta — mas é a mais limpa quando os modelos do Google já são o seu padrão.

Perguntas Frequentes

O que é o Nano Banana 2 Lite? Nano Banana 2 Lite é o ID de modelo do AnyCap para o Gemini 3.1 Flash-Lite Image — o modelo de geração de imagem rápido e econômico do Google. Ele pertence à mesma família de modelos do Gemini Omni Flash, tornando-se o parceiro natural para geração de imagem em pipelines Google-nativos no Codex.

Preciso de uma conta Google para usar esse pipeline? Não. O AnyCap cuida da autenticação para o Nano Banana 2 Lite e o Gemini Omni Flash. Suas credenciais anycap existentes cobrem ambos os modelos sem necessidade de configurar o Google AI Studio ou o Vertex AI separadamente.

Como é a qualidade de imagem para vídeo em comparação com texto para vídeo? Imagem para vídeo com um keyframe do Nano Banana 2 Lite tende a produzir resultados mais consistentes e intencionais do que texto para vídeo puro, porque o keyframe fornece ao Gemini Omni Flash uma composição inicial exata para animar, em vez de interpretar toda a cena a partir de texto.

Posso usar um modelo de imagem diferente para o keyframe? Sim. Embora o Nano Banana 2 Lite seja o par Google-nativo, o Gemini Omni Flash aceita qualquer imagem como entrada — GPT Image 2, Seedream 5 ou qualquer arquivo PNG/JPG. O pipeline Google-nativo é uma recomendação, não um requisito.

Como funciona a edição conversacional após imagem para vídeo? Exatamente da mesma forma que após texto para vídeo. Use anycap video edit --input <previous-output.mp4> --instruction "...". O modelo aplica a alteração descrita ao clipe animado, mantendo o contexto original da cena do keyframe.

O Que Vem a Seguir