Pipeline de Vídeo Codex Google-Nativo: Nano Banana 2 Lite + Gemini Omni Flash (2026)

Nano Banana 2 Lite + Gemini Omni Flash + Drive — pipeline de vídeo Google-nativo completo no Codex. Uma chave de API, de imagem a vídeo com refinamento conversacional, a partir do terminal.

by AnyCap

Se o teu fluxo de trabalho no Codex corre inteiramente em modelos Google, não precisas de misturar ecossistemas. O AnyCap oferece um pipeline Google-nativo completo dentro do Codex — uma chave de API, dois modelos, do início ao fim, desde imagem estática até vídeo final.

O pipeline: Nano Banana 2 Lite para geração de imagem → Gemini Omni Flash para geração de vídeo e refinamento conversacional → Drive para armazenamento e partilha.

Os três passos correm a partir do mesmo CLI anycap dentro da tua sessão de terminal no Codex.

O Pipeline em Três Comandos

# Step 1: Generate a keyframe image with Nano Banana 2 Lite (Gemini 3.1 Flash-Lite Image)
anycap image generate \
  --model nano-banana-2-lite \
  --prompt "Minimal product hero: dark card UI, floating interface elements, soft blue glow, professional" \
  -o keyframe.jpg

# Step 2: Animate with Gemini Omni Flash
anycap video generate \
  --model gemini-omni-flash-preview \
  --mode image-to-video \
  --param images=./keyframe.jpg \
  --prompt "Subtle parallax motion, interface elements drift gently, ambient light shift" \
  -o hero-v1.mp4

# Step 3: Upload to Drive
anycap drive upload hero-v1.mp4 --name "product-hero" --share

Três comandos. Um ecossistema. Sem contas separadas.

Por que o Pipeline Google-Nativo é Importante no Codex

Coerência visual entre passos. O Nano Banana 2 Lite e o Gemini Omni Flash partilham a mesma família de modelos do Google. O estilo visual, a linguagem de cores e o carácter de renderização mantêm-se consistentes na transição de imagem para vídeo, sem necessidade de engenharia de prompt para alinhar a estética entre fornecedores diferentes.

Refinamento conversacional após a geração. Depois de o Gemini Omni Flash animar o teu keyframe, podes refiná-lo em linguagem natural — "abranda o movimento", "adiciona mais calor", "pausa no final" — sem gerar de novo desde o início. Nenhum outro modelo no catálogo oferece isto em cima de um pipeline de imagem para vídeo.

Autenticação única, faturação unificada. Uma chave de API do anycap cobre tanto o Nano Banana 2 Lite como o Gemini Omni Flash. Sem conta separada no Google AI Studio, sem credenciais do Vertex AI, sem segundo painel de faturação.

Referência de Modelos

Função Modelo Flag AnyCap
Geração de imagem Nano Banana 2 Lite --model nano-banana-2-lite
Geração de vídeo Gemini Omni Flash --model gemini-omni-flash-preview
Edição conversacional Gemini Omni Flash anycap video edit --model gemini-omni-flash-preview
Armazenamento e partilha AnyCap Drive anycap drive upload

O Pipeline Completo com Refinamento Conversacional

O passo de imagem para vídeo é apenas o começo. Depois de gerar a primeira versão do vídeo, o Gemini Omni Flash permite refiná-lo em linguagem natural:

# Generate keyframe
anycap image generate \
  --model nano-banana-2-lite \
  --prompt "SaaS feature launch: dashboard UI, highlighted new feature panel, professional dark mode" \
  -o feature-hero.jpg

# First video pass
anycap video generate \
  --model gemini-omni-flash-preview \
  --mode image-to-video \
  --param images=./feature-hero.jpg \
  --prompt "Smooth reveal of the feature panel, professional product demo pacing" \
  -o feature-v1.mp4

# Conversational refinement pass 1
anycap video edit \
  --input feature-v1.mp4 \
  --instruction "Slow the reveal slightly and add a brief pause at peak exposure of the panel" \
  --model gemini-omni-flash-preview \
  -o feature-v2.mp4

# Conversational refinement pass 2
anycap video edit \
  --input feature-v2.mp4 \
  --instruction "Warm the color grade and add a subtle vignette at the edges" \
  --model gemini-omni-flash-preview \
  -o feature-v3.mp4

# Upload final version
anycap drive upload feature-v3.mp4 --name "feature-launch-hero" --share

A direção criativa é descoberta e refinada através da edição conversacional — e o clipe final é entregue no Drive com uma ligação partilhável.

Um Script de Automação Completo para o Codex

Aqui está um pipeline de automação completo que um agente do Codex pode executar como passo pós-implementação:

#!/bin/bash
# Google-native Codex video pipeline
# Usage: bash google-pipeline.sh "feature name" "visual description"

FEATURE="$1"
VISUAL="${2:-clean SaaS dashboard, dark mode, minimal UI}"

echo "🖼️  Generating keyframe with Nano Banana 2 Lite..."
anycap image generate \
  --model nano-banana-2-lite \
  --prompt "${VISUAL}, professional product hero composition" \
  -o /tmp/keyframe.jpg

echo "🎬 Animating with Gemini Omni Flash..."
anycap video generate \
  --model gemini-omni-flash-preview \
  --mode image-to-video \
  --param images=/tmp/keyframe.jpg \
  --prompt "${FEATURE} feature reveal, smooth animation, professional product demo" \
  -o /tmp/v1.mp4

echo "✏️  Refining: slowing motion and warming tone..."
anycap video edit \
  --input /tmp/v1.mp4 \
  --instruction "Slow the reveal motion slightly and warm the color grade" \
  --model gemini-omni-flash-preview \
  -o /tmp/final.mp4

echo "☁️  Uploading to Drive..."
LINK=$(anycap drive upload /tmp/final.mp4 --name "${FEATURE}-launch-video" --share)
echo "✅ Done: ${LINK}"

Executa assim: bash google-pipeline.sh "analytics-v2" "SaaS analytics dashboard, data visualization cards"

O Codex aciona este script após cada implementação de funcionalidade — sem intervenção humana, devolvendo uma ligação de vídeo partilhável.

Quando Usar o Pipeline Google-Nativo vs Modelos Mistos

Usa o pipeline Google-nativo quando:

  • Queres coerência visual entre imagem e vídeo sem alinhamento de prompt entre fornecedores
  • Estás num fluxo de trabalho criativo iterativo onde a edição conversacional poupa tempo
  • Preferes minimizar o número de fornecedores de modelos no teu stack
  • Já usas o Nano Banana 2 Lite para outras tarefas de geração de imagem no Codex

Usa um pipeline misto quando:

  • Precisas do teto de qualidade mais alto do Veo 3.1 para entregas finais (usa o Nano Banana 2 Lite para o keyframe e o Veo 3.1 para o vídeo)
  • O clipe precisar de ter mais de 8 segundos (muda para o Kling 3 no passo de vídeo)
  • Precisas de fotorrealismo máximo para sujeitos humanos (Sora 2 Pro no passo de vídeo)

O pipeline Google-nativo não é a única resposta — mas é a mais limpa quando os modelos do Google já são o teu padrão.

FAQ

O que é o Nano Banana 2 Lite? O Nano Banana 2 Lite é o ID de modelo do AnyCap para o Gemini 3.1 Flash-Lite Image — o modelo de geração de imagem rápido e económico do Google. Pertence à mesma família de modelos do Gemini Omni Flash, tornando-o o parceiro natural para geração de imagem em pipelines Google-nativos no Codex.

Preciso de uma conta Google para usar este pipeline? Não. O AnyCap trata da autenticação para o Nano Banana 2 Lite e o Gemini Omni Flash. As tuas credenciais anycap existentes cobrem ambos os modelos sem necessidade de configurar o Google AI Studio ou o Vertex AI separadamente.

Como é a qualidade de imagem para vídeo em comparação com texto para vídeo? Imagem para vídeo com um keyframe do Nano Banana 2 Lite tende a produzir resultados mais consistentes e intencionais do que texto para vídeo puro, porque o keyframe fornece ao Gemini Omni Flash uma composição inicial exata para animar, em vez de interpretar toda a cena a partir de texto.

Posso usar um modelo de imagem diferente para o keyframe? Sim. Embora o Nano Banana 2 Lite seja o par Google-nativo, o Gemini Omni Flash aceita qualquer imagem como entrada — GPT Image 2, Seedream 5 ou qualquer ficheiro PNG/JPG. O pipeline Google-nativo é uma recomendação, não um requisito.

Como funciona a edição conversacional após imagem para vídeo? Exatamente da mesma forma que após texto para vídeo. Usa anycap video edit --input <previous-output.mp4> --instruction "...". O modelo aplica a alteração descrita ao clipe animado, mantendo o contexto original da cena do keyframe.

O Que Vem a Seguir