a tese
Tutorial do All About AI montando um "stream infinito" de vídeo gerado por IA em tempo real: usando uma versão fast do modelo Minimax H3, o autor transmite ao vivo no Twitch uma animação estilo "Family Guy" que os espectadores redirecionam pelo chat.
aprofundar
não
Tutorial prático de infraestrutura de geração de vídeo, sem substância conceitual; interessa só a quem quer montar o pipeline, não rende análise para o Bruno.
O que foi dito
- A ideia é gerar clipes de 15 segundos em cerca de 13 (em dois GPUs Nvidia B200 a 480p via RunPod), o que permite tocar um clipe enquanto o próximo é renderizado, sustentando um fluxo contínuo.
- O modelo de linguagem “Luna” (OpenAI) conduz a história de forma autônoma, mas prompts de espectadores no chat (com ponto de exclamação) têm prioridade e desviam o enredo.
- O autor usa o Codex para escrever o pipeline (fila, memória da história, envio ao H3, playback via FFmpeg no Twitch) e o patrocinador SER API para dar contexto de busca (Google/YouTube) a um agente que ele monta em paralelo para analisar o earnings da Nvidia.
- Demonstra ao vivo: sobe os GPUs, carrega ~132 GB de pesos, gera clipes e injeta prompts (Peter e Brian pegam avião para Paris, Peter vira ator de Hollywood), mostrando a incoerência cômica típica de texto-para-vídeo sem image-to-video.
- Faz a ressalva de custo: o gargalo é o preço, cerca de US$ 14/hora a 480p e US$ 100+/hora a 720p com oito B200s, inviável para rodar 24/7 sem financiamento, além do risco de banimento no Twitch.
- Conclui que o formato de stream de IA interativo tende a se popularizar, limitado pela disponibilidade de compute.