
A inteligência artificial está mudando não apenas as ferramentas do audiovisual, mas também a dimensão das equipes necessárias para produzir imagens cada vez mais sofisticadas. Processos que até pouco tempo exigiam estruturas complexas começam a caber nas mãos de um único realizador.
Gabriel Pitsch Sehn é filmmaker, VFX artist e especialista em 3D. Certificado pela Adobe em Photoshop, Premiere e After Effects, também é piloto de drone certificado pela ANAC. À frente da Budo Visuals, desenvolve trabalhos que combinam motion, efeitos visuais, 3D e técnicas como Gaussian Splatting.
Mas talvez o aspecto mais interessante de seu trabalho esteja menos nas ferramentas utilizadas e mais na maneira como elas são colocadas a serviço da narrativa. Em nossa conversa, Gabriel fala sobre seu processo de criação, os problemas de continuidade ainda presentes na inteligência artificial, as ferramentas que utiliza e as transformações que observa no mercado audiovisual.
Uma frase dita por ele durante a entrevista acabou dando título a esta matéria: “Vídeo bonito todo mundo faz.” Para Gabriel, o desafio está em produzir algo que emocione, provoque reflexão e, principalmente, conte uma história.

Gabriel, como começou tua relação com o audiovisual e em que momento a inteligência artificial entrou no teu processo de criação?
Minha relação com o audiovisual começou há muitos anos. Sempre tive muito contato com o cinema, sempre fui apaixonado pela sétima arte e tive interesse em saber como os filmes eram feitos. Muitas vezes, o que mais me atraía nem era o filme em si, mas o processo de criação, o making of.
Quando gostava de um filme, procurava incessantemente os making ofs para saber como toda aquela magia acontecia. Isso foi formando uma bagagem e, aos poucos, fui me inserindo nos programas de edição. Edito vídeos desde a época do Windows Movie Maker. Depois passei pelo Sony Vegas e tive muito contato também com o Nero — quem é das antigas conhece bem. A gente usava para transcodificar arquivos, exportar em outros formatos e fazer cópias para CDs.
Essas interfaces de programas e softwares de edição sempre foram muito familiares para mim. Depois vieram Wondershare Filmora, Movavi, Final Cut, até que estudei mais profundamente e obtive minhas certificações Adobe, em 2008 e 2009, em Photoshop, After Effects e Premiere.
Foi um processo constante de evolução e estudo, embora eu não trabalhasse diretamente na área, porque minha vida profissional acabou tomando outro caminho. Fui consultor de grandes empresas, diretor comercial, me formei em Administração, fiz pós-graduação em gestão de grandes empresas e minha carreira se direcionou para consultoria e investimentos.
Agora o audiovisual está retornando à minha vida como um processo de readaptação, de reset. Tive que resgatar muitos dos conhecimentos adquiridos ao longo dos anos e, ao mesmo tempo, me reinventar e estudar. Enquanto recupero coisas que já sabia, estou entrando em um mundo novo, no qual existem muitas outras ferramentas, como a própria inteligência artificial. Não tive apenas que relembrar conceitos de cinematografia, mas também me adaptar a todo esse novo ambiente que estava se formando.
Quando assistimos aos teus trabalhos, chama a atenção o fato de uma produção visual bastante sofisticada poder ser realizada por uma estrutura muito pequena. Hoje, até onde uma única pessoa consegue chegar trabalhando com IA?
Essa é uma pergunta excelente, mas eu não considero que a estrutura em si seja pequena. Temos mecanismos e ferramentas que oferecem possibilidades que antes não tínhamos, mas que ainda assim se baseiam muito na nossa criatividade.
Quando vemos obras como as que tenho feito — inclusive essa última, que teve grande repercussão, com pessoas comentando que se emocionaram, foram tocadas e choraram — percebemos não apenas a importância de saber utilizar bem a ferramenta, mas também de ser criativo e ter planejamento para construir uma sequência de acontecimentos capaz de gerar emoção.
O cinema é pautado nisso. Quando um cineasta ou uma equipe de produção se propõe a fazer um filme, quer transmitir uma mensagem. Um filme de terror precisa amedrontar; um suspense precisa provocar certo desconforto; um filme de ação precisa proporcionar emoção e adrenalina. Quando o filme consegue transmitir isso ao espectador, podemos dizer que seu objetivo foi cumprido.
Acredito que meus vídeos sejam uma demonstração — entre muitas outras, porque há muita gente boa no mercado — de que uma pessoa sozinha pode, sim, fazer algo muito próximo do cinema. Para mim, esse mercado já se consolidou e é um caminho sem volta. E as possibilidades ainda irão muito além conforme a tecnologia avançar.
Hoje já é possível alcançar uma qualidade cinematográfica muito semelhante à oferecida por grandes produções, com trabalhos realizados por uma única pessoa.
Mas todo esse poder computacional e avanço tecnológico perde valor quando cai nas mãos de alguém que não sabe utilizá-lo tecnicamente ou que não tem uma história para contar. O que vemos muito são prompts jogados ao vento. Ao rolar o feed, encontramos muitos vídeos feitos com inteligência artificial, mas poucos com profundidade, densidade de roteiro, emoção e clímax — algo que realmente transmita uma mensagem e conte uma história.
Uma pessoa pode chegar muito longe trabalhando com IA, mas nada disso terá valor se ela não estudar, não se aprofundar e não estiver constantemente atualizada nesse ambiente. A evolução é semanal. Toda semana uma IA avança para uma nova versão ou surgem novas ferramentas. Acompanhar tudo isso já é, por si só, um grande desafio.
E é preciso usar a criatividade para não fazer apenas prompts simples e vídeos que qualquer pessoa poderia produzir, mas contar uma história que realmente tenha profundidade.
Como nasce um trabalho teu? Você parte de uma ideia, escreve um roteiro, cria um storyboard, pensa primeiro nas imagens? Como é teu processo até chegar ao vídeo final?
Todo trabalho precisa nascer de uma ideia. Sou muito alimentado por referências da cinematografia. Assisto a muitos vídeos e séries e passo o dia inteiro ouvindo música. Às vezes, uma música por si só já me traz uma ideia.
Quem tiver uma percepção visual e sonora mais atenta aos meus últimos vídeos perceberá que a música nunca é escolhida ao acaso. Ela tem um propósito dentro da narrativa e daquilo que quero transmitir.
Às vezes as ideias aparecem enquanto estou lavando louça ou fazendo alguma atividade cotidiana, quando a cabeça começa a divagar. Sempre tomo nota das ideias que podem me levar a algum lugar.
Toda obra, portanto, parte de uma ideia. Mas essas ideias normalmente vêm em pedaços, fragmentos aos quais preciso dar uma sequência lógica para que façam sentido. Da ideia nasce o roteiro; do roteiro, o conceito estético.
Procuro sempre mudar a estética dos meus vídeos. Nunca sigo um padrão: às vezes faço algo mais realista, outras vezes uma animação ou utilizo uma estética mais “suja”. Procuro me desafiar nesse sentido.
A partir do roteiro começo a conceber e gerar as imagens, usando prompts elaborados para definir o conceito estético e visual. Com essas imagens, monto uma sequência lógica e começo a gerar os vídeos.
Para isso, desenvolvi ferramentas que me ajudam no processo, as skills. Os prompts são executados dentro do Claude, por meio dessas skills, que utilizam codificações e uma gramática baseada no cinema. Tenho ali elementos de câmera, enquadramento, concepção visual, cor, ação e movimentação de câmera para produzir o melhor prompt possível para cada trecho.
Mesmo assim, encontro muitos obstáculos. A IA evoluiu muito, mas ainda é bastante passível de erro. Sou extremamente detalhista: se aparece alguma coisa que cai no chamado “vale da estranheza”, um movimento que não condiz com a física ou um cenário que muda de uma cena para outra, procuro corrigir.
É aí que entram ferramentas tradicionais como Premiere e After Effects. Faço pós-produção para corrigir imperfeições e acrescentar elementos que a IA não permite inserir.
Depois vem a sonorização. Embora algumas IAs já produzam vídeos com som, considero esse áudio ainda muito artificial. Por isso, trilhas, efeitos sonoros, foley e ambiências são criados, mixados ou retirados de uma grande biblioteca que construí ao longo dos anos. Quando não encontro o que preciso, eu mesmo gravo com microfone e edito.
Só então considero a obra concluída. É um processo detalhado e demorado. Dependendo da produção, levo de três dias a uma semana. Já houve trabalho de quase sete minutos no qual foram necessárias mais de 60 horas.
É um processo bastante meticuloso, ao contrário do que muita gente imagina quando pensa que tudo se resolve com um prompt.
Quais ferramentas de inteligência artificial fazem parte hoje do teu fluxo de trabalho e o que você procura em cada uma delas? Há alguma que tenha mudado significativamente tua maneira de produzir?

As principais ferramentas do meu workflow são as de geração de imagens e vídeos, além de algumas complementares.
Para imagens, transito entre ChatGPT, Nano Banana e Seedream, escolhendo aquela que oferece o melhor resultado para servir de base à composição final e à geração do vídeo.
Para vídeo, atualmente utilizo Seedance 2.0 e Seedance 2.5. Embora a versão 2.5 pareça mais avançada, considero sua pipeline um pouco quebrada e seu comportamento mais errático que o da 2.0.
Uso bastante o Suno para composição de trilhas e efeitos sonoros. Outra ferramenta que considero indispensável é o Claude Code, que é a base do meu processo para elaborar roteiros mais detalhados, colocar ideias em prática e gerar prompts utilizando minhas skills, alcançando maior assertividade cinematográfica.
Uma ferramenta que mudou bastante meu fluxo de trabalho foi o próprio Seedance, principalmente pela capacidade de lidar com ambientes e com a geografia do espaço onde inserimos personagens e situações.
Antes utilizava o Kling, que avançou para a versão 3.0. Ele oferecia maior assertividade quando trabalhávamos com start frame e end frame, mas costumava errar mais quando delegávamos à ferramenta o movimento de câmera dentro de ambientes detalhados. O Seedance melhorou isso consideravelmente e tornou o fluxo mais ágil, embora também tenha aumentado o custo de produção pelo consumo de créditos.
Quando quero uma estratégia estética diferente ou mudar completamente a concepção visual de um vídeo, o Midjourney é indispensável. Para mim, ele não é a melhor ferramenta quando buscamos precisão, mas, quando precisamos de uma estética diferente e de um concept art bem definido e característico, é fundamental.

Teu trabalho também envolve ferramentas tradicionais, como After Effects e Premiere, além de 3D, drone e técnicas como Gaussian Splatting. Onde termina o trabalho da IA e começa o trabalho do artista? Ou essa divisão já perdeu o sentido?
Hoje misturo bastante técnicas tradicionais de edição. Uso After Effects na pós-produção; Premiere na montagem e sonorização; e, dependendo do projeto, técnicas de Gaussian para a tridimensionalização de ambientes.
Para mim, não existe um ponto onde termina o trabalho da IA e começa o trabalho do artista. O artista está envolvido o tempo todo.
Uma IA, por mais avançada que seja, se for mal utilizada, não vai transmitir absolutamente nada. A IA pode facilitar o processo, mas é necessário um artista por trás para dar sentido àquilo e produzir impacto visual.
Qualquer pessoa pode pegar um prompt e fazer um vídeo bacaninha. Como digo para minha comunidade e para meus alunos: vídeo bonito todo mundo faz. Agora, um vídeo que emociona, faz a pessoa refletir, homenageia alguém, conta uma história e possui uma lógica, poucas pessoas estão fazendo.
Essas pessoas, para mim, são artistas. Por isso, dividir onde começa um e termina o outro não faz sentido. O artista está envolvido durante todo o processo criativo.
Um dos problemas que percebo na produção com IA é manter continuidade entre personagens, cenários, iluminação e movimentos de uma cena para outra. Como você enfrenta essa questão nos teus trabalhos?
Esse é um dos grandes problemas da IA. Ela é errática e tem dificuldade em entender padrões de continuidade — o que chamamos de consistência — não apenas nos personagens, mas também nos ambientes.
Para chegar a um nível em que isso seja imperceptível, existe todo um trabalho de pré-produção que exige, muitas vezes, gerar vários frames de uma mesma sequência para evitar que a IA se perca.
Sempre digo aos meus alunos que, quanto mais tempo de vídeo delegarmos para a IA criar, maior será a possibilidade de ela se perder.
Um exemplo prático: em uma sequência de 15 segundos, é mais fácil manter o controle fazendo três vídeos de cinco segundos do que um único vídeo de 15 segundos.
Com o Seedance 2.5, que permite vídeos de até 30 segundos, bato muito nessa tecla. Por mais extensivo e detalhado que seja o prompt, a probabilidade de a ferramenta se perder em algum momento ou gerar algo indesejado durante esses 30 segundos é muito grande.
Prefiro dividir em três sequências de dez segundos ou em sequências menores, de cinco, oito ou dez segundos. Dessa maneira temos muito mais controle efetivo sobre aquilo que acontece em cena, tanto com os personagens quanto com os ambientes.
Há quem veja a IA como uma ameaça às profissões do audiovisual e quem a veja como uma nova ferramenta de criação. Pela tua experiência profissional, o que realmente está mudando no mercado e que habilidades continuarão importantes para quem quiser trabalhar nessa área?
É natural que as pessoas vejam algo nocivo no novo, seja uma tecnologia ou uma ideia. Quando a internet surgiu, muita gente também acreditava que ela representaria uma ameaça.
Acredito que estamos passando novamente por esse processo. Muitas pessoas não querem se adequar ou perceber que é preciso se readaptar. Quem se adapta mais facilmente e enxerga uma possibilidade de evolução profissional tende a avançar mais rapidamente.
Primeiro existe a fase da negação, depois a aceitação e, finalmente, a adaptação. Há muita gente que já entendeu a importância da IA no trabalho e na vida, mas ainda não começou a estudar.
O impacto no mercado já chegou. Na minha visão, quem não perceber isso poderá enfrentar dificuldades para se manter em determinadas funções, e existem profissões que já podem ser completamente substituídas pela inteligência artificial.
Acredito que irão permanecer aqueles que compreenderem esse avanço, estudarem e procurarem aplicar e testar essas tecnologias. Entre as habilidades fundamentais estão aprendizado e adaptabilidade: conseguir estudar rapidamente os novos conceitos, acompanhar o que está acontecendo e não rejeitar uma ferramenta simplesmente porque sua proposta inicialmente parece absurda.
As coisas estão avançando muito rapidamente. Já existem empresas criando departamentos inteiros baseados em IA, inclusive em grandes corporações, principalmente na área de marketing.
Negar essas transformações, na minha opinião, poderá trazer consequências profissionais importantes.
Para alguém que está começando hoje e quer produzir animação ou audiovisual com IA, qual seria teu conselho? O que vale a pena aprender primeiro — e que erro você recomendaria evitar?
Para quem está começando hoje, é muito importante tomar cuidado com aquilo que consome, principalmente conteúdo de influencers. Existe um marketing muito agressivo em torno dessas ferramentas e muitas não fazem aquilo que prometem. Esse marketing apelativo pode direcionar mal quem está entrando agora no mercado.
Primeiro é importante entender o conceito básico de um prompt: como fazer uma solicitação e escrever em linguagem natural. Depois, aos poucos, avançar para prompts mais complexos. Mas, antes de tudo, é preciso entender onde se quer chegar com aquela ferramenta.
Muitas pessoas me procuram dizendo que querem fazer vídeos como os meus. Então pergunto: você quer fazer esses vídeos para atender clientes, fechar projetos e contratos com marcas? Quer viver disso? Ou simplesmente quer produzir conteúdo e memes para a internet sem objetivo financeiro?
São perguntas importantes que muita gente não faz. Algumas pessoas já estão assinando plataformas e comprometendo parte significativa do salário ou do cartão de crédito com suítes de IA para produzir imagens e vídeos bonitos sem ganhar nada com isso e, principalmente, sem saber onde querem chegar.
Um erro que recomendo evitar é justamente usar IA sem propósito.
A pessoa quer melhorar seu fluxo de trabalho? Automatizar a gestão de seu negócio? Tornar-se uma produtora audiovisual? Trabalhar com marketing? Saber o caminho que pretende trilhar também ajuda a decidir o que precisa aprender primeiro.
Existe hoje um universo gigantesco de ferramentas. Quem pretende trabalhar com vídeo, produção audiovisual, animação ou criação de personagens naturalmente deverá prestar atenção às IAs generativas: aprender a utilizar um ChatGPT, um gerador de imagens e depois transformar essas imagens em vídeo.
Chegar ao ponto de combinar várias ferramentas para contar uma história exige uma curva de aprendizado relativamente longa. Não acontece em uma semana ou um mês.
Por isso, é possível começar desenvolvendo prompts básicos para gerar uma imagem dentro de um conceito preestabelecido e depois aprender a transformar essa imagem em movimento. Mas tudo isso precisa ter um propósito.
Antes de entrar na corrida pelas ferramentas, portanto, vale fazer uma reflexão: o que vou fazer com a IA? Para onde quero ir? O que preciso melhorar na minha profissão ou no meu fluxo de trabalho?
Ter essas respostas ajuda não apenas a definir uma direção, mas também a escolher em quais ferramentas realmente vale a pena concentrar os estudos.

Link para o curso: https://budovisuals.com/budoskill/
