Curso
Muita gente dizia que 2025 seria o ano dos agentes de IA, mas, a três meses do fim, para mim está virando o ano da mídia gerada por IA, com lançamentos superpopulares como o Veo 3, o Nano Banana e agora o Sora 2.
Queria fazer uma análise completa do Sora 2, como fiz com o Veo 3, mas ainda não tenho acesso, mesmo assinando o ChatGPT Pro. Por enquanto, o acesso está sendo liberado devagar, com foco em quem entra por código de convite no novo app social Sora (já falo mais sobre isso).
Provavelmente a ideia é forçar mais usuários para lá, mas, na minha visão, isso já começa mal, porque imagino que muito mais gente esteja interessada em gerar vídeos com o Sora do que usar o app social.
A OpenAI tem bastante terreno para recuperar em relação ao combo Veo 3 + Nano Banana, do Google, e acho que começou com o pé esquerdo ao tornar o acesso dependente de ter um iPhone nos EUA ou no Canadá — até para quem já paga US$ 200 na assinatura do ChatGPT Pro.
Dito isso, vou fazer uma cobertura completa do que já sabemos sobre o Sora 2 (tanto o modelo quanto o novo app social) e — como a Meta também lançou o Vibes na semana passada, que basicamente é um feed de vídeos de IA — também vou comentar por que acho que as empresas de IA estão pisando fundo, de repente, em aplicações de mídia e entretenimento.
Mantemos nossos leitores por dentro do que há de mais recente em IA com o The Median, nossa newsletter gratuita de sexta-feira que resume as principais notícias da semana. Assine e fique por dentro em poucos minutos por semana:
O que é o Sora 2?
Sora 2 não é só um novo modelo de vídeo — também é o nome do mais recente app social da OpenAI. Então, quando alguém fala em Sora agora, pode estar se referindo a duas coisas diferentes:
- Sora 2, o modelo, que gera vídeo e áudio a partir de prompts em texto (parecido com o Veo 3); e
- Sora, o app social, uma nova plataforma para iOS, por convite, que permite remixar vídeos usando a imagem de outras pessoas, descobrir conteúdo em um feed e compartilhar clipes gerados por IA socialmente.
Os dois estão bem conectados, já que o app roda sobre o modelo Sora 2, mas têm objetivos diferentes. O modelo é a aposta da OpenAI em um sistema de geração de vídeo e áudio de uso geral. O app é um experimento do que acontece quando você envolve essa capacidade em uma camada social, de curtos formatos e focada em remix.
Vamos ver os dois em detalhes nas próximas seções. Mas vamos começar pela atração principal: o Sora 2 como modelo de vídeo.
Sora 2: o modelo de vídeo
A primeira coisa que notei no Sora 2 é que a equipe da OpenAI finalmente conseguiu saída de áudio nativa — que, até agora, era um dos maiores diferenciais do Veo 3. O Sora 2 consegue gerar diálogos, ambiência e efeitos sonoros junto com os visuais, sem precisar costurar nada depois.
Além disso, o modelo promete uma série de outras melhorias. Vamos passar por cada ponto e analisar criticamente alguns exemplos.
Mais fisicamente preciso
O Sora 2 supostamente entende melhor conceitos como peso, equilíbrio, permanência de objeto e causa e efeito. Se alguém erra um arremesso de basquete, a bola deve bater no aro e quicar — em vez de se teletransportar magicamente para a cesta, como vimos em modelos mais antigos. Vamos analisar este exemplo:
A dinâmica física parece bem convincente na maior parte do vídeo, mas, se você olhar os últimos frames (os últimos 0,5 segundo), vai ver que as pernas do skatista se esticam em uma forma impossível, quase deformando.
Quando o gato cai da cabeça do skatista, a queda parece sem peso e artificial. E, no finalzinho, o gato faz uma pirueta impossível.
Outro problema grande aqui é termos continuidade no áudio, mas falta de continuidade no vídeo. Ouvindo o locutor no microfone da arena, dá para deduzir que ação e tempo são contínuos, porque não há corte no som — mas o vídeo de 10 segundos é composto por três planos diferentes que claramente aconteceram em momentos distintos. Fica claro para mim que o Sora 2 ainda não tem noção sólida de princípios básicos de montagem.
Capaz de simular falhas
Outra melhoria sutil (mas muito útil) é que o Sora 2 agora consegue gerar erros realistas. Modelos mais antigos tendiam a renderizar ações bem-sucedidas — alguém sempre completa o salto, sempre marca o gol. O Sora 2 tenta simular a falha, o que é mais difícil do que parece. Para a IA, “errar” de forma realista muitas vezes exige um modelo interno mais profundo de física e comportamento humano.
Vamos ver um exemplo:
Eu, na verdade, gostei bastante deste vídeo; quase me convence de que a queda é real. O único ponto que quebra a ilusão é o equilíbrio impossível no final. Dá para discutir, mas acho que o homem deveria ter caído bem antes.
Ainda assim, a capacidade de gerar erros tem muito potencial. O caso de uso mais óbvio é quando você precisa filmar uma cena perigosa. Em vez de usar uma pessoa de verdade, talvez dê para tentar com IA, evitando complicações e reduzindo o orçamento.
Melhor continuidade
A OpenAI diz que o Sora 2 consegue obedecer prompts complexos em múltiplos planos mantendo o mesmo personagem, iluminação e estado geral do mundo. Então, se você pede para um homem de jaqueta vermelha entrar em um prédio, descer um corredor e pegar um jornal em uma mesa, a jaqueta deve continuar vermelha, o corredor deve se manter consistente e não deve surgir de repente dois jornais ou três braços.
Este é o exemplo mais relevante que encontrei para esse recurso:
Este exemplo reúne impressionantes seis planos em um único vídeo de 10 segundos. O que mais vende a continuidade é o som — a conversa de fundo, os fogos de artifício e os diálogos estão muito bem gerados. Não consigo julgar a semântica porque não entendo o idioma, mas, acusticamente, funciona.
No entanto, olhando com mais atenção os visuais, as coisas começam a confundir. A distância entre os personagens muda demais — às vezes estão longe, de repente estão de mãos dadas segundos depois. A câmera também quebra o eixo de um jeito meio aleatório, dificultando entender a geografia do espaço e a posição dos personagens.
Por outro lado, a consistência dos rostos está perfeita, então ponto para o modelo nisso. A iluminação também se mantém, e a gradação em preto e branco funciona em todos os planos.
Estilo flexível
A OpenAI afirma que o modelo alterna com fluidez entre estilos realistas, cinematográficos e animados — incluindo anime — preservando movimento e identidade. Isso é útil para criadores que querem um visual estilizado sem perder totalmente o controle da cena.
Preciso dizer: talvez este seja o exemplo de que mais gostei entre tudo o que mostraram. Há elementos que funcionam e outros que não, mas, em termos de narrativa, é uma cena muito bem construída, na minha opinião — sobretudo porque tem uma dinâmica emocional que funciona.
O mundo ao redor dos protagonistas é feliz: pessoas curtindo um tipo de festival noturno, fogos iluminando o céu, clima de celebração. Mas, no meio disso tudo, os dois personagens principais parecem estar tendo uma conversa difícil — dá a impressão de que estão à beira de um rompimento irreversível.
Não entendo o idioma, então não posso dizer com certeza o que estão falando, mas o tom emocional é claríssimo. A música é muito bem escolhida — levemente animada, em sintonia com o ambiente — e o close final, com os fogos refletidos nos olhos da personagem feminina, é o que sela a mensagem.
Se eu tivesse que reclamar de algo, é que as pessoas ao redor não se mexem. Mas isso também pode ser uma escolha intencional — estamos vendo um ponto de vista subjetivo, em que o mundo ao redor para por um momento porque eles estão tão imersos no próprio conflito que, subjetivamente, o exterior deixa de existir para eles.
Também recomendo dar uma olhada no nosso guia sobre um dos concorrentes mais fortes do Sora, o Seedance 2.0, da ByteDance.
Sora: o app social
Junto com o modelo, a OpenAI lançou um novo app para iOS chamado Sora, que adiciona uma camada social completa à experiência de geração de vídeos. Hoje, o app é a principal forma de acessar o Sora 2 — e, por enquanto, é só por convite e limitado a usuários dos EUA e do Canadá.
Imagino que a OpenAI queira ver o que acontece quando as pessoas começam a remixar o conteúdo umas das outras, se inserir em cenas e tratar o vídeo de IA mais como uma linguagem social. Se isso vai virar o próximo TikTok é outra história (acho que as chances são zero), mas a mecânica é interessante.
Como funciona o app social Sora
Na essência, o Sora é uma plataforma baseada em feed, feita para vídeo de IA remixável. Você rola por clipes curtos gerados por outros usuários, muitos dos quais incluem a imagem de pessoas reais por meio de um sistema chamado cameos (falo mais abaixo). Se quiser criar o seu, dá para escrever um prompt do zero ou remixar um vídeo existente usando o cameo de alguém — com a permissão da pessoa.
Você pode curtir, remixar, repostar ou seguir usuários como em qualquer outra rede. O feed é personalizado, mas a OpenAI diz que não está otimizando por tempo de exibição. Em vez disso, afirmam que o ajuste é para maximizar criação e inspiração, e adicionaram controles de bem-estar, incluindo limites diários de geração para adolescentes e controles parentais via ChatGPT.
O app também inclui um sistema de recomendações controlado por linguagem natural, ou seja, você direciona o tipo de conteúdo que quer ver em inglês simples (por exemplo, “show me funny videos with animals” ou “less surreal stuff”).
Recursos de cameo
Provavelmente é o recurso mais novo do app. Os cameos permitem gravar um clipe curto, único, de vídeo e áudio seu, que o modelo usa para gerar uma representação de corpo inteiro — voz, aparência, expressões e tudo. Depois que seu cameo é verificado e enviado, você pode se inserir em qualquer cena ou permitir que amigos remixem você nas deles.
A forma como a OpenAI apresenta isso é: você mantém o controle da sua imagem o tempo todo:
- Você decide quem pode usar seu cameo.
- Você pode revogar o acesso ou remover qualquer vídeo que inclua você.
- Você pode ver todos os vídeos (incluindo rascunhos) em que sua imagem aparece.
É um sistema inteligente, mas levanta várias questões — sobre consentimento, direitos autorais, moderação e como isso escala. A OpenAI diz que está formando equipes de revisão humana para identificar casos-limite, como bullying, e que permissões mais rígidas valem para usuários mais jovens.
Por que a corrida repentina por mídia gerada por IA?
Como apontou um relatório recente de Stanford, a IA ainda não transformou tantas indústrias — com uma exceção clara: mídia.

Fonte: State of AI in Business 2025 Report
Não acho que isso seja só ruído estatístico. Conversei diretamente com produtores de publicidade, e eles estão levando a mudança a sério. Muitos estão testando ativamente IA para reduzir custos de produção, acelerar prazos e evitar as dores de cabeça logísticas de filmar no set.
Dá para ver a mesma tendência em público. É só rolar o LinkedIn em qualquer dia para encontrar criadores postando curta-metragens, anúncios e trailers conceituais gerados por IA. Um bom exemplo é este anúncio da Kalshi — um anúncio real para uma empresa de verdade — inteiramente produzido com IA:
É por isso que acho que empresas como OpenAI, Google e Meta estão acelerando de vez na mídia gerada por IA. Se há um domínio em que a IA generativa já mostra utilidade — e onde as pessoas já estão gastando tempo e dinheiro — é aqui. Então faz sentido que os laboratórios estejam correndo para construir plataformas, ecossistemas e camadas sociais em torno de vídeo.
Na semana passada, a Meta lançou o Vibes, um novo feed de vídeos curtos gerados por IA, mirando o mesmo espaço do app Sora da OpenAI. O padrão é claro: capitalizar em mídia e entretenimento agora, enquanto a tecnologia ainda não está boa o suficiente para mexer de forma confiável com setores mais regulados, como saúde ou finanças.
Em resumo, vídeo é o fruto mais baixo do galho — e todo mundo quer colher primeiro.
Conclusão
Embora eu queira manter um olhar crítico, vale reconhecer o quanto esses modelos de IA evoluíram. Lembre que, no início de 2023, o melhor que tínhamos era o vídeo do Will Smith comendo espaguete . Agora estamos falando de áudio nativo, continuidade emocional e apps sociais de remix em que você pode se colocar em uma luta de espadas em um navio pirata ou em um programa de culinária surreal apresentado pelo seu cachorro.
Ainda assim, o Sora 2 continua sofrendo com coerência espacial, lógica básica de edição e realismo físico sutil. E a decisão da OpenAI de restringir o acesso por um app iOS, só por convite, não ajuda exatamente na reputação com usuários profissionais que buscam ferramentas sérias. Há potencial aqui, mas também há atrito.
De todo modo, está claro que mídia gerada por IA é o espaço para ficar de olho.
FAQs
Como faço para acessar o Sora 2 se tenho assinatura do ChatGPT Plus ou Pro?
Muitos usuários no X e no Reddit que já assinam a OpenAI estão frustrados com a liberação em fases, que prioriza heavy users do Sora 1 antes de expandir para os planos Plus e Pro. Se você é Pro, confira uma notificação push no app do ChatGPT ou acesse sora.com para fazer login — o acesso deve liberar gerações ilimitadas em 720p/10s em breve, com o Pro destravando o modo 1080p/20s "Sora 2 Pro". Usuários Plus recebem vantagens parecidas, mas com possíveis filas; o plano gratuito tem testes generosos porém limitados. Se ainda não chegou convite, é por alta demanda — espere ondas ao longo da próxima semana, começando nos EUA e no Canadá antes de expandir globalmente.
Quais são os limites de geração e os preços do Sora 2?
Limites de uso são tema quente, com postagens no X chamando de vaga a promessa de "limites generosos"; usuários free encaram intervalos (ex.: uma geração a cada 15 minutos), enquanto o Plus oferece gerações padrão ilimitadas e o Pro adiciona saídas mais rápidas e em resolução maior, sem tetos. Tópicos no Reddit especulam que os custos de computação mantêm vídeos mais longos (acima de 20s) como recurso premium, mas sem paywalls rígidos por enquanto — o lançamento é gratuito, com upgrades pagos para extras como renders em lote. Acompanhe seu painel para cotas em tempo real, pois estão ajustando conforme o uso.
O Sora 2 está disponível fora dos EUA e do Canadá?
O app para iOS e o acesso completo foram lançados primeiro nos EUA/Canadá em 30 de setembro de 2025, mas a OpenAI planeja uma expansão global rápida — usuários na UE relatam acesso beta via ChatGPT Pro, embora com possíveis soluções de VPN para baixar o app. Verifique o status do seu país no help center da OpenAI; atrasos decorrem de leis de privacidade de dados, mas a maioria das regiões deve receber em semanas.
Como o Sora 2 se compara a concorrentes como o Veo 3 ou o Runway?
Threads no X comparam com o Veo 3 do Google (mais forte em duração bruta) e com o Runway (melhores ferramentas de edição), mas o Sora 2 vence em precisão física, consistência de personagens e áudio integrado — usuários dizem que parece um "simulador de mundo" para histórias coerentes. Análises no Reddit apontam que o Veo leva vantagem em 4K, mas a controlabilidade do Sora (multi-planos, estilos) e o app social o tornam mais divertido/fácil de usar. Pontos fracos? Renders mais lentos e limite de 720p por enquanto. No geral, é o estado da arte em realismo, mas a disputa é apertada — teste os demos para avaliar.
Sou editor e redator de blogs, tutoriais e notícias sobre IA, garantindo que tudo se encaixe em uma estratégia de conteúdo sólida e nas práticas recomendadas de SEO. Escrevi cursos de ciência de dados em Python, estatística, probabilidade e visualização de dados. Também publiquei um romance premiado e passo meu tempo livre escrevendo roteiros e dirigindo filmes.



