Análise do gerador de vídeo PixVerse e guia do V6
Esta análise do pixverse-video-generator cobre o PixVerse V6, o atual modelo principal lançado pela AIsphere em 30 de março de 2026 (blog PixVerse, 2026). O V6 oferece clipes nativos em 1080p, áudio nativo em uma única passagem, texto na imagem em vários idiomas e mais de 20 controles de câmera cinematográficos. É o modelo atual, não uma versão obsoleta.
Declaração prévia: esta análise é construída com base na documentação oficial da PixVerse e em testes da comunidade publicados no Reddit e no Trustpilot. A PixMind não executou esses clipes nós mesmos. A empresa controladora é a AIsphere, fundada em Pequim em 2023 por Wang Changhu, ex-líder de visão computacional da ByteDance. Uma Série C em julho de 2026 elevou o financiamento total a US$ 439 milhões, com avaliação acima de US$ 2 bilhões (TechCrunch, 2026). A AIsphere agora tem sede em Singapura.
Pontos principais
- O PixVerse V6 é o modelo principal atual (30 de março de 2026); o C1 é um modelo irmão cinematográfico, não um substituto.
- O financiamento total da AIsphere chegou a US$ 439 milhões em julho de 2026, com avaliação acima de US$ 2 bilhões (TechCrunch, 2026).
- O V6 em 1080p com áudio custa 23 créditos/seg, então um clipe de 5 s fica em cerca de US$ 23 na taxa base.
- O V2.x foi descontinuado em 2026. Trate qualquer tutorial de V2.x como desatualizado.
Abrir a ferramenta PixVerse na PixMind
O que é o PixVerse?
O PixVerse é a linha de produtos de vídeo com IA da AIsphere, conhecida em chinês como 北京爱诗科技 ou Beijing Aishi Technology. Wang Changhu e Jaden Xie fundaram a empresa em Pequim em 2023 e hoje ela está sediada em Singapura (TechCrunch, 2026). O histórico de Wang em visão computacional na ByteDance aparece na força do PixVerse em coerência de movimento e continuidade de personagens.
A linha de modelos vai de V2 (julho de 2024) para V2.5, V3.5, V4 (fevereiro de 2025), V4.5, V5, V5.5, V5.6, até V6 (30 de março de 2026, modelo principal atual). C1 (7 de abril de 2026) é um modelo irmão cinematográfico, não um substituto. R1 é lançado como nível em tempo real (janeiro de 2026). O V2.x foi descontinuado em 2026, então qualquer tutorial ancorado na saída do V2.x está desatualizado.
[GRÁFICO: Linha do tempo do lineage de modelos do PixVerse — V2 (jul. 2024), V2.5, V3.5, V4 (fev. 2025), V4.5, V5, V5.5, V5.6, V6 (30 mar. 2026, modelo principal atual), C1 (7 abr. 2026, modelo irmão cinematográfico), R1 (jan. 2026, tempo real) — fonte: pixverse.ai/blogs + PR Newswire]
[INSIGHT EXCLUSIVO] O status de "atual" aqui importa mais do que o normal. Midjourney, Veo e Imagen tiveram, cada um, uma transição em 2026 em que a versão mais antiga perdeu acesso à API ou foi redirecionada. O PixVerse V6 não. Você pode iniciar um projeto hoje sem um prazo de migração pairando sobre ele, o que é raro para um lançamento de 2026.
O fornecedor afirma mais de 100 milhões de criadores em 175 países. Trate isso como um número de marketing autorreportado, não como um valor auditado de forma independente. O financiamento total de US$ 439 milhões e a avaliação acima de US$ 2 bilhões dão ao PixVerse fôlego financeiro que a maioria das startups chinesas de vídeo com IA não tem (TechCrunch, 2026).
Transforme um clipe de referência em um prompt reutilizável
Gerador de vídeo PixVerse: recursos principais
Os recursos de destaque do V6 começam com saída nativa em 1080p e clipes de 1 a 15 segundos. Ele pode produzir curtas-metragens com vários planos a partir de um único prompt, com áudio nativo em uma passagem (blog PixVerse, 2026). O modelo também traz mais de 20 controles de câmera cinematográficos, texto na imagem em vários idiomas e Character Lock para referência de várias imagens.
Curtas-metragens com vários planos a partir de um prompt
O V6 consegue encadear planos de um único prompt em um curta-metragem. Versões mais antigas do PixVerse geravam um clipe por prompt. O V6 planeja sozinho os cortes entre os planos, o que importa para storyboards, anúncios e reels sociais.
Usuários do Reddit relatam que a consistência de vários planos no V6 é mais fraca do que no modelo irmão C1 (reddit.com/r/PixVerse, 2026). O C1 foi ajustado para continuidade cinematográfica. O V6 foi ajustado para amplitude de controle. Escolha o modelo que corresponde à sua carga de trabalho.
Áudio nativo e mais de 20 controles de câmera
O áudio nativo gera áudio e vídeo em uma única passagem. Isso elimina a etapa de dublagem para diálogos, som ambiente e efeitos sonoros. Tópicos do Reddit r/PixVerse descrevem o áudio como "cru, exige várias tentativas", então planeje refazer os clipes até que funcione.
Os mais de 20 controles de câmera cobrem dolly, pan, tilt, zoom, órbita, grua e mudança de foco. Você pode encadear movimentos dentro de um único prompt, onde o V6 se distancia de concorrentes que expõem apenas um movimento por clipe.
Character Lock e texto multilíngue
O Character Lock permite alimentar várias imagens de referência do mesmo sujeito. O V6 mantém o rosto e o figurino entre os planos, o recurso que agências de publicidade e cineastas de curta-metragem buscam primeiro. O texto multilíngue na imagem lida com inglês, chinês e outros sistemas de escrita importantes, o que importa para trabalho de cartazes e anúncios.
Cinematic shot, 1080p, 5 seconds: woman in red jacket walks through neon-lit
Tokyo alley at night, rain on pavement, dolly-in from medium to close-up,
ambient rain audio, in-frame neon sign reads "OPEN 24 HRS",
Character Lock reference: character_ref_01.png
[EXPERIÊNCIA PESSOAL] Em nossa experiência analisando ferramentas de vídeo com IA para fluxos de trabalho da PixMind, o vários-planos com um único prompt é o recurso que mais vale a pena testar sob estresse antes de confiar nele para uma entrega a um cliente. Execute o mesmo prompt três vezes, conte com que frequência o figurino do personagem se mantém entre os cortes e então decida.
[IMAGEM: Exemplo lado a lado de dois clipes em 1080p do PixVerse V6 mostrando o Character Lock mantendo o rosto do sujeito e a jaqueta vermelha em dois planos diferentes na mesma sequência de prompt. Termos de busca: "pixverse v6 character lock multi-shot example"]
Efeitos, modelos e a CLI
O V6 herda o ecossistema de efeitos e modelos do PixVerse, uma das bibliotecas mais amplas de vídeo com IA em 2026. Uma CLI é lançada junto com a interface web, com compatibilidade com Claude Code, Codex, Cursor e OpenClaw. Isso importa se você constrói pipelines que scriptam jobs de render a partir de uma fonte de prompts.
Especificações: resolução, duração, proporções de tela
O V6 produz 1080p de forma nativa e chega ao 4K pelo modo Upscale, a +5 créditos por segundo (docs.platform.pixverse.ai, 2026). A duração do clipe varia de 1 a 15 segundos. As proporções de tela cobrem 9:16, 16:9, 1:1 e 21:9. A taxa de quadros é relatada até 30 FPS, embora esse número não esteja na documentação oficial e venha de testes da comunidade.
| Especificação | V6 |
|---|---|
| Resolução nativa | 1080p |
| Resolução máxima | 4K via Upscale (+5 créditos/seg) |
| Duração do clipe | 1 a 15 segundos |
| Proporções de tela | 9:16, 16:9, 1:1, 21:9 |
| Taxa de quadros | até 30 FPS (não em docs oficiais) |
| Modos | Text-to-Video, Image-to-Video, Transition, Extend, Fusion |
A proporção 21:9 é o diferencial para trabalho de anúncios e trailers. A maioria dos modelos de vídeo de 2026 para no 16:9. O PixVerse é um dos poucos que oferece saída anamórfica de forma nativa, o que poupa uma etapa de letterbox na pós-produção.
Clipes da camada gratuita têm marca-d'água. As camadas pagas a removem, embora detalhes exatos da política de marca-d'água não estejam na documentação oficial e possam diferir entre o app ao consumidor e a API.
Preços do gerador de vídeo PixVerse
Os preços funcionam num sistema de créditos com uma taxa base de US$ 1 equivale a 5 créditos (docs.platform.pixverse.ai, 2026). V6 Text-to-Video e Image-to-Video em 1080p sem áudio custam 18 créditos por segundo. Adicionar áudio nativo eleva isso a 23 créditos por segundo. Na taxa base, um clipe de 5 s do V6 em 1080p com áudio custa 115 créditos, ou cerca de US$ 23.
| Modo | Resolução | Áudio | Créditos/seg |
|---|---|---|---|
| V6 T2V / I2V | 360p | não | 5 |
| V6 T2V / I2V | 1080p | não | 18 |
| V6 T2V / I2V | 1080p | sim | 23 |
| C1 | 1080p | não | 19 |
| C1 | 1080p | sim | 24 |
| Upscale | até 4K | n/a | +5 |
| Complemento SFX | n/a | sim | +2 |
| Complemento Lip sync | n/a | sim | +4 |
[INSIGHT EXCLUSIVO] Publicações antigas da era V5 citam um valor de "US$ 0,30 a US$ 0,45 por vídeo" que não se sustenta no V6 1080p. Esse número vinha de saídas em 360p sem áudio. O custo honesto por vídeo no V6 1080p com áudio está mais próximo de US$ 23 por 5 segundos, não quarenta centavos. Se você vir o número antigo num tutorial, está desatualizado.
As assinaturas da API reduzem o custo efetivo por clipe. A Essential custa US$ 100 por mês por 15.000 créditos. A Scale custa US$ 1.500 por mês por 239.230 créditos. A Business custa US$ 6.000 por mês por 1.069.500 créditos. Os pacotes pré-pagos variam de US$ 10 por 1.000 créditos a US$ 5.000 por 500.000 créditos.
Gerações com falha ainda consomem créditos. Essa é uma linha de custo real no V6, especialmente com áudio nativo, em que a saída áspera da primeira passagem significa mais reprises.
[GRÁFICO: Gráfico de barras comparando o custo por segundo do V6 — 360p sem áudio 5 créditos, 1080p sem áudio 18 créditos, 1080p com áudio 23 créditos, C1 com áudio 24 créditos — fonte: docs.platform.pixverse.ai]
Como acessar o PixVerse gratuitamente
Há três caminhos reais de acesso. O app ao consumidor do PixVerse em pixverse.ai tem uma camada gratuita com créditos diários. A alocação exata de créditos diários fica presa ao app atual e as fontes divergem quanto ao número. Confira pixverse.ai para o valor em tempo real, em vez de confiar numa afirmação estática de blog.
O segundo caminho é o wrapper da PixMind em /pixverse-video. Ele expõe o V6 por meio de uma interface de navegador sem configuração de API. Essa é a rota que recomendamos para usuários iniciantes que querem avaliar o modelo antes de se comprometer com um plano pago.
O terceiro caminho é fal.ai, que hospeda o V6 para desenvolvedores que querem acesso à API sem uma assinatura do PixVerse. A precificação do fal.ai segue sua própria programação de tokens, então compare com a taxa oficial de créditos antes de se comprometer.
A saída da camada gratuita tem marca-d'água. As camadas pagas a removem, e o app ao consumidor e a API tratam a política de marca-d'água de forma diferente. Planeje fazer upgrade antes de entregar trabalho a clientes, já que clipes com marca-d'água não são entregáveis na maioria dos contextos comerciais.
PixVerse versus outros modelos de vídeo com IA
Não existe benchmark de Nível 1 que classifique o V6 lado a lado contra Runway, Veo 3.1, Sora 2, Kling 3.0 e Seedance 2.5. Trate a comparação abaixo como qualitativa, extraída de testes da comunidade e rankings de arenas. Note que a API do Veo 3 foi desativada em 30 de junho de 2026, então qualquer comparação com Veo deve usar o Veo 3.1.
Versus Runway: o Runway é mais forte em direção de câmera explícita e controle no nível de keyframe. O V6 vence na amplitude de prompts e em produzir um clipe utilizável a partir de uma frase com menos ajuste manual. Escolha Runway para storyboards precisos. Escolha V6 para velocidade de ideação.
Versus Veo 3.1: o Veo 3.1 lidera em movimento cinematográfico e realismo. O V6 compete em preço e na proporção de tela 21:9 que o Veo não oferece nativamente. O acesso somente pago do Veo também empurra criadores atentos ao orçamento em direção ao V6.
Versus Sora 2: o Sora 2 lidera em realismo narrativo, mas é pago e restrito. O V6 é a opção mais acessível para testar sem compromisso de assinatura, o que importa para a exploração criativa em estágio inicial.
Versus Kling 3.0: o Kling vence em velocidade e em clipes de formato mais longo. O V6 vence na integração de áudio e no ecossistema de efeitos e modelos, mais desenvolvido do que o do Kling no momento da publicação.
Versus Seedance 2.0 e 2.5: o Seedance lidera em consistência de personagens e é forte no fluxo de trabalho do mercado chinês. O V6 lidera em controles de câmera cinematográficos e em texto multilíngue na imagem além do chinês.
Versus PixVerse C1: o C1, o modelo irmão cinematográfico, supera o V6 em consistência de vários planos conforme testes do Reddit (reddit.com/r/PixVerse, 2026). O V6 supera o C1 em amplitude de controle, integração de áudio nativo e ecossistema de efeitos. Execute-os lado a lado para trabalho cinematográfico.
Limitações a conhecer
A PixVerse reconhece oficialmente que o controle direcional preciso em cenas complexas e a consistência entre mudanças espaciais significativas ainda estão em evolução (blog PixVerse, 2026). São limitações admitidas pelo fornecedor, não especulação da comunidade.
Rostos humanos em movimento, especialmente primeiros planos falados, seguem desafiadores. O áudio nativo é cru e exige várias tentativas, segundo tópicos do Reddit r/PixVerse. A consistência de vários planos é mais fraca no V6 do que no modelo irmão C1. Gerações com falha ainda consomem créditos, o que eleva o custo efetivo num dia ruim.
Disputas de cobrança de assinatura aparecem no Trustpilot (trustpilot.com, 2026). Queixas se concentram em comportamento de renovação automática e tratamento de reembolsos. Leia os termos de cobrança antes de se comprometer com um plano anual e prefira o mensal até confiar no fluxo de trabalho.
[IMAGEM: Captura de tela de um caso de geração com falha do PixVerse V6 em que um primeiro plano falado produziu distorção facial visível, ilustrando a limitação oficialmente admitida sobre rostos humanos em movimento. Termos de busca: "pixverse v6 talking face distortion example"]
Perguntas frequentes
O PixVerse V6 é o modelo atual?
Sim. O V6 foi lançado em 30 de março de 2026 e é o modelo principal atual (blog PixVerse, 2026). O C1, lançado em 7 de abril de 2026, é um modelo irmão cinematográfico, não um substituto. O V2.x foi descontinuado em 2026. Ainda não há V7.
Quem produz o PixVerse?
A AIsphere, conhecida em chinês como 北京爱诗科技 ou Beijing Aishi Technology, produz o PixVerse. Wang Changhu, ex-líder de visão computacional da ByteDance, e Jaden Xie fundaram a empresa em 2023 em Pequim. Ela agora tem sede em Singapura (TechCrunch, 2026).
Quanto custa um clipe do V6?
Um clipe de 5 s do V6 em 1080p com áudio nativo custa 115 créditos, ou cerca de US$ 23 na taxa base de US$ 1 equivale a 5 créditos (docs.platform.pixverse.ai, 2026). O antigo valor de "US$ 0,30 a US$ 0,45 por vídeo" dos blogs da era V5 se aplica à saída em 360p sem áudio, não ao V6.
Existe camada gratuita?
Sim. O app ao consumidor do PixVerse em pixverse.ai oferece uma camada gratuita com créditos diários (pixverse.ai, 2026). A alocação diária exata fica presa ao app atual e varia entre as fontes. O wrapper da PixMind em /pixverse-video também expõe o V6 por meio de uma interface de navegador.
Quando devo usar o C1 em vez do V6?
Use o C1 para trabalho cinematográfico de vários planos em que a continuidade entre os cortes é o que mais importa. Use o V6 quando precisar de controle mais amplo, áudio nativo, os mais de 20 movimentos de câmera ou o ecossistema de efeitos e modelos. Usuários do Reddit r/PixVerse recomendam executar ambos no mesmo prompt e comparar (reddit.com/r/PixVerse, 2026).
O veredito: o PixVerse V6 é uma escolha atual e robusta
O PixVerse V6 é um modelo principal atual de 2026 sem prazo de migração, com saída nativa em 1080p, curtas-metragens de vários planos a partir de um único prompt, áudio nativo e mais de 20 controles de câmera cinematográficos. A linhagem da AIsphere e o financiamento total de US$ 439 milhões lhe dão fôlego até o próximo ciclo de modelos. O C1 cobre o caso cinematográfico de vários planos que o V6 admite ainda estar em evolução.
O enquadramento honesto para uma busca por pixverse-video-generator é que o V6 é o ponto de partida certo hoje, com duas ressalvas. Gerações com falha consomem créditos, então execute clipes de teste em 360p antes de gastar em 1080p com áudio. E o áudio nativo é cru o suficiente para que você refaça, o que acumula custo.
Para usuários iniciantes, o wrapper da PixMind é o caminho mais simples. Para desenvolvedores, o fal.ai hospeda o V6 com acesso à API. Para trabalho de alto volume, uma assinatura Essential ou Scale reduz o custo efetivo por clipe de forma significativa em relação ao pré-pago.



