NoticiasInteligência ArtificialTecnologia

LTX-2.5 chega ao ComfyUI com vídeo por IA rápido

O LTX-2.5, novo modelo de vídeo por IA da LTX, foi lançado com pesos abertos e integração nativa ao ComfyUI. Segundo a empresa, ele cria um clipe de imagem para vídeo de 10 segundos em 720p em 6,8 segundos, quando executado em dois chips NVIDIA GB200. A novidade mira criadores, estúdios, desenvolvedores e equipes de robótica que precisam rodar, adaptar e manter a geração de vídeo por IA sob seu próprio controle.

O anúncio foi publicado em 11 de agosto de 2026. O modelo está disponível no Hugging Face, no ComfyUI e pela API LTX. A licença é gratuita para organizações com receita recorrente anual abaixo de US$ 10 milhões; empresas maiores precisam negociar licenciamento.

O que muda no LTX-2.5

A LTX afirma que reconstruiu as etapas centrais do pipeline, em vez de apenas acrescentar recursos a uma base antiga. Entre os destaques está um novo decodificador de difusão, criado para reduzir artefatos em cenas de muito movimento e preservar detalhes finos, como rostos e textos. Há também um modelo de linguagem baseado em Gemma 4 e um aprimorador de prompts para pedidos com vários sujeitos e instruções complexas.

  • Geração multishot em uma única saída.
  • Maior consistência de personagem, cenário e voz.
  • Checkpoint voltado à IA física e à robótica.
  • Modelo destilado para inferência mais econômica.
  • Execução local em GPUs NVIDIA RTX compatíveis.

Multishot: a promessa de continuidade

Em vez de gerar e montar planos isolados, o LTX-2.5 pode renderizar uma sequência inteira. A proposta é manter elementos visuais e sonoros coerentes entre cortes, algo relevante para narrativa, publicidade, animação e pré-visualização de filmes.

Velocidade exige contexto de hardware

O número de 6,8 segundos chama atenção, mas não representa o cenário comum de uso. A medição foi feita em dois NVIDIA GB200, hardware de data center. Na API gerenciada, a mesma tarefa levou 23,7 segundos, porém em 1080p — a plataforma não oferece a faixa de 720p nessa modalidade. A LTX diz que o modelo pode rodar em qualquer GPU com ao menos 16 GB de VRAM, além de infraestrutura de borda e máquinas locais.

Gráfico compara velocidade de geração de vídeo do LTX-2.5
Comparação de velocidade divulgada pela LTX; os resultados dependem de resolução, infraestrutura e configuração. Imagem: LTX.
CenárioTempo informadoObservação
LTX-2.5 self-hosted6,8 segundos10 s, 720p, dois GB200
API LTX23,7 segundos10 s, 1080p
Google Veo 3.170 segundosClipe de 8 segundos, segundo LTX
Dados divulgados pela LTX; não constituem benchmark independente.

As comparações de qualidade e velocidade foram reportadas ou encomendadas pela própria LTX. Empresas devem validar desempenho, custo e qualidade com seus prompts, dados e infraestrutura.

Pesos abertos e ComfyUI atraem empresas

A estratégia da LTX contrasta com serviços fechados, cobrados por API. Com os pesos abertos, uma empresa pode testar o modelo em sua própria infraestrutura, fazer ajuste fino com dados proprietários e evitar que filmagens sensíveis, personagens ou outros ativos de IP saiam do ambiente interno. Isso não elimina custos de GPU, operação ou licença comercial, mas amplia o controle técnico.

“Estamos tentando manter a mesma eficiência e a velocidade de inferência pelas quais somos conhecidos, elevando constantemente a qualidade.”

Zeev Farbman, cofundador e CEO da LTX, em declaração à VentureBeat

Para o ComfyUI, a integração desde o primeiro dia reduz a distância entre experimentação e produção. A interface baseada em nós permite combinar modelos, condicionamento, pós-processamento e fluxos repetíveis. Segundo Yoland Yan, CEO da Comfy Org, esse ambiente serve tanto à criação visual quanto a pipelines de dados e cenários de robótica.

Onde o modelo de vídeo por IA pode ser usado

A LTX posiciona o LTX-2.5 além de clipes cinematográficos. Entre os usos citados estão efeitos visuais, transformação de dia em noite, simulação de água, interpolação de keyframes para animação e fotografia computacional. Na robótica, o checkpoint pré-treinado pode ser ajustado para dados de domínio específicos, úteis em IA física e aplicações em tempo real.

Não há links diretos para vídeos, posts de X/Twitter ou publicações de Instagram no material fornecido. Por isso, não foram adicionadas incorporações dessas plataformas. Os links externos presentes apontam para páginas oficiais de acesso e documentação, não para mídia incorporável.

  1. O que é o LTX-2.5?

    É um modelo de vídeo por IA com pesos abertos. Ele gera vídeo a partir de imagem e prompt, com foco em velocidade, controle local e fluxos no ComfyUI.

  2. O LTX-2.5 é gratuito para empresas?

    Depende da receita. A LTX informa uso gratuito para organizações abaixo de US$ 10 milhões em ARR; acima desse limite, é necessário negociar uma licença.

  3. Qual hardware é necessário para rodar o LTX-2.5?

    A empresa cita mínimo de 16 GB de VRAM. O resultado de 6,8 segundos, porém, foi obtido em dois chips NVIDIA GB200 de data center.

  4. O LTX-2.5 funciona no ComfyUI?

    Sim. O lançamento inclui integração nativa desde o primeiro dia, permitindo montar workflows de geração, edição e teste por meio de nós.

Considerações finais

O LTX-2.5 reforça a disputa entre modelos abertos e APIs fechadas na geração de vídeo por IA. Sua combinação de ComfyUI, pesos abertos, multishot e foco em inferência local pode ser especialmente atraente para equipes que valorizam privacidade, ajuste fino e previsibilidade operacional. Ainda assim, as promessas de desempenho devem ser lidas com cautela: resolução, GPU, carga de trabalho e qualidade desejada mudam substancialmente o resultado final.

Diogo Fernando

Apaixonado por tecnologia e cultura pop, programo para resolver problemas e transformar vidas. Empreendedor e geek, busco novas ideias e desafios. Acredito na tecnologia como superpoder do século XXI.