
LTX-2.5 chega ao ComfyUI com vídeo por IA rápido
O LTX-2.5, novo modelo de vídeo por IA da LTX, foi lançado com pesos abertos e integração nativa ao ComfyUI. Segundo a empresa, ele cria um clipe de imagem para vídeo de 10 segundos em 720p em 6,8 segundos, quando executado em dois chips NVIDIA GB200. A novidade mira criadores, estúdios, desenvolvedores e equipes de robótica que precisam rodar, adaptar e manter a geração de vídeo por IA sob seu próprio controle.
O anúncio foi publicado em 11 de agosto de 2026. O modelo está disponível no Hugging Face, no ComfyUI e pela API LTX. A licença é gratuita para organizações com receita recorrente anual abaixo de US$ 10 milhões; empresas maiores precisam negociar licenciamento.
Tabela de conteúdos
O que muda no LTX-2.5
A LTX afirma que reconstruiu as etapas centrais do pipeline, em vez de apenas acrescentar recursos a uma base antiga. Entre os destaques está um novo decodificador de difusão, criado para reduzir artefatos em cenas de muito movimento e preservar detalhes finos, como rostos e textos. Há também um modelo de linguagem baseado em Gemma 4 e um aprimorador de prompts para pedidos com vários sujeitos e instruções complexas.
- Geração multishot em uma única saída.
- Maior consistência de personagem, cenário e voz.
- Checkpoint voltado à IA física e à robótica.
- Modelo destilado para inferência mais econômica.
- Execução local em GPUs NVIDIA RTX compatíveis.
Multishot: a promessa de continuidade
Em vez de gerar e montar planos isolados, o LTX-2.5 pode renderizar uma sequência inteira. A proposta é manter elementos visuais e sonoros coerentes entre cortes, algo relevante para narrativa, publicidade, animação e pré-visualização de filmes.
Velocidade exige contexto de hardware
O número de 6,8 segundos chama atenção, mas não representa o cenário comum de uso. A medição foi feita em dois NVIDIA GB200, hardware de data center. Na API gerenciada, a mesma tarefa levou 23,7 segundos, porém em 1080p — a plataforma não oferece a faixa de 720p nessa modalidade. A LTX diz que o modelo pode rodar em qualquer GPU com ao menos 16 GB de VRAM, além de infraestrutura de borda e máquinas locais.

| Cenário | Tempo informado | Observação |
|---|---|---|
| LTX-2.5 self-hosted | 6,8 segundos | 10 s, 720p, dois GB200 |
| API LTX | 23,7 segundos | 10 s, 1080p |
| Google Veo 3.1 | 70 segundos | Clipe de 8 segundos, segundo LTX |
As comparações de qualidade e velocidade foram reportadas ou encomendadas pela própria LTX. Empresas devem validar desempenho, custo e qualidade com seus prompts, dados e infraestrutura.
Pesos abertos e ComfyUI atraem empresas
A estratégia da LTX contrasta com serviços fechados, cobrados por API. Com os pesos abertos, uma empresa pode testar o modelo em sua própria infraestrutura, fazer ajuste fino com dados proprietários e evitar que filmagens sensíveis, personagens ou outros ativos de IP saiam do ambiente interno. Isso não elimina custos de GPU, operação ou licença comercial, mas amplia o controle técnico.
“Estamos tentando manter a mesma eficiência e a velocidade de inferência pelas quais somos conhecidos, elevando constantemente a qualidade.”
Zeev Farbman, cofundador e CEO da LTX, em declaração à VentureBeat
Para o ComfyUI, a integração desde o primeiro dia reduz a distância entre experimentação e produção. A interface baseada em nós permite combinar modelos, condicionamento, pós-processamento e fluxos repetíveis. Segundo Yoland Yan, CEO da Comfy Org, esse ambiente serve tanto à criação visual quanto a pipelines de dados e cenários de robótica.
Onde o modelo de vídeo por IA pode ser usado
A LTX posiciona o LTX-2.5 além de clipes cinematográficos. Entre os usos citados estão efeitos visuais, transformação de dia em noite, simulação de água, interpolação de keyframes para animação e fotografia computacional. Na robótica, o checkpoint pré-treinado pode ser ajustado para dados de domínio específicos, úteis em IA física e aplicações em tempo real.
Não há links diretos para vídeos, posts de X/Twitter ou publicações de Instagram no material fornecido. Por isso, não foram adicionadas incorporações dessas plataformas. Os links externos presentes apontam para páginas oficiais de acesso e documentação, não para mídia incorporável.
O que é o LTX-2.5?
É um modelo de vídeo por IA com pesos abertos. Ele gera vídeo a partir de imagem e prompt, com foco em velocidade, controle local e fluxos no ComfyUI.
O LTX-2.5 é gratuito para empresas?
Depende da receita. A LTX informa uso gratuito para organizações abaixo de US$ 10 milhões em ARR; acima desse limite, é necessário negociar uma licença.
Qual hardware é necessário para rodar o LTX-2.5?
A empresa cita mínimo de 16 GB de VRAM. O resultado de 6,8 segundos, porém, foi obtido em dois chips NVIDIA GB200 de data center.
O LTX-2.5 funciona no ComfyUI?
Sim. O lançamento inclui integração nativa desde o primeiro dia, permitindo montar workflows de geração, edição e teste por meio de nós.
Considerações finais
O LTX-2.5 reforça a disputa entre modelos abertos e APIs fechadas na geração de vídeo por IA. Sua combinação de ComfyUI, pesos abertos, multishot e foco em inferência local pode ser especialmente atraente para equipes que valorizam privacidade, ajuste fino e previsibilidade operacional. Ainda assim, as promessas de desempenho devem ser lidas com cautela: resolução, GPU, carga de trabalho e qualidade desejada mudam substancialmente o resultado final.
