Vídeo sem filmagem: do guião ao vídeo final em minutos.
O AiST Video monta vídeos de formação, publicitários e de produto a partir de texto, imagens e do seu arquivo: avatar Ai do locutor, montagem automática, dobragem, legendas, corte de conteúdo longo em shorts. Um mesmo vídeo — para Reels, Shorts, VK Clips, Dzen e o LMS corporativo, com dobragem em mais de 30 idiomas. Sem câmara, sem ator, sem editor. Guião → vídeo em 3–5 minutos em vez de duas semanas de produção. T&D, marketing e PR lançam um curso de 50 lições numa semana — antes, um ano e o orçamento de um automóvel.
- ▶ Text-to-video & image-to-video
- ◉ Avatar Ai do locutor + lipsync
- ≋ Dobragem em mais de 30 idiomas
- ⌖ Corte automático em Reels / Shorts / VK Clips
- ⛨ 152-FZ · on-prem · brand-safety
O vídeo é o conteúdo mais caro. E já não é possível prescindir dele.
90% das redes sociais, 70% da formação e metade da publicidade são vídeo. Mas cada peça implica filmagem, ator, montagem, grafismo, duas semanas e a fatura da produtora. O negócio esbarra no teto de produção de conteúdo audiovisual.
Um vídeo de formação — milhares de euros e um mês
Guião, casting do locutor, estúdio, montagem, grafismo, correções. Um curso corporativo de 50 lições transforma-se num ano de trabalho e no orçamento de um automóvel de gama alta.
O SMM quer 30 shorts por semana
VK Clips, Reels, Shorts — os algoritmos premeiam quem publica muito. Tem webinars e entrevistas longas — mas não há quem as corte em 30 clipes verticais com legendas.
Lançamento em 5 países = 5 produções
Um curso de formação em 5 idiomas são 5 locutores, 5 estúdios, 5 montagens. A localização consome 80% do orçamento de um lançamento regional.
Do texto do guião — ao vídeo final na plataforma de vídeo.
A cadeia recebe o guião (ou um artigo, um PDF ou uma página do Confluence), gera as cenas, adiciona o avatar-locutor com a sua voz, monta, coloca as legendas, corta os shorts e publica. Cada passo configura-se no painel.
-
01
O guião — com as suas palavras ou com um documento Pode escrever o guião à mão, carregar um PDF ou indicar um artigo no Confluence — a plataforma divide-o por cenas e propõe os planos. Depois ajusta-o no painel.
-
02
Avatar do locutor — com a sua voz Avatares prontos ou um avatar «como o seu diretor de RH» — a partir de uma gravação de vídeo de 5 minutos. A voz do locutor é clonada com uma gravação de 3 minutos. O lipsync funciona em qualquer idioma.
-
03
Montagem automática com cenas e b-roll A plataforma seleciona sozinha o b-roll do seu arquivo (ou gera-o com o AiST Image), adiciona transições, música, oráculos com as teses-chave e o logótipo. O resultado é um vídeo final — não uma «cabeça falante».
-
04
Diretamente — para o LMS, a plataforma de vídeo ou o feed O vídeo é cortado automaticamente em shorts verticais com legendas, dobrado nos idiomas necessários e publicado no LMS, no Rutube/Kinescope e nas redes sociais — através de conectores prontos.
Não é «simplesmente Sora». A cadeia completa de produção de vídeo.
A geração é apenas 25% da tarefa. Além disso são precisos: montagem, avatares, voz, legendas, localização, corte, branding e publicação. Nós temos tudo num só painel e através de uma só API.
Text-to-video
Guião → cenas finais em 1080p/4K. Até 60 segundos por passagem; os vídeos longos, por junção.
Image-to-video
Imagem estática → cena animada. A ficha de produto roda, o render do interior ganha vida, o retrato pestaneja.
Avatares Ai + lipsync
Avatares prontos ou um avatar «como o seu diretor de RH». O lipsync funciona em qualquer idioma. Emoções, expressões faciais, gestos.
Clone de voz do locutor
3 minutos de gravação — e o seu locutor fala em mais de 30 idiomas. Mantêm-se o timbre, a entoação e o carácter.
Montagem automática
Junção de cenas, transições, ritmo, música conforme o ambiente, oráculos com as teses-chave — automaticamente.
Corte automático em shorts
Um webinar longo → 20 clipes verticais com enquadramento no orador e um «gancho» no primeiro segundo.
Legendas em mais de 30 idiomas
Legendas automáticas a partir de ASR com códigos de tempo por palavra. Oráculos estilizados conforme a marca. SRT/VTT.
Dobragem e nova locução
O mesmo vídeo em 30 idiomas com lipsync. Uma produção — 30 versões locais. Localização 100 vezes mais barata.
Upscaling e restauro
Gravações corporativas antigas de 480p → 4K sem perdas. Correção de cor, redução de ruído, restauro de rostos.
Remoção e substituição de fundo
O orador sobre um fundo corporativo sem croma. Remoção de objetos do plano, mudança de cenário num clique.
Modelos e branding
Logótipo, oráculos, terços inferiores, genérico, packshot — conforme o modelo de marca. Compõe-se automaticamente.
Catálogo de modelos
FLUX-Video, Kling, Hunyuan, Sora-like, o seu self-host. Através do AiST Gateway — o modelo adequado para cada tarefa.
Um só motor — para formação, publicidade, redes sociais, e-commerce e TV corporativa.
Não estamos presos a um modelo nem a um formato. Para cada caso — o modelo, o template e o conector adequados à plataforma necessária. O criador de conteúdos não pensa «como fazer» — pensa «sobre o que é o vídeo».
// tipos de vídeo
// formatos
// modelos & vozes
// plataformas de vídeo
// lms & formação
// redes sociais & publicidade
O vídeo deixa de ser «um projeto de um trimestre» e passa a ser «uma tarefa rotineira de uma manhã».
As 50 lições de um curso de formação — numa semana, com um só designer instrucional e sem equipa. 200 shorts para redes sociais a partir de um webinar de uma hora — numa hora. Fichas de 5000 produtos com demonstração animada — numa noite. A localização do curso emblemático em 5 idiomas — num dia, não num trimestre e com um orçamento milionário.
Editor web: o guião à esquerda, a pré-visualização à direita, a linha temporal em baixo. Nada de Premiere, nada de After Effects.
O 1C envia a linha do produto ou da lição — e recebe de volta o vídeo final com avatar, locução e oráculos. Em 5 minutos está na montra ou no LMS.
Carrega um webinar de uma hora — e obtém 20 shorts verticais com legendas, oráculos e um «gancho» no primeiro segundo. Prontos a publicar.
Da universidade corporativa ao feed das redes sociais.
O Video é a infraestrutura de produção. Cada departamento encontra o seu caso: formação, marketing, e-commerce, RH, media, produto. Um motor, diferentes presets.
Um curso corporativo numa semana, não num ano
O designer instrucional carrega o PDF do programa — e obtém 50 lições com locutores, montagem, legendas e testes. O curso em 5 idiomas — em paralelo.
Criativos publicitários para testes A/B
20 variantes de um vídeo de 15 segundos com diferentes teses e criativos — numa hora. O Ya.Direct e o VK Ads aceitam-nas, o marketing de performance testa-as e o orçamento de produção fica libertado.
Fichas em vídeo para mais de 1000 produtos
Cada produto com foto 360° e um breve vídeo de apresentação gerado a partir da ficha do produto no 1C. A conversão de uma ficha com vídeo é 30–80% superior à de uma ficha sem ele.
Shorts a partir de webinars e entrevistas
Um webinar de uma hora → 20 clipes verticais com enquadramento no orador, legendas e um «gancho» no primeiro segundo. O SMM alimenta diariamente os algoritmos de Reels/Shorts/Clips.
Notícias semanais da empresa
Os RH redigem o resumo da semana em texto — e obtêm um vídeo de 5 minutos com um avatar-apresentador, montagem e grafismo. Os colaboradores veem a TV corporativa no portal e no Telegram.
Demos e tutoriais para cada release
As release notes no Confluence → um tutorial automático com screencast, voz e legendas. Cada funcionalidade com o seu vídeo na documentação, sem intervenção do redator técnico.
Não é preciso «acoplar o Sora e programar um editor de montagem». Está tudo pronto.
Um modelo text-to-video «em bruto» é menos de um quarto da tarefa. Além disso são precisos: vozes, avatares, montagem, legendas, templates de marca, publicação no LMS e nas redes sociais, um cluster GPU. Nós já temos tudo integrado.
Ativa-se — não é a equipa de DevOps que o constrói durante meio ano.
O AiST Video é um serviço dentro da AiST Platform. Não precisa de procurar engenheiros de ML para modelos de difusão, implementar infraestrutura GPU, desenvolver um editor de vídeo nem integrações com o LMS. Carregue 5 minutos de vídeo do seu diretor de RH — e num dia será o locutor de qualquer um dos seus cursos.
«Tínhamos planeado o lançamento do curso para um trimestre e um grande orçamento. Lançámo-lo numa semana com um só designer instrucional. A localização em 5 idiomas — em paralelo»
O que mais há na AiST Platform→O vídeo com o seu locutor e os seus dados — não sai do perímetro.
O avatar Ai do seu alto dirigente, o clone de voz do diretor de RH, a demo do novo produto, os rostos dos colaboradores na TV corporativa — são PII, biometria e segredo comercial. O AiST Video funciona on-prem, com auditoria, marcas de água e moderação.
Perímetro fechado
- On-prem ou AiST BOX no seu centro de dados
- A inferência GPU — nas suas instalações, nada sai para fora
- Os avatares e as vozes — na sua base de dados
- Marca de água invisível nas gerações
- Filtros NSFW + brand-safety
- Auditoria de cada geração — no SIEM
Garantia de estilo
- Templates de genérico, oráculos e terços inferiores
- Cores, tipografias e logótipo conforme o manual de marca
- Vozes — apenas as aprovadas
- Avatares — apenas os oficiais
- Moderação à saída
- Versionamento de templates
ROI e orçamento
- −90% de custo de produção
- −80% de custo de localização
- × 20 de velocidade de publicação de conteúdo
- Orçamentos GPU por departamento
- Fatura transparente em rublos
- Licença por minutos ou por pacote
O que costumam perguntar antes de um piloto do Video.
Vai ficar com «ar de IA» ou vai ficar bem?
Bem — se o modelo e o caso forem bem escolhidos. Os avatares e o lipsync atingiram no último ano um nível em que o espetador não nota. A geração text-to-video completa ainda se percebe «de IA» em grandes planos de rostos, mas é perfeita para b-roll, abstrações e demos de produto. A escolha do modelo para o seu caso é feita no piloto.
É possível criar o avatar do nosso diretor de RH / CEO?
Sim. Com uma gravação de vídeo de 5 minutos «a meio perfil, com diferentes emoções» treina-se um avatar pessoal. Com uma gravação de áudio de 3 minutos clona-se a voz. O avatar é armazenado na sua base de dados e a sua utilização fica sob o perfil «aprovado pelo responsável de marca».
E quanto à localização e à dobragem?
Um vídeo → mais de 30 idiomas com lipsync. A voz do locutor mantém-se (não é um «TTS robotizado»: o seu diretor de RH fala usbeque com a sua própria voz). O custo da localização é 100 vezes inferior ao da dobragem em estúdio.
Quantas GPU são precisas?
Para começar — 1–2 H100 ou equivalente: até ~200 minutos de vídeo final por dia. Um vídeo de 30 s — renderizado em 2–4 minutos. Para e-commerce com milhares de fichas por dia — escalamento horizontal. O dimensionamento é calculado por nós para o seu volume.
Quanto tempo demora a arrancar?
O piloto «o designer instrucional monta um curso de formação» ou «o SMM corta shorts» — 2 semanas até produção (incluindo o treino do avatar e o clone de voz). A cadeia completa de e-commerce com integração do 1C e marketplaces — 4–6 semanas.
É um produto independente ou parte da plataforma?
O AiST Video é um serviço dentro da AiST Platform. Pode contratá-lo separadamente (como Video-API) ou diretamente com o AiST Image para o b-roll, o AiST ASR para as transcrições, RAG para a pesquisa em vídeo, perfis e auditoria. Um só painel, uma só fatura.
Envie-nos um vídeo do locutor — o nosso gestor mostrar-lhe-á o avatar e a locução diretamente na reunião.
Peça uma demo: envie um vídeo breve do seu representante e mostramos-lhe o avatar Ai final com a sua voz e o seu aspeto diretamente na reunião de demonstração.