AiST.Ai
aist.video / generation · auto-edit · dubbing · avatars

Vídeo sem filmagem: do guião ao vídeo final em minutos.

O AiST Video monta vídeos de formação, publicitários e de produto a partir de texto, imagens e do seu arquivo: avatar Ai do locutor, montagem automática, dobragem, legendas, corte de conteúdo longo em shorts. Um mesmo vídeo — para Reels, Shorts, VK Clips, Dzen e o LMS corporativo, com dobragem em mais de 30 idiomas. Sem câmara, sem ator, sem editor. Guião → vídeo em 3–5 minutos em vez de duas semanas de produção. T&D, marketing e PR lançam um curso de 50 lições numa semana — antes, um ano e o orçamento de um automóvel.

  • ▶ Text-to-video & image-to-video
  • ◉ Avatar Ai do locutor + lipsync
  • ≋ Dobragem em mais de 30 idiomas
  • ⌖ Corte automático em Reels / Shorts / VK Clips
  • ⛨ 152-FZ · on-prem · brand-safety
// o problema

O vídeo é o conteúdo mais caro. E já não é possível prescindir dele.

90% das redes sociais, 70% da formação e metade da publicidade são vídeo. Mas cada peça implica filmagem, ator, montagem, grafismo, duas semanas e a fatura da produtora. O negócio esbarra no teto de produção de conteúdo audiovisual.

// custo

Um vídeo de formação — milhares de euros e um mês

Guião, casting do locutor, estúdio, montagem, grafismo, correções. Um curso corporativo de 50 lições transforma-se num ano de trabalho e no orçamento de um automóvel de gama alta.

→
Guião → vídeo final com avatar, locução e montagem em 5 minutos. Um curso de 50 lições — numa semana.
// escala

O SMM quer 30 shorts por semana

VK Clips, Reels, Shorts — os algoritmos premeiam quem publica muito. Tem webinars e entrevistas longas — mas não há quem as corte em 30 clipes verticais com legendas.

→
Corte automático do vídeo longo em shorts verticais com legendas e enquadramento no orador. 30 peças numa hora.
// localização

Lançamento em 5 países = 5 produções

Um curso de formação em 5 idiomas são 5 locutores, 5 estúdios, 5 montagens. A localização consome 80% do orçamento de um lançamento regional.

→
Dobragem e lipsync em mais de 30 idiomas. Um vídeo — 30 versões locais numa hora, mantendo a voz do locutor.
// como funciona

Do texto do guião — ao vídeo final na plataforma de vídeo.

A cadeia recebe o guião (ou um artigo, um PDF ou uma página do Confluence), gera as cenas, adiciona o avatar-locutor com a sua voz, monta, coloca as legendas, corta os shorts e publica. Cada passo configura-se no painel.

// L1 · entrada
script texto / guião + assistente de redação
doc artigo / PDF / Confluence guião automático
media foto / b-roll o seu arquivo + AiST Image
long vídeo longo / gravação webinar · entrevista
↓
// L2 · montagem
scenes geração de cenas FLUX-Video · Kling · Sora-like
avatar avatar Ai do locutor lipsync · expressões faciais
tts locução com a sua voz clone de voz · ru/en
edit montagem automática cortes · transições · b-roll
↓
// L3 · exportação
subs legendas SRT/VTT mais de 30 idiomas
shorts corte em shorts 9:16 + enquadramento no rosto
brand logótipo + oráculos + cta modelo de marca
publish para o LMS / redes / DAM Rutube · VK · Kinescope
  • 01
    O guião — com as suas palavras ou com um documento Pode escrever o guião à mão, carregar um PDF ou indicar um artigo no Confluence — a plataforma divide-o por cenas e propõe os planos. Depois ajusta-o no painel.
  • 02
    Avatar do locutor — com a sua voz Avatares prontos ou um avatar «como o seu diretor de RH» — a partir de uma gravação de vídeo de 5 minutos. A voz do locutor é clonada com uma gravação de 3 minutos. O lipsync funciona em qualquer idioma.
  • 03
    Montagem automática com cenas e b-roll A plataforma seleciona sozinha o b-roll do seu arquivo (ou gera-o com o AiST Image), adiciona transições, música, oráculos com as teses-chave e o logótipo. O resultado é um vídeo final — não uma «cabeça falante».
  • 04
    Diretamente — para o LMS, a plataforma de vídeo ou o feed O vídeo é cortado automaticamente em shorts verticais com legendas, dobrado nos idiomas necessários e publicado no LMS, no Rutube/Kinescope e nas redes sociais — através de conectores prontos.
// capacidades

Não é «simplesmente Sora». A cadeia completa de produção de vídeo.

A geração é apenas 25% da tarefa. Além disso são precisos: montagem, avatares, voz, legendas, localização, corte, branding e publicação. Nós temos tudo num só painel e através de uma só API.

▶

Text-to-video

Guião → cenas finais em 1080p/4K. Até 60 segundos por passagem; os vídeos longos, por junção.

generation
⇆

Image-to-video

Imagem estática → cena animada. A ficha de produto roda, o render do interior ganha vida, o retrato pestaneja.

img2vid
◉

Avatares Ai + lipsync

Avatares prontos ou um avatar «como o seu diretor de RH». O lipsync funciona em qualquer idioma. Emoções, expressões faciais, gestos.

avatar · lipsync
≋

Clone de voz do locutor

3 minutos de gravação — e o seu locutor fala em mais de 30 idiomas. Mantêm-se o timbre, a entoação e o carácter.

voice-clone · tts
▤

Montagem automática

Junção de cenas, transições, ritmo, música conforme o ambiente, oráculos com as teses-chave — automaticamente.

auto-edit
⌖

Corte automático em shorts

Um webinar longo → 20 clipes verticais com enquadramento no orador e um «gancho» no primeiro segundo.

clipping · 9:16
A

Legendas em mais de 30 idiomas

Legendas automáticas a partir de ASR com códigos de tempo por palavra. Oráculos estilizados conforme a marca. SRT/VTT.

captions
↻

Dobragem e nova locução

O mesmo vídeo em 30 idiomas com lipsync. Uma produção — 30 versões locais. Localização 100 vezes mais barata.

dub · localization
↑

Upscaling e restauro

Gravações corporativas antigas de 480p → 4K sem perdas. Correção de cor, redução de ruído, restauro de rostos.

restore
◐

Remoção e substituição de fundo

O orador sobre um fundo corporativo sem croma. Remoção de objetos do plano, mudança de cenário num clique.

bg · matting
⊞

Modelos e branding

Logótipo, oráculos, terços inferiores, genérico, packshot — conforme o modelo de marca. Compõe-se automaticamente.

brand · templates
≡

Catálogo de modelos

FLUX-Video, Kling, Hunyuan, Sora-like, o seu self-host. Através do AiST Gateway — o modelo adequado para cada tarefa.

multi-model
// o que faz e para onde exporta

Um só motor — para formação, publicidade, redes sociais, e-commerce e TV corporativa.

Não estamos presos a um modelo nem a um formato. Para cada caso — o modelo, o template e o conector adequados à plataforma necessária. O criador de conteúdos não pensa «como fazer» — pensa «sobre o que é o vídeo».

// tipos de vídeo

FormaçãoOnboardingPromoFicha de produtoDemo de produtoNotícias corporativasShortReelsTeaserCaso de sucesso

// formatos

16:9 horizontal9:16 vertical1:1 quadrado4:5 post4K UHD1080pHEVC · H.264 · AV1

// modelos & vozes

FLUX-VideoKlingHunyuanWanYandexGPT-VideoSaluteSpeech TTSSileroTTS+ vozes personalizadas

// plataformas de vídeo

RutubeKinescopeVK VideoVK ClipsYa.EfirRuTube LiveHLS / RTMP

// lms & formação

iSpring LearnEquioMirapolisWebTutor1C:E-learningSCORM 1.2 / 2004

// redes sociais & publicidade

VK AdsYa.DirectTelegram AdsDzenOKPinterest

O vídeo deixa de ser «um projeto de um trimestre» e passa a ser «uma tarefa rotineira de uma manhã».

As 50 lições de um curso de formação — numa semana, com um só designer instrucional e sem equipa. 200 shorts para redes sociais a partir de um webinar de uma hora — numa hora. Fichas de 5000 produtos com demonstração animada — numa noite. A localização do curso emblemático em 5 idiomas — num dia, não num trimestre e com um orçamento milionário.

× 20velocidade de produção
−90%custo por vídeo
~ 3 minrenderização de 1 vídeo de 30 s
⌬
Painel do criador de conteúdos

Editor web: o guião à esquerda, a pré-visualização à direita, a linha temporal em baixo. Nada de Premiere, nada de After Effects.

⛯
API para e-commerce e LMS

O 1C envia a linha do produto ou da lição — e recebe de volta o vídeo final com avatar, locução e oráculos. Em 5 minutos está na montra ou no LMS.

▶
Cadeia para redes sociais

Carrega um webinar de uma hora — e obtém 20 shorts verticais com legendas, oráculos e um «gancho» no primeiro segundo. Prontos a publicar.

// o que se constrói sobre o AiST Video

Da universidade corporativa ao feed das redes sociais.

O Video é a infraestrutura de produção. Cada departamento encontra o seu caso: formação, marketing, e-commerce, RH, media, produto. Um motor, diferentes presets.

// formação

Um curso corporativo numa semana, não num ano

O designer instrucional carrega o PDF do programa — e obtém 50 lições com locutores, montagem, legendas e testes. O curso em 5 idiomas — em paralelo.

iSpringSCORMavatares
// marketing

Criativos publicitários para testes A/B

20 variantes de um vídeo de 15 segundos com diferentes teses e criativos — numa hora. O Ya.Direct e o VK Ads aceitam-nas, o marketing de performance testa-as e o orçamento de produção fica libertado.

Ya.DirectVK AdsA/B
// e-commerce

Fichas em vídeo para mais de 1000 produtos

Cada produto com foto 360° e um breve vídeo de apresentação gerado a partir da ficha do produto no 1C. A conversão de uma ficha com vídeo é 30–80% superior à de uma ficha sem ele.

1C:Comérciomarketplaces360°
// smm & conteúdo

Shorts a partir de webinars e entrevistas

Um webinar de uma hora → 20 clipes verticais com enquadramento no orador, legendas e um «gancho» no primeiro segundo. O SMM alimenta diariamente os algoritmos de Reels/Shorts/Clips.

VK ClipsTelegram9:16
// tv corporativa

Notícias semanais da empresa

Os RH redigem o resumo da semana em texto — e obtêm um vídeo de 5 minutos com um avatar-apresentador, montagem e grafismo. Os colaboradores veem a TV corporativa no portal e no Telegram.

Telegramportalresumo
// produto

Demos e tutoriais para cada release

As release notes no Confluence → um tutorial automático com screencast, voz e legendas. Cada funcionalidade com o seu vídeo na documentação, sem intervenção do redator técnico.

Confluencescreencastrelease-notes
// já na plataforma

Não é preciso «acoplar o Sora e programar um editor de montagem». Está tudo pronto.

Um modelo text-to-video «em bruto» é menos de um quarto da tarefa. Além disso são precisos: vozes, avatares, montagem, legendas, templates de marca, publicação no LMS e nas redes sociais, um cluster GPU. Nós já temos tudo integrado.

Ativa-se — não é a equipa de DevOps que o constrói durante meio ano.

O AiST Video é um serviço dentro da AiST Platform. Não precisa de procurar engenheiros de ML para modelos de difusão, implementar infraestrutura GPU, desenvolver um editor de vídeo nem integrações com o LMS. Carregue 5 minutos de vídeo do seu diretor de RH — e num dia será o locutor de qualquer um dos seus cursos.

«Tínhamos planeado o lançamento do curso para um trimestre e um grande orçamento. Lançámo-lo numa semana com um só designer instrucional. A localização em 5 idiomas — em paralelo»

O que mais há na AiST Platform→
▶
Catálogo de modelos de vídeoFLUX-Video · Kling · Hunyuan · self-host
✓ pronto
◉
Avatares Ai + lipsyncprontos + personalizado com 5 min de vídeo
✓ pronto
≋
Clone de voz do locutor3 min de gravação → mais de 30 idiomas
✓ pronto
▤
Montagem automática + b-rollatravés do AiST Image · música · transições
✓ pronto
⌖
Corte automático em shorts9:16 + enquadramento no orador
✓ pronto
A
Legendas + dobragem em mais de 30 idiomaso lipsync mantém-se
✓ pronto
⛓
Conectores LMS / redes / DAMiSpring · Equio · Rutube · VK · 1C
✓ pronto
⛨
NSFW + brand-safety + watermarkfiltros + marca de água visível/invisível
✓ pronto
// controlo corporativo

O vídeo com o seu locutor e os seus dados — não sai do perímetro.

O avatar Ai do seu alto dirigente, o clone de voz do diretor de RH, a demo do novo produto, os rostos dos colaboradores na TV corporativa — são PII, biometria e segredo comercial. O AiST Video funciona on-prem, com auditoria, marcas de água e moderação.

// para o CISO

Perímetro fechado

  • On-prem ou AiST BOX no seu centro de dados
  • A inferência GPU — nas suas instalações, nada sai para fora
  • Os avatares e as vozes — na sua base de dados
  • Marca de água invisível nas gerações
  • Filtros NSFW + brand-safety
  • Auditoria de cada geração — no SIEM
// para a marca

Garantia de estilo

  • Templates de genérico, oráculos e terços inferiores
  • Cores, tipografias e logótipo conforme o manual de marca
  • Vozes — apenas as aprovadas
  • Avatares — apenas os oficiais
  • Moderação à saída
  • Versionamento de templates
// para o CFO

ROI e orçamento

  • −90% de custo de produção
  • −80% de custo de localização
  • × 20 de velocidade de publicação de conteúdo
  • Orçamentos GPU por departamento
  • Fatura transparente em rublos
  • Licença por minutos ou por pacote
// perguntas frequentes

O que costumam perguntar antes de um piloto do Video.

Vai ficar com «ar de IA» ou vai ficar bem?

Bem — se o modelo e o caso forem bem escolhidos. Os avatares e o lipsync atingiram no último ano um nível em que o espetador não nota. A geração text-to-video completa ainda se percebe «de IA» em grandes planos de rostos, mas é perfeita para b-roll, abstrações e demos de produto. A escolha do modelo para o seu caso é feita no piloto.

É possível criar o avatar do nosso diretor de RH / CEO?

Sim. Com uma gravação de vídeo de 5 minutos «a meio perfil, com diferentes emoções» treina-se um avatar pessoal. Com uma gravação de áudio de 3 minutos clona-se a voz. O avatar é armazenado na sua base de dados e a sua utilização fica sob o perfil «aprovado pelo responsável de marca».

E quanto à localização e à dobragem?

Um vídeo → mais de 30 idiomas com lipsync. A voz do locutor mantém-se (não é um «TTS robotizado»: o seu diretor de RH fala usbeque com a sua própria voz). O custo da localização é 100 vezes inferior ao da dobragem em estúdio.

Quantas GPU são precisas?

Para começar — 1–2 H100 ou equivalente: até ~200 minutos de vídeo final por dia. Um vídeo de 30 s — renderizado em 2–4 minutos. Para e-commerce com milhares de fichas por dia — escalamento horizontal. O dimensionamento é calculado por nós para o seu volume.

Quanto tempo demora a arrancar?

O piloto «o designer instrucional monta um curso de formação» ou «o SMM corta shorts» — 2 semanas até produção (incluindo o treino do avatar e o clone de voz). A cadeia completa de e-commerce com integração do 1C e marketplaces — 4–6 semanas.

É um produto independente ou parte da plataforma?

O AiST Video é um serviço dentro da AiST Platform. Pode contratá-lo separadamente (como Video-API) ou diretamente com o AiST Image para o b-roll, o AiST ASR para as transcrições, RAG para a pesquisa em vídeo, perfis e auditoria. Um só painel, uma só fatura.

// próximo passo

Envie-nos um vídeo do locutor — o nosso gestor mostrar-lhe-á o avatar e a locução diretamente na reunião.

Peça uma demo: envie um vídeo breve do seu representante e mostramos-lhe o avatar Ai final com a sua voz e o seu aspeto diretamente na reunião de demonstração.

// ao enviar, o senhor aceita o tratamento dos seus dados pessoais