Dimensões
Cada dimensão é uma camada de análise. Combina as que precisares — só paga pelas habilitadas.
Como funciona
Quando crias um produto, escolhes quais dimensões habilitar. Na chamada POST /v1/analyze passas o array dimensions com um subset das habilitadas. O backend processa em paralelo e cobra só pelas que rodou.
/v1/analyze passa só as que precisas pra economizar.Catálogo
audio
~R$ 0,008/min de vídeoDetecta picos de volume, silêncio, energia espectral e mood.
{ rms_mean, rms_peaks, silence_intervals, energy_centroid, mood_label }scenes
~R$ 0,012/minSegmenta o vídeo em cenas via descontinuidades visuais (cuts e fades).
[{ scene_id, start_sec, end_sec, kind: 'hard_cut'|'fade'|'dissolve' }]ocr
~R$ 0,020/minExtrai texto que aparece on-screen (legendas, banners, slides).
[{ text, bbox: [x,y,w,h], confidence, start_sec, end_sec, lang }]transcript
~R$ 0,030/minTranscreve fala pra texto (PT/EN/ES + 90+ idiomas via Whisper).
[{ start_sec, end_sec, text, speaker_id?, confidence }]bpm
~R$ 0,005/minEstima tempo musical (batidas por minuto) e identifica beats.
{ bpm: 128.4, beat_times: [0.42, 0.89, ...], confidence }nsfw
~R$ 0,015/minScore de conteúdo adulto/sensitive frame-a-frame.
[{ frame_idx, score: 0..1, category: 'safe'|'suggestive'|'explicit' }]faces
~R$ 0,025/minDetecta + tracking de rostos com bounding box + embedding opcional.
[{ face_id, bbox, frame_idx, embedding_id? }]Custos (estimativa)
Os números acima são estimativas baseadas em vídeo 1080p 30fps. Custo real varia por resolução e densidade de conteúdo. Tu vê custo real no dashboard de uso (N+3, em breve).
Budget cap por produto é a tua proteção: defines R$ X por mês, atingiu → API rejeita com HTTP 402 até virar mês ou tu aumentar o cap.