O que as pessoas realmente salvam: um estudo de dados (2026)
studies

O que as pessoas realmente salvam: um estudo de dados (2026)

Analisamos os primeiros 119 vídeos salvos no SavedThat. Mix de plataformas, distribuição de duração, comportamento de busca e o que os primeiros usuários nos contam sobre fluxos de vídeo salvo.

SavedThat team11 min read

A maioria dos artigos «o que as pessoas salvam» é vibe. A gente puxou a consulta real.

Este é um estudo de dados honesto dos primeiros 119 vídeos salvos no SavedThat por 43 usuários early, e das 202 buscas que esses usuários rodaram. Amostra pequena, caveats transparentes. Abaixo: o que os números realmente dizem sobre como as pessoas salvam e reencontram vídeos em 2026.

O destrinche completo está no final do post. As três descobertas que nos surpreenderam:

  1. YouTube não domina por contagem, domina por densidade de conteúdo. Dois terços dos vídeos salvos são YouTube, mas representam 30+× o volume de conteúdo falado de Instagram + TikTok combinados.
  2. 16% das buscas retornam zero resultado. Ou o usuário salvou o vídeo errado, ou consultou antes de salvar o certo. Os dois são sinais de produto.
  3. A deduplicação cross-user opera mesmo nessa escala. 158 favoritos apontam pra 112 vídeos únicos — cerca de 1 em 7 salvos é um duplicado de uma transcrição já indexada por outra pessoa.

O dataset

Pequeno. Caveat assumido na frente. A gente vai rerodar quando o corpus bater 1.000 e de novo em 10.000. Padrões em 100 são barulhentos mas interessantes porque são atuais e moldados por quem realmente se cadastrou num produto em early-stage.

O que segue é o destrinche.

Mix de plataformas: YouTube dois terços, formatos curtos um terço

PlataformaVídeos salvos% dos salvosDuração média
YouTube + Shorts7966%30:10 min
Reels do Instagram3328%0:56 seg
TikTok76%0:26 seg

Dois terços YouTube confirma o que o marketing de toda ferramenta de favoritos pressupõe: salvos de vídeo long-form ainda dominam o caso prosumer. O que nos surpreendeu foi o gap dentro do próprio YouTube — vídeos em média de 30 minutos significam que nossos usuários early salvam podcasts, entrevistas e talks de conferência, não Shorts. Compara com a duração mediana oficial de upload do YouTube — o vídeo mediano na plataforma é muito mais curto, então o que as pessoas salvam está bastante enviesado pra conteúdo mais longo.

Instagram entra em segundo com 28% — são Reels de formato curto em média abaixo de um minuto. Salvar um Reel e salvar um episódio de 90 minutos do Lex Fridman são claramente jobs diferentes mesmo que os dois acabem na mesma biblioteca.

TikTok é terceiro com 6%, principalmente porque a cohort enviesa mais velha (founders, pesquisadoras, gente de produto). Isso vai se reequilibrar rápido conforme a audiência do SavedThat se amplia.

O ratio escondido: volume de conteúdo falado

Contagens enganam. Vamos multiplicar:

Salvos do YouTube contribuem 30× mais volume de conteúdo falado que Instagram + TikTok combinados. A categoria parece equilibrada por contagem e é bem desbalanceada pelo que há de fato dentro dos vídeos. Isso importa pra fluxos de busca em transcrição: a maioria das consultas devolve hits do YouTube não porque o YouTube está super-representado nos salvos, mas porque vídeos do YouTube contêm vastamente mais texto pra dar match.

Distribuição de duração: bimodal

Os 119 vídeos se ordenam em duas corcovas claras com um vale:

Faixa de duraçãoVídeos% do total
Menos de 1 minuto3832%
1-10 minutos2824%
10-30 minutos2319%
30-60 minutos1311%
Mais de 1 hora119%

A corcova 32% de menos-de-um-minuto é majoritariamente Reels e TikToks — salvos rápidos de receitas, demos, piadas. As corcovas superiores 19% + 11% + 9% (43 vídeos, 36%) são conteúdo long-form do YouTube onde a densidade de informação por vídeo justifica o salvar.

A faixa do meio 1-10 minutos (24%) é a mais estranha — tutoriais do YouTube, clipes curtos do Lex Fridman, highlights de podcast. É onde o «watch later» historicamente ia morrer porque os vídeos são longos demais pra scroll-watching casual e curtos demais pra valer agendar. A busca em transcrição salva especificamente essa faixa: com 5 minutos por vídeo, você nunca reassistiria pra achar uma citação, então busca-por-conteúdo é o único caminho de recuperação.

Comportamento de busca: taxa de zero-resultado de 16%

A gente logou 202 buscas por 15 dos 43 usuários. Três números se destacam:

A taxa de 16% de zero-resultado é a métrica mais interessante. Três diagnósticos do porquê:

  1. Corpus errado. Usuário buscou citação de vídeo que ainda não tinha salvado. Comum na primeira semana de uso. O conserto é do lado do produto: mostrar um empty state «salva um vídeo primeiro» quando um usuário com menos de 3 salvos consulta.
  2. Erro semântico. O idioma da consulta estava longe demais do idioma da transcrição e a reciprocal rank fusion não fechou o gap. A gente vê isso principalmente quando usuários consultam em russo contra uma biblioteca toda em inglês.
  3. Transcrições genuinamente ruins. Um punhado de vídeos com auto-legendas que não cobriram bem o conteúdo falado. Busca não consegue achar o que não foi indexado.

Essas três causas se dividem mais ou menos parelhas na revisão manual que a gente fez em 20 buscas de zero-resultado. Cada uma é fix de produto; nenhuma é fix do motor de busca.

A taxa de engajamento de busca de 35% é honesta e provavelmente típica pra uma ferramenta cujo valor se acumula com o tamanho da biblioteca — com menos de 5 salvos por usuário, não tem nada útil pra buscar. A gente vai rerodar isso quando as contas cruzarem 20 salvos em média pra ver se o engajamento converge.

Deduplicação cross-user: 1 em 7 salvos é dup

158 favoritos contra 112 peças únicas de conteúdo significa que cerca de 41% dos usuários ao menos uma vez salvaram um vídeo que outra pessoa já tinha salvado. O vídeo único mais salvo tem 11 favoritos entre usuários. Favoritos médios por peça de conteúdo: 1,41.

Esse é um sinal econômico direto. Cada salvo duplicado é um fetch de transcrição + custo de embedding OpenAI que a gente não paga (Instagram/TikTok são pagos via Supadata; YouTube é grátis mas custa em compute). A 41% de taxa de hit dedup num corpus de 43 usuários, o store de conteúdo cross-user já está economizando dinheiro real. Em 1.000 usuários, a gente esperaria a taxa subir pra 70%+ — vídeos populares convergem.

A implicação de produto: quando um usuário novo salva um vídeo popular, ele aterrissa na biblioteca em menos de um segundo com zero custo de crédito, porque transcrição e embeddings já existem. Essa experiência é um moat — concorrentes com stores de conteúdo por-usuário não conseguem igualar.

O que isso nos diz sobre a categoria

Três takeaways:

Busca em transcrição é feature de vídeo long-form. O gap de 30× de densidade de conteúdo entre YouTube e formato curto significa que o peso técnico está no lado long-form. Transcrições de Reel e TikTok são baratas de puxar e buscar; transcrições do YouTube é onde o volume de índice e o trabalho de qualidade de recuperação compensa.

A faixa de duração média não tem dono. Vídeos de 1-10 minutos são 24% dos salvos e os menos servidos pelas ferramentas existentes. O «Watch Later» nativo do YouTube trata como vídeos de 60 minutos (passa scroll). Ferramentas de formato curto (Glasp) tratam como vídeos de 60 segundos (grifa momentos específicos). Nenhum encaixa. Uma ferramenta de busca em transcrição que serve bem a faixa 1-10 minutos ganha esse segmento, e quase ninguém está otimizando pra ela.

Dedup cross-user é sub-marketada. Toda ferramenta de busca em transcrição exceto SavedThat trata a biblioteca de cada usuário como banco próprio. Em 100 usuários isso não importa. Em 10.000 usuários, é a diferença entre margem sustentável e queimar crédito OpenAI em conteúdo duplicado. A gente espera o resto da categoria copiar nos próximos 12 meses.

O que a gente vai rerodar

Esse estudo inteiro é feito pra ser re-runável. A gente vai publicar updates em três marcos:

Se quer estar no próximo snapshot, a biblioteca em que você salva é a que a gente conta. Vê pricing ou começa grátis.

Os números crus

Tudo mais neste post deriva desta tabela. A gente publica pra que qualquer afirmação acima seja verificável contra a fonte.

MétricaValor
Total de vídeos com `status=ready`119
Total de favoritos de usuário (linhas videos.videos)158
Conteúdo único (videos.video_content_id distinct)112
Usuários cadastrados43
Usuários que buscaram pelo menos uma vez15
Total de buscas logadas202
Resultados médios por busca13,5
Buscas de zero resultado33 (16%)
YouTube + Shorts (ready)79
Reels do Instagram (ready)33
TikTok (ready)7
Duração média YouTube1.810 seg (30:10)
Duração média Reel56 seg
Duração média TikTok26 seg
Vídeo único mais favoritado11 usuários
Favoritos médios por peça de conteúdo1,41
Taxa de hit dedup cross-user~41%

Snapshot tirado: 11 de maio de 2026.

Keep reading

Frequently asked questions (2026)

119 vídeos é o bastante pra tirar conclusões?

Não — por isso é enquadrado como snapshot, não estudo. Padrões em 100 vídeos são direcionalmente interessantes mas estatisticamente magros. A gente publica a metodologia e os números exatos pra que o próximo snapshot em 1.000 e 10.000 seja comparável, não pra que quem lê tome decisões de negócio numa amostra de 119 linhas.

Algum usuário foi excluído dos dados?

Três linhas de video_content em status `failed` foram excluídas (o fetch de transcrição errou além do limite de retries). Todos os 43 usuários cadastrados estão incluídos independente do número de salvos, incluindo os 28 usuários que ainda não buscaram. A gente não excluiu nenhuma demografia de usuário — o snapshot reflete todo mundo cadastrado em 11 de maio de 2026.

Como o «volume de conteúdo falado» foi calculado?

Contagem de vídeos por plataforma multiplicada pela duração média em segundos. Isso aproxima o conteúdo falado total porque a contagem de palavras da transcrição correlaciona linearmente com a duração pra maior parte da fala. A gente não conta segmentos silenciosos, música ou conteúdo visual — só a duração portadora de fala.

Por que a média de favoritos por conteúdo (1,41) é tão baixa?

A dedup cross-user se compõe com o tamanho da cohort. Em 43 usuários amostrados de um lançamento early de produto, a maioria dos vídeos ainda tem só um favorito. Conforme os usuários cadastrados crescem, os vídeos mais populares acumulam favoritos mais rápido do que vídeos novos são salvos, e a média sobe. O Pocket alcançou 5-7× favoritos médios por URL em escala; a gente espera trajetória similar.

Vão rerodar esse estudo em escala?

Sim — em 1.000 vídeos, 10.000 vídeos e 100.000 vídeos. Cada post de marco vai manter a mesma metodologia e formato de tabela pra leitoras conseguirem comparar os números diretamente. Assina o RSS do blog do SavedThat ou segue o founder no X pro próximo snapshot.

Posso ver os dados crus?

Não — vídeos salvos e consultas de busca são dados privados de usuário e não exportáveis. Os números agregados deste post são calculados a partir de contagens anonimizadas; nada na tabela publicada pode ser rastreado até um usuário ou vídeo individual. Se quer verificar a metodologia, cadastra no SavedThat e vai ver os mesmos padrões de consulta na sua própria biblioteca.