O que existe hoje no projeto, com caminho e estado. É o "banco de dados" de onde o site nasce.
Vídeo e áudio#
| Item | Caminho | Estado |
|---|---|---|
| A entrevista, 2h17m17s, MP4 H.264/AAC | 19971125 - … .mp4 (raiz, 1,25 GB) | pronto para web; hospedagem a decidir (decisão nº 4) |
| Legendas sincronizadas | transcricao/mojsie-1997.srt (1.237 blocos) | corrigida nos pontos críticos; conversível a WebVTT por script |
| Original WMV | raiz (1,1 GB) | arquivo-mãe; não vai ao site |
| Trechos de áudio da voz dele | — | a produzir (recortes do MP4), se o modo imersivo usar |
Texto — a voz dele#
| Item | Caminho | Números |
|---|---|---|
| Transcrição verbatim | transcricao/01-verbatim.md | 487 turnos, ~800 âncoras [mm:ss], marcações [?] com notas de método |
| Transcrição revisada | transcricao/02-revisada.md | 406 turnos, mesmos timestamps |
| Como ler (o método) | transcricao/00-como-ler.md | vira a página "sobre a transcrição" |
| Índice temático + cronologia por fita | transcricao/03-indice.md | 5 fitas, ~140 entradas temáticas |
A jornada (dados estruturados em potencial)#
| Item | Caminho | Números |
|---|---|---|
| Linha do tempo 1914–1950 | cronologia/linha-do-tempo.md | ~85 eventos, cada um com fonte tipada ENTREVISTA hh:mm / DOCUMENTO / HISTÓRIA / INFERÊNCIA — é o dataset da timeline |
| Catálogo de achados | CATALOGO-DOS-ACHADOS.md | D01–D19 (documentos), P01–P11 (pessoas), H01–H09 (história), C01–C06 (correções); índice cruzado minuto-a-minuto do vídeo → achados (~35 linhas) — é o dataset dos painéis e do PiP |
| Dossiês de contexto | contexto/00–17 | 17 arquivos; viram os textos "o mundo em volta" dos painéis |
| Dados biográficos canônicos | fontes/dados-biograficos.md | nomes, grafias, datas, a linhagem de Błaszki (5 gerações), a árvore 1 → 23 |
Imagens#
| Item | Caminho | Números |
|---|---|---|
| Fotos e documentos da família (da apresentação do bisneto) | fontes/fotos/ + README com legendas | 17 JPG + 3 PNG (mapas compostos) — inclui a foto de 1938, Herz na loja, carteira de admissão, casamento, cocheiro, carta Spielberg |
| Documentos de arquivo (pesquisa 2026) | pesquisa/docs/ + README de proveniência | ~35 arquivos: cartão da família (Kalisz 1934), ficha DP 1946, lista do Groix, KAP 1929, plano de 1927, cartão de Ebensee, p. 148 de Majdanek, registro WJC 1945, fichas Tauba… |
| Fotos em alta da família | — | pendente da família (backlog B2): originais da foto de 1938, tenaim físico etc. |
| Foto da família do tio Rafu | Yad Vashem (registro 13987692) | online; publicação exige verificação de termos |
A pesquisa viva#
| Item | Caminho | Uso no site |
|---|---|---|
| Achados por rodada | pesquisa/achados.md | seção "a busca continua" / changelog |
| Próximos passos | pesquisa/proximos-passos.md | idem |
| Pedidos prontos | pesquisa/pedidos-prontos.md | privado da família (não publicar — contém estratégia de contato) |
| Perguntas abertas | espalhadas (Marisha, Kronstadt, foto de 1938…) | seção "o que ainda não sabemos" — honestidade como conteúdo |
Lacunas conhecidas (o que o site NÃO tem hoje)#
- Fotos em alta resolução (as atuais são recompressões do PDF)
- A tradução dos tenaim (B1) e a confirmação do "Aser Hersz" (pedido nº 10) — o site nasce com essas perguntas abertas por design
- Trechos de áudio recortados; imagens tratadas para parallax (produção)
- Qualquer dado estruturado em JSON — hoje tudo é Markdown (a conversão é parte do trabalho de código: um script que compila os .md em
timeline.json,catalogo.json,pessoas.json, mantendo os .md como fonte da verdade)