Transparência editorial

Como sabemos

Uma afirmação só é tão útil quanto a fonte, o universo e os limites que a acompanham.

Hierarquia de fontes

Usamos fontes administrativas portuguesas para confirmar a presença numa lista publicada, as regras gerais de composição do nome e as estatísticas divulgadas. Obras onomásticas e investigação académica sustentam etimologia e história. Fontes jornalísticas podem ajudar a localizar uma publicação primária, mas não substituem essa publicação. A presença — ou ausência — na lista usada pelo catálogo não constitui uma decisão individual de admissibilidade jurídica.

Do documento ao verbete

  1. Registamos entidade responsável, título, URL, cobertura, data de consulta, condições de reutilização e checksum ou a razão da sua ausência.
  2. Conservamos a grafia publicada e criamos separadamente uma forma normalizada para pesquisa.
  3. Cada afirmação editorial recebe uma ou mais referências e um estado de revisão.
  4. Descrevemos conflitos entre fontes; não escolhemos uma versão sem fundamento.
  5. A validação rejeita entradas sem fonte registada, afirmações sem referência e observações que não cumpram o contrato estatístico.

Ausência não é zero

Um campo vazio significa que os dados adequados não estão publicados neste catálogo. Não demonstra que o nome não existe, não foi registado ou não ocorre num território.

Rankings e décadas

O snapshot atual cobre 2017–2023 (7 anos disponíveis) e contém as tabelas oficiais Top 20, separadas em feminino e masculino. Recalculamos a posição por contagem decrescente: empates recebem a mesma posição e a posição seguinte salta os lugares empatados. Uma soma por década inclui apenas anos em que o nome aparece num Top 20 disponível. Não estima anos ausentes, não conta nomes fora do Top 20 e não representa o total nacional da década.

Relações entre verbetes

Uma variante recebe uma ligação apenas quando a grafia documentada corresponde exatamente a um único verbete existente e a mesma fonte sustenta uma afirmação verificada. O tipo histórico exige ainda que a afirmação identifique expressamente a forma de origem. Variantes sem destino exato e único continuam como texto, sem ligação inferida. O índice de relações reproduz integralmente estas ligações.

Política de indexação editorial

Cada verbete de catálogo identifica a grafia, a classificação e a fonte que sustentam a sua existência nesta edição. Quando faltam etimologia ou estatísticas, a página declara a lacuna em vez de gerar uma explicação. As grafias próximas servem apenas para navegação alfabética e são acompanhadas por uma advertência explícita: proximidade no índice não significa variante nem relação histórica.

Os guias editoriais respondem a perguntas mais amplas com texto próprio, autoria institucional, data de revisão e fontes visíveis. Não criamos páginas separadas para pequenas variações da mesma pergunta. Facetas com menos de 10 verbetes e o índice histórico enquanto tiver menos de três entradas continuam acessíveis por ligações internas, mas recebem noindex,follow e não entram nos sitemaps. Assim, a navegação conserva os dados sem promover como destino autónomo um recorte demasiado pequeno.

Privacidade geográfica

Não publicamos atualmente distribuições por concelho. Qualquer futura entrega terá de ser agregada e passar pela regra de supressão antes de chegar ao catálogo. Na ausência de uma regra mais restritiva do produtor, células com cinco ou menos ocorrências perdem a contagem e recebem o estado suprimido, nunca zero. A plataforma não tenta identificar pessoas nem inferir a sua residência.

Privacidade e medição

Nas páginas elegíveis, o contentor Google Tag Manager e o respetivo pedido à Google ficam adiados até existir consentimento explícito, dado nessa visita ou guardado anteriormente no navegador. Quando o contentor é carregado, apenas o armazenamento analítico (analytics_storage) fica autorizado; o armazenamento publicitário, de dados de utilizador e de personalização permanece negado. As páginas de ferramentas e de resultados de pesquisa nunca incluem o contentor, mesmo com consentimento, para que os valores introduzidos não fiquem acessíveis a scripts de medição. A escolha fica guardada no armazenamento local do navegador e pode ser alterada em «Gerir medição».

As sugestões apresentadas enquanto escreve usam um índice estático descarregado pelo navegador. Se submeter a página simples de resultados, o termo segue por HTTP GET para o servidor da aplicação; esse endpoint não mantém registo de acesso, responde com no-store, retira o termo do endereço e não inclui scripts de medição. Os nomes escritos no combinador familiar são processados no dispositivo; nenhum controlo das seis ferramentas é enviado por um formulário de recurso, e os valores pessoais não são copiados para o URL, armazenamento local ou pedidos da aplicação.

Automação responsável

O conector das tabelas Top 20 consulta semanalmente a API pública da Justiça, cria um snapshot canónico e só integra uma alteração depois de validar o formato, a proveniência, as 20 linhas de cada ano e segmento, as posições calculadas e o catálogo completo. A lista de nomes próprios do IRN tem um processo separado e manual, condicionado por autorização e checksum do artefacto. Uma falha não altera a versão pública anterior.

Limitações

As listas públicas do IRN e as estatísticas Top 20 divulgadas não formam uma série completa por nome, ano e concelho. Também não fornecem, por si só, etimologias, primeiras ocorrências históricas ou distribuições de apelidos. A página de cobertura quantifica os campos presentes e declara as lacunas conhecidas.

Formatos públicos v1

Todos os ficheiros identificam a versão do esquema. Cada JSON inclui uma atribuição explícita; o JSON de observações declara também a sua cobertura e o de décadas descreve o método de agregação. O JSON e o CSV de verbetes incluem as relações, os destinos e as respetivas fontes; o CSV conserva ainda uma coluna de atribuição. Os CSV de observações e décadas devem ser usados com os metadados dos JSON correspondentes: atribuir Antroponimia.pt e o Instituto dos Registos e do Notariado, conservar os identificadores de fonte disponíveis e não apresentar os resumos parciais como totais nacionais.

A série v1 recebe apenas campos adicionais compatíveis. Uma alteração incompatível será publicada numa nova versão de URL.