Skip to main content

Metodologia do Kaomojis — Curadoria, Classificação e QA

Esta página explica, em termos de engenharia, como o Kaomojis cura, classifica e mantém a qualidade de mais de 61.000 kaomoji. Não somos uma simples lista de copiar-colar: operamos design de dados, deduplicação, anotação multilíngue, ranking e QA de tradução como um pipeline integrado.

1. Ingestão

Fontes principais: kaomoji públicos de BBSes e mídias sociais japonesas, além de originais de nossos editores e submissões revisadas via /request.

Triagem automática rejeita conteúdo com personagens, marcas ou copyright.

Todas as strings passam por normalização Unicode NFC.

2. Deduplicação

Cada texto é hasheado com SHA-256 e aplicado UNIQUE no banco.

Quase-duplicatas são sinalizadas para revisão humana.

Cerca de 8% dos candidatos são rejeitados.

3. Categorização

Classificação em três camadas: categoria (emoção), evento, cena.

Rascunho IA → revisão editorial.

Desde a Phase 122 expandimos de 7 para 48 emoções.

4. Ranking

O score dinâmico combina qualidade editorial, cópias históricas/de 30 dias/de 7 dias, curtidas, status oficial e riqueza dos metadados.

Cópias e curtidas usam ponderação logarítmica para impedir que poucos itens populares dominem sem limite.

Recalculado a cada 15 minutos.

5. Pipeline multilíngue

O catálogo oferece 12 idiomas; a grande maioria dos kaomoji tem exemplos, palavras-chave e notas.

Idiomas principais passam por revisão humana.

Keywords são expressões naturais, não traduções literais.

6. QA de tradução

audit-translations.mjs --strict semanal. Meta < 5% sem tradução.

Novo idioma segue checklist de 16 arquivos.

7. Infraestrutura

Stack: Astro 6 SSR + React 19 + SQLite + PM2 + Cloudflare CDN.

TTFB ~25ms.

Sitemap: 415.000+ URLs.

8. Melhoria contínua

Cada mudança registrada como "Phase" — em 2026-04 estamos na Phase 554.

Análise GA4 + GSC 5× ao dia.

Testes A/B avaliados automaticamente.

Última atualização: 2026-04-15 (Phase 554)