Metodologia do Kaomojis — Curadoria, Classificação e QA
Esta página explica, em termos de engenharia, como o Kaomojis cura, classifica e mantém a qualidade de mais de 61.000 kaomoji. Não somos uma simples lista de copiar-colar: operamos design de dados, deduplicação, anotação multilíngue, ranking e QA de tradução como um pipeline integrado.
1. Ingestão
Fontes principais: kaomoji públicos de BBSes e mídias sociais japonesas, além de originais de nossos editores e submissões revisadas via /request.
Triagem automática rejeita conteúdo com personagens, marcas ou copyright.
Todas as strings passam por normalização Unicode NFC.
2. Deduplicação
Cada texto é hasheado com SHA-256 e aplicado UNIQUE no banco.
Quase-duplicatas são sinalizadas para revisão humana.
Cerca de 8% dos candidatos são rejeitados.
3. Categorização
Classificação em três camadas: categoria (emoção), evento, cena.
Rascunho IA → revisão editorial.
Desde a Phase 122 expandimos de 7 para 48 emoções.
4. Ranking
O score dinâmico combina qualidade editorial, cópias históricas/de 30 dias/de 7 dias, curtidas, status oficial e riqueza dos metadados.
Cópias e curtidas usam ponderação logarítmica para impedir que poucos itens populares dominem sem limite.
Recalculado a cada 15 minutos.
5. Pipeline multilíngue
O catálogo oferece 12 idiomas; a grande maioria dos kaomoji tem exemplos, palavras-chave e notas.
Idiomas principais passam por revisão humana.
Keywords são expressões naturais, não traduções literais.
6. QA de tradução
audit-translations.mjs --strict semanal. Meta < 5% sem tradução.
Novo idioma segue checklist de 16 arquivos.
7. Infraestrutura
Stack: Astro 6 SSR + React 19 + SQLite + PM2 + Cloudflare CDN.
TTFB ~25ms.
Sitemap: 415.000+ URLs.
8. Melhoria contínua
Cada mudança registrada como "Phase" — em 2026-04 estamos na Phase 554.
Análise GA4 + GSC 5× ao dia.
Testes A/B avaliados automaticamente.
Última atualização: 2026-04-15 (Phase 554)