A análise de dados não tem mal, o rastreamento é que é o problema
Nesta página
Escrevo só sobre o que me parece interessante. Não estou a correr uma experiência de growth hacking. Num blogue pessoal, os dados não servem para escalar, servem para validar o conteúdo. Precisas de saber: aquele texto cheio de opiniões sobre pensões acertou? Aquela funcionalidade de brincadeira teve algum clique?
Um bom conteúdo precisa de poucos dados, e limpos, para ser validado.
É por isso que todo o sistema de consentimento de cookies é frustrante. O problema não são os dados em si, é a arquitetura usada para os recolher.
Necessidade contra o “talvez”
Quando medes visualizações, tens uma escolha:
Análise é curiosidade: Contar visualizações anónimas para saber que texto funcionou. É essencial para um site com cuidado.
Rastreamento é vigilância: Ligar essa visualização a um indivíduo para construir um perfil com fins externos, como correr publicidade. Exige recolher identificadores pessoais e seguir o utilizador pela web fora.
Essa segunda opção não é necessariamente uma invasão de privacidade, mas pode ser. E o “pode ser” é que é o problema. Só devíamos rastrear o que é estritamente necessário. A minha curiosidade pessoal acaba em saber o que as pessoas estão a ler, e mais nada.
A pilha mínima
Para separar a minha curiosidade dessa arquitetura de vigilância, montei uma pilha sem esforço e sem custos. Instalei o Umami num servidor gratuito da Vercel com uma base de dados Neon Postgres. Demorei menos de meia hora.
O resultado? As estatísticas essenciais deste site funcionam sem banner. O Umami só recolhe dados anonimizados e agregados. Tivemos mais de 16 000 visitantes no último mês. Sim, isso é “uma miséria”, mas são 16 000 sessões éticas em que ninguém teve de consentir vigilância.
O que o minimalismo me diz sobre o conteúdo
Os dados são claros e acionáveis, e provam o valor da curiosidade simples:
O conteúdo vive para sempre: Já não publico no Hacker News, mas as estatísticas mostram que as ligações dos textos antigos lá continuam a trazer tráfego anos depois. É um retorno enorme para um site pessoal.
A IA é descoberta hiperespecífica: Reparei num aumento considerável de cliques vindos de serviços como o ChatGPT e o Perplexity, mas só nos meus artigos técnicos de nicho sobre CRDTs e economia da IA. A IA está a funcionar como um motor de referências técnicas muito específicas.
A brincadeira era rastreável: A razão toda para montar isto foi ver se alguém clicava no shakespeak. As estatísticas disseram-me que teve só uns poucos cliques, sobretudo do X e do LinkedIn. É uma aplicação parva, vai comer-te 700MB de dados, mas sei quem lá clica.
A verdadeira razão das bolachas 🍪
(Obviamente, estou a falar de cookies.)
Então porque é que tenho um banner de “bolachas”? Não é por causa das estatísticas.
É inteiramente por causa da brincadeira. A página /shakespeak tem um LLM descarregável que corre no teu navegador. No momento em que introduzes qualquer elemento fora do padrão e controlado pelo utilizador, mesmo que de brincadeira, disparas um alarme de conformidade.
O facto de eu poder correr de graça as estatísticas de leitura do site inteiro sem problema, mas uma brincadeira de LLM exigir um banner, resume na perfeição o estado ridículo da web. A opção ética e gratuita é agora o caminho mais fácil. Escolhes a necessidade em vez do “pode ser”.