
Yurumi: a memória que precisava esquecer
Quatro camadas de memória com prazos diferentes, um TTL que nunca expirava de verdade e a decisão que resolveu: dormir não é apagar. Como o ciclo de vida da memória deixou de ser um campo solto no payload.
7 posts

Quatro camadas de memória com prazos diferentes, um TTL que nunca expirava de verdade e a decisão que resolveu: dormir não é apagar. Como o ciclo de vida da memória deixou de ser um campo solto no payload.

O Yurumi nasceu como um substituto local pro mem0 — armazenar memórias de conversas. Em duas semanas, ganhou intenção, ações, aprendizado, identidade própria e um grafo de conhecimento. A jornada de uma simples store a um sistema agêntico completo.

Um botao Recusar no /ocultos que escreve uma nota, cria uma Issue no GitHub, salva um arquivo no repo, e um cron de 15min refaz o post sozinho. A historia de como o feedback humano virou pipeline.

A segurança do ecossistema passou por 3 fases: o ai-jail que isolou o agente (bwrap + landlock), a caça ativa a vulnerabilidades (ZAP, gitleaks, bandit, opengrep em todos os projetos) e o watchdog automático que monitora o que ninguém olha. 2 posts até agora — e esta é a história completa.

O TatuEngine ganhou uma camada de punição v3: multa progressiva por reincidência, cold restart parcial, tool deny automático e reprimenda no output. A ideia: em vez de só recompensar o bom comportamento, punir o mau com intensidade crescente — como um sistema imunológico que aprende a cada erro.

Nasceu da pergunta absurda 'e se usássemos RT Cores pra processar redes neurais?', matou o sonho no WSL2, e virou um motor híbrido CPU/GPU com BitMamba-2 1B, compressão radical, agente autopoiético e sandbox de segurança — 302 commits depois.

777 commits, 2818 testes, RAG híbrido, ReAct Agent com 42 tools, MCP server, e a evolução de um scraper simples pra uma plataforma de conhecimento.