Autor: DK
-

Como delegar sem retrabalho: 6 perguntas antes do pedido
Explicar a tarefa leva 40 minutos, fazer leva 20. O checklist de 6 perguntas que eu respondo antes de delegar, e que serve também para prompt de IA. -

Prompt caching via API: a alavanca de custo que mora no formato do prompt
Prompt caching via API: escrever custa 25% a mais, ler custa 10%. O layout de prompt que vira economia real na Anthropic, OpenAI e Gemini. -

LLM gateway, não só API gateway: a política que decide quem atende cada request
LLM gateway não é só API gateway com outro nome. A política de roteamento com gatilho, trava de fallback e teto de gasto por classe. -

Cost attribution por feature, workflow e tenant: de qual bolso saiu cada token
Cost attribution de LLM: o contrato de atribuição que amarra cada request a feature, workflow e tenant, do gateway ao relatório por tenant. -

Token budget por agente: o rate limiter que protege o seu orçamento
Token budget por agente: rate limit de provedor controla taxa, não gasto. Como impor teto de custo por request, sessão, agente e tenant. -

Latência, qualidade, custo e confiabilidade: o mapa do stack de inferência
Latência, qualidade, custo e confiabilidade: os quatro eixos que todo knob do stack de inferência move, com preços e limites verificados em 2026. -

Context engineering, não só prompts longos
Os quatro modos de falha de contexto e as táticas que mantêm agentes de IA confiáveis, além do prompt. -

O efeito snowball: por que a mensagem 50 pesa 6x na janela de contexto
Cada mensagem pesa mais na janela de contexto. A fórmula do custo quadrático e um HUD de statusline pra ver a bola de neve crescer. -

Harness engineering, não só prompt engineering
Harness engineering: guias, sensores e correções no ambiente tornam agentes de código mais confiáveis, além do prompt. -

Se um LLM só puder ler 5 páginas do seu site, quais seriam?
O que é llms.txt, pra que serve, quando usar e quando não usar. Com exemplos reais do Stripe, Supabase e deste próprio blog -

O líder que você acha que é não é o líder que o time percebe
O que te tornou referência técnica pode estar travando seu time agora. Um método para enxergar como você realmente aparece para quem lidera. -

E se o seu problema não for um problema de verdade?
Sente que as buchas não param de crescer? Às vezes só precisamos de um jeito novo de olhar pra elas e entender que fazer menos, pode ajudar mais no dia a dia -
![Transformando logs em alertas: monitoramento proativo com Graylog [pt.3]](https://fogonacaixadagua.com.br/wp-content/uploads/2025/12/featured_graylog_alert.jpg)
Transformando logs em alertas: monitoramento proativo com Graylog [pt.3]
Logs sem alertas são como câmeras de segurança sem ninguém assistindo. Neste tutorial, transformamos o Graylog em um sistema de detecção ativa com 6 alertas práticos -
![Gravando sessões de terminal com tlog: Auditoria que funciona [pt.2]](https://fogonacaixadagua.com.br/wp-content/uploads/2025/12/featured_image_tlog.jpg)
Gravando sessões de terminal com tlog: Auditoria que funciona [pt.2]
Aprenda a gravar sessões de terminal no Linux com tlog e enviar para o Graylog. Substitua o rootsh por uma solução moderna com reprodução fiel e logs centralizados. -
![Montando seu servidor de logs com Graylog: A base de toda auditoria [pt.1]](https://fogonacaixadagua.com.br/wp-content/uploads/2025/12/featured_auditoria_01.jpg)
Montando seu servidor de logs com Graylog: A base de toda auditoria [pt.1]
Logs espalhados são logs perdidos. Neste artigo, montamos um servidor centralizado com Graylog, OpenSearch e MongoDB: a fundação necessária antes de qualquer estratégia de auditoria em Linux
