Engenharia & AI
Arquitetura, AI e Decisões que Sobrevivem à Produção
System design, integração com AI e lições de quem já quebrou e consertou sistemas reais
-

Como delegar sem retrabalho: 6 perguntas antes do pedido
Explicar a tarefa leva 40 minutos, fazer leva 20. O checklist de 6 perguntas que eu respondo antes de delegar, e que serve também para prompt de IA. -

Prompt caching via API: a alavanca de custo que mora no formato do prompt
Prompt caching via API: escrever custa 25% a mais, ler custa 10%. O layout de prompt que vira economia real na Anthropic, OpenAI e Gemini. -

LLM gateway, não só API gateway: a política que decide quem atende cada request
LLM gateway não é só API gateway com outro nome. A política de roteamento com gatilho, trava de fallback e teto de gasto por classe.

![Firecracker em produção: systemd, restart automático e a diferença entre demo e serviço de verdade [pt.5]](https://fogonacaixadagua.com.br/wp-content/uploads/2025/12/featured_firecracker_production_2.jpeg)
![Snapshots no Firecracker: de 9 segundos para 300ms [pt.4]](https://fogonacaixadagua.com.br/wp-content/uploads/2025/12/featured_firecracker_snapshot_2.jpeg)
![Redes no Firecracker: Configurando TAP, NAT e Internet para seu Nano-Lambda [pt.3]](https://fogonacaixadagua.com.br/wp-content/uploads/2025/12/featured_firecracker_network_3.jpeg)
![Construindo um nano-Lambda: como serverless funciona por dentro [pt.2]](https://fogonacaixadagua.com.br/wp-content/uploads/2025/12/featured_firecracker_qrcode_2.jpeg)
![Firecracker: A tecnologia por trás do AWS Lambda que você pode rodar no seu Linux [pt.1]](https://fogonacaixadagua.com.br/wp-content/uploads/2025/12/featured_firecracker_2.jpeg)
