Engenharia & AI
Arquitetura, AI e Decisões que Sobrevivem à Produção
System design, integração com AI e lições de quem já quebrou e consertou sistemas reais
-

Token budget por agente: o rate limiter que protege o seu orçamento
Token budget por agente: rate limit de provedor controla taxa, não gasto. Como impor teto de custo por request, sessão, agente e tenant. -

Latência, qualidade, custo e confiabilidade: o mapa do stack de inferência
Latência, qualidade, custo e confiabilidade: os quatro eixos que todo knob do stack de inferência move, com preços e limites verificados em 2026. -

Context engineering, não só prompts longos
Os quatro modos de falha de contexto e as táticas que mantêm agentes de IA confiáveis, além do prompt.







![Firecracker em produção: systemd, restart automático e a diferença entre demo e serviço de verdade [pt.5]](https://fogonacaixadagua.com.br/wp-content/uploads/2025/12/featured_firecracker_production_2.jpeg)
![Snapshots no Firecracker: de 9 segundos para 300ms [pt.4]](https://fogonacaixadagua.com.br/wp-content/uploads/2025/12/featured_firecracker_snapshot_2.jpeg)
![Redes no Firecracker: Configurando TAP, NAT e Internet para seu Nano-Lambda [pt.3]](https://fogonacaixadagua.com.br/wp-content/uploads/2025/12/featured_firecracker_network_3.jpeg)
![Construindo um nano-Lambda: como serverless funciona por dentro [pt.2]](https://fogonacaixadagua.com.br/wp-content/uploads/2025/12/featured_firecracker_qrcode_2.jpeg)