Cache
EngenhariaArmazenamento rápido e temporário de dados frequentemente acessados para evitar recalcular ou buscar do banco de dados.
Por que importa
Reduz latência de respostas em ordens de magnitude — dados em cache retornam em microsegundos vs milissegundos do disco.
Uma página de produto popular fica armazenada em cache por 1 hora; 99% dos acessos retornam do cache em vez de consultar o banco.
Veja também:Cache-aside,CDN
Cache-aside
EngenhariaPadrão de cache onde a aplicação é responsável por verificar se o dado está em cache, e se não estiver, busca do banco e armazena.
Por que importa
É o padrão mais flexível de cache — permite lógica customizada de invalidação e atualização.
Ao buscar um usuário, a app verifica Redis; se não estiver lá, consulta PostgreSQL e salva em Redis com TTL de 1 hora.
Veja também:Cache,Índice (banco de dados)
Camada oculta
IACamada intermediária de uma rede neural entre a entrada e saída, onde o modelo aprende representações abstratas dos dados.
Por que importa
Quanto mais camadas ocultas, mais complexos os padrões que a rede pode aprender — mas também maior o risco de overfitting.
Um modelo de classificação de imagens com 3 camadas ocultas aprende: bordas na primeira, formas na segunda, objetos na terceira.
Veja também:Rede neural,Peso,Função de ativação
CDN
Content Delivery NetworkCloudRede global de servidores que copia seus conteúdos estáticos e os serve a partir do local mais próximo do usuário.
Por que importa
Reduz latência para usuários globais — arquivos servidos de um servidor próximo em vez de cruzar continentes.
Um usuário no Brasil baixa uma imagem 10x mais rápido a partir de um servidor em São Paulo do que de um em Dublin.
Veja também:Edge computing,Latência,Throughput
Chain of thought
IATécnica que pede ao modelo LLM para explicitar seu raciocínio passo a passo antes de chegar à resposta final.
Por que importa
Melhora drasticamente a qualidade das respostas em problemas complexos — modelos acertam mais quando explicam a lógica.
Em vez de perguntar "quanto é 17 × 8?", pede "Quanto é 17 × 8? Pense passo a passo." e o modelo gera: 17 × 8 = 17 × (5 + 3) = ...
Veja também:Prompt,Few-shot,Inferência
Ler artigo relacionado →
Chunking
IADivisão de um documento ou texto longo em pedaços menores (chunks) para alimentar um sistema de RAG ou embedding.
Por que importa
Textos muito longos perdem informações em embedding, e chunks pequenos demais fragmentam o contexto — o tamanho importa muito.
Um PDF de 100 páginas é dividido em chunks de 500 tokens com 50 tokens de sobreposição para preservar contexto entre pedaços.
Veja também:RAG,Embedding,Janela de contexto
Ler artigo relacionado →
CI/CD
Continuous Integration / Continuous DeploymentEngenhariaPrática de integrar código frequentemente (CI) e deployar mudanças automaticamente para produção (CD) após testes.
Por que importa
Reduz tempo entre escrever código e ter em produção de semanas para minutos, e detecta bugs antes de afetar usuários.
Um merge em main dispara testes automaticamente; se passarem, o código é deployado para produção em 5 minutos.
Veja também:Rollback,Observabilidade,Terraform
Cloud computing
CloudModelo de computação que entrega poder de processamento, armazenamento e aplicações pela internet em vez de máquinas locais.
Por que importa
Elimina custos de hardware local, permite escala sob demanda e não requer expertise em manutenção de servidores.
Em vez de comprar um servidor para $5k, pague $500/mês na AWS e escale de 1 para 1000 máquinas em segundos.
Veja também:IaaS,PaaS,SaaS
Container
CloudPacote isolado que contém uma aplicação, suas dependências e sistema de arquivos, garantindo que rode igual em qualquer lugar.
Por que importa
"Funciona na minha máquina" deixa de ser problema — o container funciona idêntico em desenvolvimento, teste e produção.
Uma aplicação Node.js em um container Docker roda exatamente igual no laptop do dev, no CI e no servidor de produção.
Veja também:Docker,Kubernetes,Imagem de container
Ler artigo relacionado →