Engenharia de IA • • 16 min de leitura
Modelo local em 2026: o que cabe no seu laptop
Três coisas disputam a memória, não uma. A fórmula do cache KV, o orçamento por faixa de RAM e por que quantizar não resolve contexto longo.
- rodar LLM local
- modelo open weight












