top of page

Meu
Blog
Aqui eu compartilho minha jornada


Por que o decoder-only venceu a corrida dos LLMs generativos, e não o encoder-decoder original ou o encoder-only?
O encoder-only lê. O encoder-decoder transforma. O decoder-only continua e foi por isso que ele dominou os LLMs generativos. Não por ser mais inteligente. Por escalar melhor.
21 de jul.0 min de leitura


Por que a complexidade quadrática O(n²) da atenção é o gargalo econômico dos LLMs
Fluxo de agente com contexto limitado: nova mensagem passa pelo orquestrador, que recupera memórias e carrega o estado resumido; ambos montam um contexto enviado ao LLM; após a resposta, memória e resumo são atualizados.
14 de jul.0 min de leitura


Como a self-attention constrói contexto
Q, K e V aparecem em quase toda explicação sobre Transformers. Mas qual é a função de cada um? Entenda como a self-attention relaciona tokens, seleciona informações do contexto e atualiza suas representações.
7 de jul.0 min de leitura


IA in Action: quando a inteligência artificial deixa de responder e começa a executar
Este texto abre uma série de artigos sobre o SP Innovation Week 2026. A proposta é transformar anotações de palestras e painéis em análises acessíveis sobre inteligência artificial, inovação e transformação digital. Evento: SP Innovation Week 2026 Data: 13 a 15 de maio de 2026 Locais: Mercado Livre Arena Pacaembu e FAAP Trilha: IA in Action Tema do artigo: agentes de IA, governança, escala e execução empresarial Entre os dias 13 e 15 de maio de 2026, o São Paulo Innovation We
16 de mai.7 min de leitura
bottom of page
