Por que o decoder-only venceu a corrida dos LLMs generativos, e não o encoder-decoder original ou o encoder-only?
Comentários