Справочник современных модельных семейств
Декодерные трансформеры (Autoregressive LLM)
Основаны на последовательном предсказании следующего токена. Используют причинно-следственные маски внимания (Causal Masking), RoPE (Rotary Position Embeddings) и оптимизацию KV-кэша.
Латентные диффузионные модели (LDM)
Выполняют итеративное шумоподавление не в пространстве пикселей, а в сжатом векторном представлении VAE, что снижает вычислительную сложность генерации высокого разрешения.