Справочник современных модельных семейств

Декодерные трансформеры (Autoregressive LLM)

Основаны на последовательном предсказании следующего токена. Используют причинно-следственные маски внимания (Causal Masking), RoPE (Rotary Position Embeddings) и оптимизацию KV-кэша.

Латентные диффузионные модели (LDM)

Выполняют итеративное шумоподавление не в пространстве пикселей, а в сжатом векторном представлении VAE, что снижает вычислительную сложность генерации высокого разрешения.