Мощный блог

В данном блоге доступно 8 постов на разные темы

По запросу нашлось 3 поста
Как KV-кеш поборол O(n²)

Как KV-кеш поборол O(n²)

25 августа 2026

Key-Value кеш — отличный пример того, как недостаточно предложить и теоретически обосновать даже такую сильную архитектурную идею, как трансформеры в LLM. Замечание 1. Трансформеры — это архитектурное решение, которое было …

Читать статью →
Квантование: разберись уже с этим

Квантование: разберись уже с этим

24 августа 2026

Квантование (quantization) LLM — это процесс уменьшения точности весов нейросети для снижения вычислительных затрат с сохранением приемлемой предсказательной точности автогенерации. Если совсем простым языком говорить, это как сжатие в JPEG …

Читать статью →
Битва за память: как VRAM, RAM и PCIe влияют на скорость LLM

Битва за память: как VRAM, RAM и PCIe влияют на скорость LLM

4 августа 2026

Как понять, запустится ли модель на локальном ПК Если на ПК только CPU Формула для очень грубой оценки: text ток/с ≈ пропускная способность RAM / размер модели в памяти Во …

Читать статью →