Мощный блог

В данном блоге доступно 8 постов на разные темы

По запросу нашлось 4 поста
Квантование: разберись уже с этим

Квантование: разберись уже с этим

24 августа 2026

Квантование (quantization) LLM — это процесс уменьшения точности весов нейросети для снижения вычислительных затрат с сохранением приемлемой предсказательной точности автогенерации. Если совсем простым языком говорить, это как сжатие в JPEG …

Читать статью →
Tools vs Skills: чем инструменты агента отличаются от навыков

Tools vs Skills: чем инструменты агента отличаются от навыков

11 августа 2026

Инструмент (Tool) — это механизм интеграции LLM с внешним миром. Технически инструменты реализуются в виде функций или методов классов и позволяют компенсировать врождённые ограничения языковых моделей. Основные ограничения LLM: Временные …

Читать статью →
Язык, на котором говорят LLM: разбираем контракт OpenAI API

Язык, на котором говорят LLM: разбираем контракт OpenAI API

4 августа 2026

API-вызовы (OpenAI-совместимый формат): запрос и ответ При работе с LLM часто требуется знать верхнеуровневый формат «запрос-ответ», который обеспечивает полноценную коммуникацию между клиентом и LLM. Единого официального стандарта нет: каждый вендор …

Читать статью →
Битва за память: как VRAM, RAM и PCIe влияют на скорость LLM

Битва за память: как VRAM, RAM и PCIe влияют на скорость LLM

4 августа 2026

Как понять, запустится ли модель на локальном ПК Если на ПК только CPU Формула для очень грубой оценки: text ток/с ≈ пропускная способность RAM / размер модели в памяти Во …

Читать статью →