Обучение моделей с нуля или серьёзный supervised fine tuning без LoRA требует значительных ресурсов. Для моделей до 7B параметров рекомендуется dedicated сервер с двумя GPU RTX 4090 или A5000, 128 ГБ ОЗУ и NVMe SSD от 2 ТБ. Для моделей 13B и больше нужны конфигурации с 4 GPU или более, либо распределённое обучение между несколькими нодами с быстрой сетью. AnubizHost поддерживает оба варианта на dedicated тарифах с возможностью кастомной сборки под конкретный проект.
Сетевая связность критична при distributed training через FSDP или DeepSpeed, поскольку gradient синхронизация требует низкой латентности и высокой пропускной способности. Наши dedicated серверы оснащены сетью 10 Гбит/с по запросу и приватной сетью между нодами в том же дата-центре. Это даёт сопоставимый с InfiniBand уровень для большинства практических задач, кроме самых тяжёлых нагрузок уровня GPT-3 обучения.