Выбор видеокарты зависит от модели и объёма VRAM:
- RTX 3060 12GB: Stable Diffusion 1.5/SDXL, fine-tuning маленьких моделей, дешёвый вход в ML.
- RTX 4070/4080 16GB: комфортная работа со Stable Diffusion XL, LLM 7B-13B в 4-bit квантизации.
- RTX 4090 24GB: LLM до 30B в 4-bit, обучение средних моделей, потребительский топ.
- Tesla A100 40/80GB: production LLM inference, обучение моделей до 70B параметров.
- H100 80GB: топ-уровень для обучения foundation моделей, FP8 inference.
Для большинства side-проектов и индивидуальной работы достаточно RTX 4090 24GB. Для production inference сервиса с большой нагрузкой - A100 или H100. Anubiz Host работает с разными конфигурациями под индивидуальный запрос.