DeepSeek изменил ландшафт открытых LLM в конце 2025 - начале 2026:
- DeepSeek-V3 671B: MoE архитектура с 37B активных параметров. Качество уровня GPT-4o при стоимости обучения 5.5 млн долларов вместо сотен миллионов.
- DeepSeek-R1: Первая открытая reasoning-модель, конкурирующая с OpenAI o1. Решает математические олимпиады, сложные алгоритмические задачи.
- DeepSeek-R1-Distill: Дистиллированные версии 1.5B-70B на базе Qwen и Llama. Бюджетный reasoning на скромном железе.
- DeepSeek-Coder-V2: Лидер среди открытых моделей для кода. Превосходит GPT-4 на HumanEval и MBPP.
- DeepSeek-Math: Специализация на математических задачах с цепочками рассуждений.
Все модели под MIT-подобной лицензией - можно использовать коммерчески, fine-tune и распространять без ограничений. Anubiz Host разворачивает DeepSeek на любом масштабе - от одиночной RTX 4090 до 8x H100 фермы.