Обучение LLM

130 товаров
AI-сервер Huawei Atlas 800T A2 — 8× Ascend 910B 64GB, 4× Kunpeng 920, RAM 512GBAI-сервер Huawei Atlas 800T A2 — 8× Ascend 910B 64GB, 4× Kunpeng 920, RAM 512GBAI-сервер Huawei Atlas 800T A2 — 8× Ascend 910B 64GB, 4× Kunpeng 920, RAM 512GB
AI-сервер Huawei Atlas 800T A2 — 8× Ascend 910B 64GB, 4× Kunpeng 920, RAM 512GB
от 30 223 775 ₽
39 449 980 ₽
-23%
Производитель
Huawei
Тип оборудования
Сервер (AI-ускоритель, NPU)
Наличие
В наличии
GPU: модель × количество
Huawei Ascend 910B × 8
AI-сервер ASUS RS720QN-E11-RS24U — 8× RTX PRO 4500 BSE 32GB, 8× Grace, RAM 1.9TBAI-сервер ASUS RS720QN-E11-RS24U — 8× RTX PRO 4500 BSE 32GB, 8× Grace, RAM 1.9TBAI-сервер ASUS RS720QN-E11-RS24U — 8× RTX PRO 4500 BSE 32GB, 8× Grace, RAM 1.9TB
AI-сервер ASUS RS720QN-E11-RS24U — 8× RTX PRO 4500 BSE 32GB, 8× Grace, RAM 1.9TB
от 14 562 455 ₽
18 547 969 ₽
-21%
Производитель
ASUS
Тип оборудования
Сервер (GPU-ускоритель)
Наличие
В наличии
GPU: модель × количество
NVIDIA RTX PRO 4500 Blackwell Server Edition × 8 (по 2 GPU на узел)
AI-сервер NVIDIA GB200 NVL72 — 72× GB200 Grace BlackwellAI-сервер NVIDIA GB200 NVL72 — 72× GB200 Grace Blackwell
от 345 563 545 ₽
429 226 298 ₽
-19%
Производитель
NVIDIA
Тип оборудования
Rack-scale AI-система (стоечная, жидкостное охлаждение)
Наличие
В наличии
GPU: модель × количество
NVIDIA GB200 (Blackwell) × 72
AI-сервер Supermicro NVIDIA GB300 NVL72 — 72× GB300 Grace Blackwell UltraAI-сервер Supermicro NVIDIA GB300 NVL72 — 72× GB300 Grace Blackwell Ultra
от 442 156 410 ₽
600 401 862 ₽
-26%
Производитель
Supermicro
Тип оборудования
Rack-scale AI-система (стоечная, жидкостное охлаждение)
Наличие
В наличии
GPU: модель × количество
NVIDIA GB300 (Blackwell Ultra) × 72
AI-сервер Supermicro NVIDIA GB200 NVL72 — 72× GB200 Grace BlackwellAI-сервер Supermicro NVIDIA GB200 NVL72 — 72× GB200 Grace Blackwell
от 345 406 510 ₽
447 210 534 ₽
-23%
Производитель
Supermicro
Тип оборудования
Rack-scale AI-система (стоечная, жидкостное охлаждение)
Наличие
В наличии
GPU: модель × количество
NVIDIA GB200 (Blackwell) × 72
AI-сервер NVIDIA GB300 NVL72 — 72× GB300 Grace Blackwell UltraAI-сервер NVIDIA GB300 NVL72 — 72× GB300 Grace Blackwell Ultra
от 442 328 360 ₽
530 794 032 ₽
-17%
Производитель
NVIDIA
Тип оборудования
Rack-scale AI-система (стоечная)
Наличие
В наличии
GPU: модель × количество
NVIDIA GB300 (Blackwell Ultra) × 72
AI-сервер GIGABYTE NVIDIA GB300 NVL72 — 72× GB300 Grace Blackwell UltraAI-сервер GIGABYTE NVIDIA GB300 NVL72 — 72× GB300 Grace Blackwell Ultra
AI-сервер GIGABYTE NVIDIA GB300 NVL72 — 72× GB300 Grace Blackwell Ultra
от 442 423 645 ₽
591 450 557 ₽
-25%
Производитель
GIGABYTE
Тип оборудования
Rack-scale AI-система (стоечная, жидкостное охлаждение)
Наличие
В наличии
GPU: модель × количество
NVIDIA GB300 (Blackwell Ultra) × 72
AI-сервер GIGABYTE NVIDIA GB200 NVL72 — 72× GB200 Grace BlackwellAI-сервер GIGABYTE NVIDIA GB200 NVL72 — 72× GB200 Grace Blackwell
AI-сервер GIGABYTE NVIDIA GB200 NVL72 — 72× GB200 Grace Blackwell
от 346 077 305 ₽
433 507 361 ₽
-20%
Производитель
GIGABYTE
Тип оборудования
Rack-scale AI-система (стоечная, жидкостное охлаждение)
Наличие
В наличии
GPU: модель × количество
NVIDIA GB200 (Blackwell) × 72
AI-сервер ASUS NVIDIA GB300 NVL72 — 72× GB300 Grace Blackwell UltraAI-сервер ASUS NVIDIA GB300 NVL72 — 72× GB300 Grace Blackwell Ultra
AI-сервер ASUS NVIDIA GB300 NVL72 — 72× GB300 Grace Blackwell Ultra
от 448 494 145 ₽
575 960 902 ₽
-22%
Производитель
ASUS
Тип оборудования
Rack-scale AI-система (стоечная, жидкостное охлаждение)
Наличие
В наличии
GPU: модель × количество
NVIDIA GB300 (Blackwell Ultra) × 72
AI-сервер GIGABYTE H263-V60-AAW1 — 8× RTX PRO 4500 BSE 32GB, 8× Grace, RAM 3.8TBAI-сервер GIGABYTE H263-V60-AAW1 — 8× RTX PRO 4500 BSE 32GB, 8× Grace, RAM 3.8TBAI-сервер GIGABYTE H263-V60-AAW1 — 8× RTX PRO 4500 BSE 32GB, 8× Grace, RAM 3.8TB
AI-сервер GIGABYTE H263-V60-AAW1 — 8× RTX PRO 4500 BSE 32GB, 8× Grace, RAM 3.8TB
от 14 973 520 ₽
18 756 304 ₽
-20%
Производитель
GIGABYTE
Тип оборудования
Блейд-сервер (4-узловой, 2U, rear access)
Наличие
В наличии
GPU: модель × количество
NVIDIA RTX PRO 4500 Blackwell Server Edition × 8 (по 2 GPU на узел)
AI-сервер GIGABYTE G893-ZX1-AAX4 — 8× Instinct MI355X 288GBAI-сервер GIGABYTE G893-ZX1-AAX4 — 8× Instinct MI355X 288GBAI-сервер GIGABYTE G893-ZX1-AAX4 — 8× Instinct MI355X 288GB
AI-сервер GIGABYTE G893-ZX1-AAX4 — 8× Instinct MI355X 288GB
от 51 005 500 ₽
62 817 300 ₽
-19%
Производитель
GIGABYTE
Тип оборудования
Сервер (GPU-ускоритель)
Наличие
В наличии
GPU: модель × количество
AMD Instinct MI355X 288GB × 8
AI-сервер GIGABYTE G893-ZX1-AAX3 — 8× Instinct MI350X 288GBAI-сервер GIGABYTE G893-ZX1-AAX3 — 8× Instinct MI350X 288GBAI-сервер GIGABYTE G893-ZX1-AAX3 — 8× Instinct MI350X 288GB
AI-сервер GIGABYTE G893-ZX1-AAX3 — 8× Instinct MI350X 288GB
от 46 255 500 ₽
59 401 800 ₽
-22%
Производитель
GIGABYTE
Тип оборудования
Сервер (GPU-ускоритель)
Наличие
В наличии
GPU: модель × количество
AMD Instinct MI350X 288GB × 8
AI-сервер DELL PowerEdge XE9785 — 8× Instinct MI355X 288GBAI-сервер DELL PowerEdge XE9785 — 8× Instinct MI355X 288GBAI-сервер DELL PowerEdge XE9785 — 8× Instinct MI355X 288GB
AI-сервер DELL PowerEdge XE9785 — 8× Instinct MI355X 288GB
от 50 160 000 ₽
66 000 000 ₽
-24%
Производитель
Dell
Тип оборудования
Сервер (GPU-ускоритель)
Наличие
В наличии
GPU: модель × количество
AMD Instinct MI355X 288GB × 8
AI-сервер Supermicro SYS-221GE-NR — 4× NVIDIA H100 80GBAI-сервер Supermicro SYS-221GE-NR — 4× NVIDIA H100 80GB
от 16 062 980 ₽
20 120 996 ₽
-20%
Производитель
Supermicro
Тип оборудования
Сервер (GPU-ускоритель)
Наличие
В наличии
GPU: модель × количество
NVIDIA H100 80GB × 4
AI-сервер Supermicro SYS-221GE-NR — 4× NVIDIA H100 NVL 94GBAI-сервер Supermicro SYS-221GE-NR — 4× NVIDIA H100 NVL 94GB
от 15 656 855 ₽
20 106 698 ₽
-22%
Производитель
Supermicro
Тип оборудования
Сервер (GPU-ускоритель)
Наличие
В наличии
GPU: модель × количество
NVIDIA H100 NVL 94GB × 4
AI-сервер Supermicro AS-8126GS-TNMR — 8× Instinct MI325X 256GBAI-сервер Supermicro AS-8126GS-TNMR — 8× Instinct MI325X 256GBAI-сервер Supermicro AS-8126GS-TNMR — 8× Instinct MI325X 256GB
AI-сервер Supermicro AS-8126GS-TNMR — 8× Instinct MI325X 256GB
от 27 067 923 ₽
33 051 358 ₽
-18%
Производитель
Supermicro
Тип оборудования
Сервер (GPU-ускоритель)
Наличие
В наличии
GPU: модель × количество
AMD Instinct MI325X 256GB × 8
AI-сервер Supermicro AS-8126GS-TNMR — 8× Instinct MI350X 288GBAI-сервер Supermicro AS-8126GS-TNMR — 8× Instinct MI350X 288GBAI-сервер Supermicro AS-8126GS-TNMR — 8× Instinct MI350X 288GB
AI-сервер Supermicro AS-8126GS-TNMR — 8× Instinct MI350X 288GB
от 46 637 020 ₽
60 873 584 ₽
-23%
Производитель
Supermicro
Тип оборудования
Сервер (GPU-ускоритель)
Наличие
В наличии
GPU: модель × количество
AMD Instinct MI350X 288GB × 8
AI-сервер Supermicro ARS-221GL-NHIR — 2× GH200 144GB, RAM 960GBAI-сервер Supermicro ARS-221GL-NHIR — 2× GH200 144GB, RAM 960GB
от 9 775 310 ₽
11 730 372 ₽
-17%
Производитель
Supermicro
Тип оборудования
Сервер (GPU-ускоритель)
Наличие
В наличии
GPU: модель × количество
NVIDIA GH200 (Hopper) 144GB × 2
AI-сервер Deepcool MATREXX 55 MESH — 2× Radeon Pro WX8200 8GB, 2× Xeon E5 2687wv4, RAM 256GBAI-сервер Deepcool MATREXX 55 MESH — 2× Radeon Pro WX8200 8GB, 2× Xeon E5 2687wv4, RAM 256GBAI-сервер Deepcool MATREXX 55 MESH — 2× Radeon Pro WX8200 8GB, 2× Xeon E5 2687wv4, RAM 256GB
AI-сервер Deepcool MATREXX 55 MESH — 2× Radeon Pro WX8200 8GB, 2× Xeon E5 2687wv4, RAM 256GB
от 352 783 ₽
419 626 ₽
-16%
Производитель
Deepcool
Наличие
В наличии
GPU: модель × количество
AMD Radeon Pro WX8200 8GB × 2
Размер поддерживаемой модели
до 7–14 млрд (с квантизацией)
AI-сервер Supermicro 4028GR-TR — 4× Instinct MI50 16GB, 2× Xeon E5 2680v4, RAM 128GBAI-сервер Supermicro 4028GR-TR — 4× Instinct MI50 16GB, 2× Xeon E5 2680v4, RAM 128GBAI-сервер Supermicro 4028GR-TR — 4× Instinct MI50 16GB, 2× Xeon E5 2680v4, RAM 128GB
AI-сервер Supermicro 4028GR-TR — 4× Instinct MI50 16GB, 2× Xeon E5 2680v4, RAM 128GB
от 395 675 ₽
537 285 ₽
-26%
Производитель
Supermicro
Тип оборудования
Сервер (GPU-ускоритель)
Наличие
В наличии
GPU: модель × количество
AMD Radeon Instinct MI50 16GB × 4

Обучение LLM

GPU-серверы для обучения LLM и нейросетей

Start Server поставляет GPU-серверы для обучения и дообучения больших языковых моделей, нейросетей и систем машинного обучения. Конфигурация подбирается под размер модели, объём датасета, точность вычислений, количество GPU и сроки обучения. Для разных задач — от одного GPU до многопроцессорных систем и кластеров.

Серверы для обучения LLM: обучение предъявляет иные требования, чем инференс — нужно хранить параметры модели, градиенты, состояния оптимизатора и активации. Если один GPU не вмещает модель или нужно ускорить процесс, вычисления распределяются между несколькими ускорителями. Современные фреймворки поддерживают data parallelism, tensor parallelism, pipeline parallelism и expert parallelism.

Серверы для fine-tuning и дообучения: не каждому проекту нужно обучение с нуля. GPU-серверы применяются для fine-tuning готовых моделей, адаптации под корпоративные данные, instruction tuning, обучения отраслевых моделей, экспериментов и R&D, продолжения pre-training, обучения моделей CV и ML. Конфигурация рассчитывается под конкретный training workload, а не только под количество параметров.

Multi-GPU серверы для обучения: для ресурсоёмких задач — системы с несколькими GPU. При выборе учитываются: GPU → объём VRAM → количество GPU → межсоединение (NVLink) → CPU → RAM → NVMe → сеть → питание → охлаждение. При распределённом обучении обмен данными между GPU становится частью общей производительности — tensor parallelism требует высокоскоростной коммуникации внутри NVLink-домена, а для нескольких узлов критична межсерверная сеть.

Серверы для распределённого обучения: если одного сервера недостаточно, узлы объединяются в GPU-кластер. Проектируется не только серверы, но и InfiniBand/RoCE сеть, СХД, локальный NVMe, сетевые адаптеры, топология кластера, система управления, мониторинг и планировщик задач. В крупномасштабном LLM-тренинге эффективность зависит не только от GPU, но и от коммуникаций, параллелизма и стабильности всего training-контура.

Программный стек: PyTorch, NVIDIA NeMo, Megatron-LM, DeepSpeed, FSDP, NCCL, Slurm, Kubernetes, инструменты мониторинга GPU. NeMo/Megatron поддерживает data, tensor, pipeline, context и expert parallelism.

Как выбрать сервер для обучения LLM: для расчёта нужны: модель, размер, вид обучения, precision, датасет, желаемое время, количество GPU и бюджет, а также требования к RAM, NVMe, сети, питанию и охлаждению. Start Server подбирает отдельный сервер или проектирует многоузловую инфраструктуру.

Купить сервер для обучения LLM: передайте название/архитектуру модели, количество параметров, обучение с нуля или fine-tuning, объём датасета, precision, желаемое время обучения, имеющуюся инфраструктуру и бюджет — на основе этих данных формируется конфигурация и необходимое количество GPU. Start Server организует подбор, поставку, интеграцию и пусконаладку GPU-серверов для обучения LLM и нейросетей.