Red Hat запускает llm-d — платформу для масштабируемого вывода ИИ на базе Kubernetes

watch 9s
views 2

15:24, 22.05.2025

Содержание статьи
arrow

  • Ключевые особенности llm-d
  • Сотрудничество ведущих игроков ИИ-индустрии
  • Технологическая основа и архитектура

Red Hat представила llm-d — новый open source-проект, предназначенный для высокопроизводительного распределённого вывода больших языковых моделей (LLM). Платформа разработана на базе Kubernetes и ориентирована на упрощение масштабирования генеративного ИИ. Исходный код доступен на GitHub под лицензией Apache 2.0.

Ключевые особенности llm-d

Среди главных функций платформы:

  • оптимизированный планировщик вывода (Inference Scheduler) для vLLM;
  • дезагрегированная архитектура обслуживания;
  • повторное использование префиксных кэшей;
  • гибкое масштабирование в зависимости от трафика, задач и доступных ресурсов.

Сотрудничество ведущих игроков ИИ-индустрии

Разработка ведётся в партнёрстве с такими компаниями, как Nvidia, AMD, Intel, IBM Research, Google Cloud, CoreWeave, Hugging Face и другими. Такое сотрудничество подчёркивает серьёзность подхода к llm-d и потенциал платформы как отраслевого стандарта.

Технологическая основа и архитектура

Проект использует библиотеку vLLM для распределённого inference, а также такие компоненты, как LMCache для выгрузки KV-кэша, интеллектуальную маршрутизацию трафика с поддержкой ИИ, высокоэффективные коммуникационные API, и автоматическое масштабирование под нагрузку и инфраструктуру.

Всё это позволяет адаптировать систему под различные сценарии использования и требования к производительности. А сам запуск llm-d может стать значительным шагом в сторону демократизации мощных ИИ-систем и их доступности для широкой аудитории разработчиков и исследователей.

Поделиться

Была ли эта статья полезной для вас?

Популярные предложения VPS

-10%

CPU
CPU
4 Xeon Cores
RAM
RAM
4 GB
Space
Space
50 GB SSD
Bandwidth
Bandwidth
Unlimited
KVM-SSD 4096 Linux

£ 13.92

£

При оплате за год

-22.2%

CPU
CPU
4 Xeon Cores
RAM
RAM
4 GB
Space
Space
50 GB SSD
Bandwidth
Bandwidth
300 GB
KVM-SSD 4096 HK Linux

£ 28.8

£

При оплате за год

-10%

CPU
CPU
4 Xeon Cores
RAM
RAM
2 GB
Space
Space
30 GB SSD
Bandwidth
Bandwidth
Unlimited
10Ge-KVM-SSD 2048 Linux

£ 26.44

£

При оплате за год

-20.5%

CPU
CPU
6 Xeon Cores
RAM
RAM
8 GB
Space
Space
100 GB SSD
Bandwidth
Bandwidth
8 TB
KVM-SSD 8192 Metered Linux

£ 49.74

£

При оплате за год

-10%

CPU
CPU
10 Epyc Cores
RAM
RAM
64GB
Space
Space
400 GB NVMe
Bandwidth
Bandwidth
Unlimited
Keitaro KVM 65536
OS
CentOS
Software
Software
Keitaro

£ 130.05

£

При оплате за год

-10%

CPU
CPU
6 Xeon Cores
RAM
RAM
8 GB
Space
Space
200 GB HDD
Bandwidth
Bandwidth
Unlimited
KVM-HDD 8192 Linux

£ 22.03

£

При оплате за год

-10%

CPU
CPU
6 Xeon Cores
RAM
RAM
8 GB
Space
Space
100 GB SSD
Bandwidth
Bandwidth
Unlimited
wKVM-SSD 8192 Windows

£ 24.82

£

При оплате за год

-10%

CPU
CPU
6 Xeon Cores
RAM
RAM
16 GB
Space
Space
400 GB HDD
Bandwidth
Bandwidth
Unlimited
KVM-HDD 16384 Linux

£ 43.63

£

При оплате за год

-16.3%

CPU
CPU
4 Xeon Cores
RAM
RAM
2 GB
Space
Space
30 GB SSD
Bandwidth
Bandwidth
40 Mbps
DDoS Protected SSD-KVM 2048 Linux

£ 41.88

£

При оплате за год

-8.1%

CPU
CPU
6 Xeon Cores
RAM
RAM
8 GB
Space
Space
200 GB HDD
Bandwidth
Bandwidth
Unlimited
wKVM-HDD 8192 Windows

£ 27.27

£

При оплате за год

Другие статьи на эту тему

cookie

Принять файлы cookie и политику конфиденциальности?

Мы используем файлы cookie, чтобы обеспечить вам наилучший опыт работы на нашем сайте. Если вы продолжите работу без изменения настроек, мы будем считать, что вы согласны получать все файлы cookie на сайте HostZealot.