gigaRAM
Open AI Infrastructure

AI-инфраструктура становится стеком, а не коробкой

Открытые стандарты стоек, сетей и software снижают vendor lock-in. gigaRAM — слой памяти внутри этого стека.

Explore GigaRAM

Открытая AI-инфраструктура

AI-нагрузки
Обучение и инференс
Open software stack
vLLM · PyTorch · ROCm
Linux
Операционная система
Открытый interconnect / сеть
Открытые стандарты
Ускоритель
GPU или AI-ускоритель
Open Rack
OCP Open Rack Wide (ORW)

Два маршрута

Один стек — две архитектуры

Вертикально интегрированный стек

GPUNVLink / NVSwitchCUDAБиблиотеки вендораAI-фреймворки

Открытая инфраструктура

Open RackУскорительОткрытый interconnect / сетьLinuxOpen-source softwareAI-нагрузки

NVIDIA остаётся эталоном высокоинтегрированной AI-инфраструктуры. Открытый маршрут развивается рядом — это не замена, а второй путь.

OCP Open Rack Wide

ORW простыми словами

01

Это стандарт, а не продукт

ORW — открытая спецификация AI-стойки в рамках Open Compute Project. Не ускоритель, не продукт AMD и не новый тип GPU.

02

Общая архитектура для разных вендоров

Серверы, ускорители, сеть, storage, питание и жидкостное охлаждение проектируются под единый форм-фактор и совместимы между собой.

03

AMD Helios — один из примеров

Стоечная система AMD Helios с ускорителями поколения MI400 / MI455X — одна из реализаций этого подхода. Важная, но не единственная.

Одна стойка, несколько поставщиков

OCP ORW
Compute
Вендор A · B · C
Ускорители
Вендор A · B · C
Networking
Вендор A · B · C
Storage
Вендор A · B · C
Power
Вендор A · B · C
Liquid cooling
Вендор A · B · C

Открытый стандарт описывает механику, питание и охлаждение. Кто поставит каждый компонент — решает заказчик.

The Open AI Software Stack

Открытый софтверный стек

ORW сам по себе не определяет software stack. Его значение в другом: hardware становится более стандартизированным и открытым, а software всё чаще строится вокруг Linux и open-source экосистемы.

AI Models
Модели и приложения
vLLM · SGLang
Inference-движки
PyTorch · JAX
Фреймворки
ROCm · open accelerator software
Слой ускорителя
Linux
Операционная система
Kubernetes · Slurm
Оркестрация и планирование
Open compute infrastructure
Открытая инфраструктура (ORW и др.)

Где находится gigaRAM

Слой памяти, а не ещё один AI-фреймворк

gigaRAM находится между AI-нагрузками и физической памятью сервера: интеллектуально распределяет данные между DRAM и NVMe.

AI Applications & Models
Нагрузки
PyTorch · vLLM · базы данных · контейнеры
Runtime
gigaRAM Intelligent Memory Layer
Интеллектуальный слой памяти
DRAM ↔ NVMe
Физическая память и флеш
CPU / GPU infrastructure
Оборудование

Open compute needs open memory infrastructure.

  • Прозрачно для приложений
  • Linux-native
  • Не зависит от вендора оборудования
  • Спроектирован под открытую инфраструктуру
  • Снижает зависимость от дорогой DRAM
  • Больше нагрузки на тех же серверах
  • AI, базы данных и memory-intensive приложения

gigaRAM не заменяет HBM ускорителя и не входит в состав ORW или Helios. Это отдельный слой software-инфраструктуры, который может дополнять открытую AI-инфраструктуру.

Замер на реальных нагрузках

Redis−50%
Замещение DRAMСуммарный RPS +5,6%p99 SET −21,7%
PostgreSQL−40%
Замещение DRAMTPS ≈ −2%

Redis: 48 vCPU, 50 млн ключей по 16 KiB. PostgreSQL — консервативная проектная оценка. Обе цифры проверяются пилотом на вашей нагрузке.

Сравнение

Trade-off, а не победитель

Vertically Integrated

  • Один вендор
  • GPU
  • Interconnect
  • Networking
  • Software ecosystem

Максимальная интеграция и зрелая экосистема.

Open Infrastructure

  • Несколько вендоров
  • Открытые стандарты стоек
  • Открытые стандарты сети и interconnect
  • Linux
  • Open-source AI software
  • Независимый infrastructure software

Гибкость, выбор поставщиков и место для независимого инфраструктурного софта.

Ни один из подходов не является универсально правильным. Выбор зависит от сроков, масштаба, компетенций команды и стратегии закупок.

Тренд 2027+

AI infrastructure is becoming a stack, not a box.

Следующий этап рынка — не только соревнование GPU. Конкуренция перемещается на уровень всей AI factory.

Compute
Memory
Networking
Storage
Cooling
Orchestration
Software

По мере распространения открытых стандартов появляется пространство для независимых компаний, которые делают лучший компонент каждого слоя.

The future of AI infrastructure will not be defined by compute alone.

gigaRAM строит интеллектуальный слой памяти для этого будущего.

Explore GigaRAM

Коротко

Частые вопросы

Что такое OCP Open Rack Wide (ORW)?

Открытый стандарт AI-стойки, разработанный в рамках Open Compute Project. Он описывает механику, питание, охлаждение и интеграцию оборудования, позволяя разным производителям выпускать совместимые серверы, ускорители, networking и storage.

ORW — это продукт AMD или новый тип GPU?

Нет. ORW — это открытая спецификация стойки, а не продукт конкретного вендора и не тип ускорителя. Её могут использовать любые производители оборудования.

Причём здесь AMD Helios и MI400 / MI455X?

AMD Helios — стоечная AI-система, построенная по принципам открытой rack-архитектуры, с ускорителями поколения MI400 / MI455X. Это один из важных примеров реализации подхода, а не сам стандарт.

Определяет ли ORW software stack?

Нет. ORW стандартизирует hardware-инфраструктуру. Software при этом всё чаще строится вокруг Linux и open-source экосистемы: ROCm и других открытых слоёв ускорителя, PyTorch и JAX, vLLM и SGLang, Kubernetes и Slurm.

Где в этом стеке находится gigaRAM?

gigaRAM — слой инфраструктуры памяти между AI-нагрузками и физической памятью сервера. Он прозрачно распределяет данные между DRAM и NVMe, позволяя запускать более крупные нагрузки на существующих серверах. Это не часть ORW или Helios и не замена HBM ускорителя.