Мы в OpenYard внимательно следим за тем, как развивается инфраструктура для искусственного интеллекта — от железа до сетей и архитектуры дата-центров. Причём это не просто рабочая необходимость, а и то, что нам самим по-настоящему интересно. В эту статью попали материалы, которые мы собираем и анализируем в процессе исследований для наших новых продуктов. Здесь собраны ключевые тренды, которые уже начинают влиять на то, как мы будем строить свою инфраструктуру и запускать модели ИИ в ближайшие 5–7 лет.
Рубрика «gpu» - 8
GPU Server and AI Infrastructure: тренды архитектуры 2030
2025-06-30 в 12:42, admin, рубрики: AI, amd, gpu, intel, Nvidia, ocp, OpenYard, искусственный интеллектПочему в бюджете ЦОДа лидирует статья «электричество»
2025-06-24 в 9:02, admin, рубрики: gpu, ruvds_статьи, дата-центр, инфраструктура, облака, серверы, хостинг, цод, экономика проектов, электричествоМой идеальный компьютер
2025-06-23 в 19:00, admin, рубрики: gpu, linux, Nvidia, NVMe, pci passthrough, vfio, virt-manager, virtualizationЯ сижу под Linux, но иногда нужна винда. До недавнего времени у меня был обычный dual boot, но сейчас я реализовал свой идеальный сетап:
-
основная система - Linux
-
Windows - на выделенной SSD
-
на нее можно загрузиться как из груба, так и из виртуалки
-
с пробросом второго GPU (дисплей на отдельный физический выход)
-
с качественным удаленным подключением (как RDP, но быстрое) - можно играть в игры
Ниже опишу что и как сделал.
Не является руководством к действию, я в процессе этих игр одну инсталляцию загубил - накосячил с драйверами видеокарт. Все действия - на свой страх и риск.
Что такое CDN и как она работает: объяснение на примере доставки котиков
2025-06-17 в 13:01, admin, рубрики: CDN, gpu, web2, вычисления, доставка контента, интернет, сайт, серверы, трафик, хостингИщем игры для Atari в случайных данных
2025-06-16 в 13:01, admin, рубрики: atari, Atari 2600, gpu, параллельное программированиеПочём ИИ для народа: протестировали платформу YADRO G4208P с восемью H100 NVL и RTX 4090 на десятке ИИ-моделей
2025-06-10 в 10:53, admin, рубрики: gpu, mlcommons, бенчмарки, производительность, сервер, сравнениеПривет! Меня зовут Артём Маклаев, вместе с командой я занимаюсь оценкой производительности серверных платформ для задач искусственного интеллекта в YADRO. Сегодня поговорим о готовящемся к выпуску сервере YADRO G4208P G3, к раннему образцу которого мы получили полный доступ, чтобы оценить его эффективность работы с нейросетями.
Шпаргалка по установке драйверов NVIDIA на ML сервер
2025-05-29 в 13:09, admin, рубрики: container, CUDA, docker, gpu, linux, Nvidia, nvidia-smi, Ubuntu, Драйвер, установка
Специалисты из сферы ИИ часто сталкиваются с задачей корректной настройки сервера с GPU. Лично я с этой задачей сталкиваюсь в последнее время даже слишком часто...
От GeForce 256 до RTX PRO 6000, или Куда добежали профессиональные GPU к 2025 году
2025-05-29 в 6:43, admin, рубрики: ada lovelace, blackwell, GeForce, geforce rtx, gpu, hopper gpu, Nvidia, графические процессоры, Железо, серверЕсли в 1999-м вы апгрейдили ПК до GeForce 256 ради Quake III, вы инвестировали в будущее ИИ. Тогда никто не верил, что игровая карта с 32 МБ памяти станет прародителем ChatGPT. А сегодня ее «потомки» обучают нейросети, рендерят реалистичные миры и управляют суперкомпьютерами. Рассказываем, как NVIDIA за 25 лет увеличила производительность GPU в тысячи раз и превратила их в главный инструмент для машинного обучения, моделирования сложных процессов и анализа больших данных.
Эффективное использование GPU в Kubernetes: Настройка и использование Volcano Scheduler + Volcano vGPU Device Plugin
2025-05-27 в 18:29, admin, рубрики: gpu, helm, kubernetes, linux, Nvidia, NVIDIA GPU, vgpu, ВидеокартыОб авторе
Меня зовут Андросов Михаил — DevOps/MLOps-инженер. Последние два года сопровождаю ML-кластера Kubernetes с интенсивной нагрузкой на GPU.
Аппаратные характеристики
Наш типовой bare-metal-узел — сервер с 10 × NVIDIA RTX 4090 (24 GB). GPU enterprise уровня тоже есть, но мы предпочитаем использовать пользовательские GPU: такие карты проще приобрести и эксплуатировать.
Основные проблемы
В процессе запуска бесчисленных ML экспериментов, встали следующие проблемы:
-
Недоиспользование памяти. Большинство ML задач занимает лишь часть памяти RTX 4090, из-за чего GPU простаивает.
-
Взаимоблокировки.Читать полностью »
Как приручить Горыныча: русская high availability с тремя головами
2025-05-27 в 13:01, admin, рубрики: gpu, ruvds_статьи, SaaS, web2, Веб, виртуализация, вычисления, интернет, облака, сайт, серверы, трафик, хостинг
В одном царстве, в одном хостинг-государстве жил-был сказочный Змей Горыныч. Он был трёхголовым, распределённым и главное отказоустойчивым. Конечно, иногда из-за синхронизации подлагивал, но в целом был зверем, которых на свете мало…
Охранял он, как и положено, всякие ценности. То жар-птицу (high-value asset), то царевну (уникальный бизнес-процесс), а иногда просто всё по периметру выжигал огнём, чтобы в прод лишний никто не сунулся.
Он не был злодеем, просто его так собрали по SLA: доступность — 99,99%, задержка — в пределах 200 мс, а восстановление — автоматическое. Богатыря Горыныч не боялся, потому что он для него не герой, а unplanned human intervention — угроза стабильности.
Давайте разберёмся, что за монстр этот Змей.Читать полностью »



