Материалы по тегу: gpu
|
29.07.2026 [23:18], Андрей Крупин
Эксперты оценили зрелость ИИ-инфраструктуры российских компаний: бизнесу не хватает кадров и GPU-мощностейОтечественный бизнес активно внедряет искусственный интеллект, но не располагает инфраструктурой, необходимой для его промышленной эксплуатации. К такому выводу пришли аналитики Orion soft в исследовании «Индекс готовности ИИ-инфраструктуры российских компаний». На основе полученных экспертами Orion soft данных средний индекс готовности инфраструктуры игроков рынка РФ к внедрению ИИ по итогам I полугодия 2026 года составил 38 из 100 баллов, что соответствует начальному этапу формирования инфраструктурной среды для масштабного использования технологий искусственного разума. Индекс учитывает состояние вычислительных ресурсов, наличие специализированных AI- и ML-команд, зрелость процессов эксплуатации, безопасность ИИ-контуров и способность организаций масштабировать ИИ. Результаты исследования показали, что несмотря на массовый интерес к ИИ, уровень организационной и технологической готовности компаний ощутимо отстаёт от ожидаемых темпов внедрения: 31 % организаций только планируют запуск первых ИИ-проектов, ещё 48 % реализовали не более двух инициатив. Более того, 79 % участников исследования столкнулись с дефицитом профильных специалистов, а потребность в собственных GPU-кластерах испытывают 91 % респондентов.
Источник изображения: Orion soft / orionsoft.ru Исследование также выявило ключевые приоритеты бизнеса: основным фокусом становится возможность безопасно и экономически эффективно использовать ИИ в корпоративной среде. Более 60 % компаний приоритизируют локальные модели, собственную инфраструктуру или отечественные облачные платформы, что подтверждает растущий спрос на защищённый корпоративный ИИ-контур. Наиболее востребованными сценариями остаются интеллектуальный поиск по внутренним данным, LLM-ассистенты и аналитические сервисы, тогда как обучение собственных моделей остаётся нишевым сценарием.
27.07.2026 [12:55], Сергей Карасёв
Supermicro представила серверы на платформе AMD EPYC VeniceКомпания Supermicro анонсировала серверы семейства H15, построенные на аппаратной платформе AMD EPYC Venice 9006. Эти машины, как утверждаются, обеспечивают 1,7-кратный прирост производительности по сравнению с устройствами предыдущего поколения. В серию H15 входит большое количество систем, оптимизированных для широкого спектра корпоративных и инфраструктурных приложений, включая ИИ-нагрузки. Это, в частности, флагманские двухпроцессорные устройства Hyper, одно- и двухсокетные решения CloudDC для облачных сред, 2U-серверы высокой плотности GrandTwin, модели FlexTwin формата 1OU, платформы хранения Petascale Storage типа All-Flash в корпусах 1U и 2U, модели SuperBlade и пр. Кроме того, дебютировали GPU-серверы AS-5126GS-TNRT и AS-5126GS-TNRT2, которые комплектуются соответственно восемью и десятью ускорителями AMD Instinct MI350P. Обе системы выполнены в форм-факторе 5U и оснащены воздушным охлаждением. Первая из этих машин располагает в общей сложности девятью слотами для карт PCIe 5.0 x16 FHFL, вторая — тринадцатью. Во фронтальной части корпуса расположены отсеки для SFF-накопителей. Питание обеспечивают шесть блоков мощностью 2700 Вт с сертификатом 80 PLUS Titanium. Реализованы два сетевых порта 10GbE (RJ45), выделенный сетевой порт управления 1GbE (RJ45) и разъём D-Sub. Заявлена совместимость с Oracle Linux 10.0, RHEL 9.6/10.0, RHEL AI 3.0, Windows Server 2022/2025.
Источник изображения: Supermicro Supermicro также сообщила о сотрудничестве с AMD с целью поставок стоечной платформы Helios AI с 72 ускорителями Instinct MI455X. Она ориентирована на обучение ИИ-моделей в масштабе и на инференс с высокой пропускной способностью. Предусмотрено применение жидкостного охлаждения, сетевых устройств AMD Pensando и программного стека AMD ROCm.
25.07.2026 [21:30], Сергей Карасёв
ИИ-платформа Liqid UltraStack объединяет 30 ускорителей AMD Instinct MI350PКомпания Liqid объявила о стратегическом сотрудничестве с AMD, направленном на создание решений следующего поколения для ИИ-инфраструктур. В рамках партнёрства представлена аппаратная платформа Liqid UltraStack 30, оптимизированная для задач инференса. В состав системы входят сервер с двумя процессорами AMD EPYC 9005 Turin и коммутатор Liqid PCIe Fabric Switch. Ключевыми компонентами являются три GPU-блока, каждый из которых содержит десять ускорителей AMD Instinct MI350P (144 Гбайт памяти HBM3E с 4096-бит шиной). Таким образом, в общей сложности задействованы 30 названных карт и 4,3 Тбайт памяти HBM3E. Заявленная производительность достигает 69 Пфлопс в режиме FP8. Говорится о возможности работы с общими пулами памяти по высокоскоростному стандарту CXL. Суммарное энергопотребление платформы находится на уровне 22 кВт. По заявлениям Liqid, система обеспечивает 3,7-кратный прирост показателя токенов в секунду по сравнению с традиционными решениями. Количество токенов в пересчете на $1 увеличивается в 2,1 раза, а токенов на 1 Вт затрачиваемой энергии — в 1,8 раза. Затраты на развёртывание могут быть уменьшены на 65 %.
Источник изображения: Liqid Программное обеспечение Liqid Matrix объединяет GPU-ускорители и в реальном времени распределяет их ресурсы между рабочими нагрузками через высокоскоростную PCIe-шину. При этом все карты остаются в пределах одного узла. В целом, платформа Liqid UltraStack 30, как утверждается, устраняет накладные расходы, связанные с использованием нескольких узлов, обеспечивает предсказуемое линейное масштабирование и доводит загрузку GPU почти до 100 %. Упомянута поддержка Kubernetes для работы с несколькими моделями.
23.07.2026 [18:07], Сергей Карасёв
6U-сервер Gigabyte XLS4-SX2 оснащён восемью ускорителями RTX Pro 6000 Blackwell с СЖОКомпания Gigabyte анонсировала сервер XLS4-SX2-LAS1, использующий аппаратную платформу Intel Xeon Granite Rapids вкупе с GPU-ускорителями NVIDIA. Новинка, выполненная в форм-факторе 6U, рассчитана на работу с ИИ-приложениями (включая обучение моделей и инференс) и другими ресурсоёмкими нагрузками, такими как обработка видео. Устройство допускает установку двух процессоров Intel Xeon 6700P/6500P. Реализована 8-канальная подсистема оперативной памяти с 32 слотами для модулей DDR5 RDIMM/MRDIMM. Во фронтальной части расположены восемь отсеков для NVMe-накопителей E1.S с интерфейсом PCIe 5.0; допускается горячая замена. Кроме того, доступны два внутренних коннектора для SSD формата M.2 с интерфейсом PCIe 5.0 x4. Сервер несёт на борту восемь ускорителей NVIDIA RTX Pro 6000 Blackwell Server Edition с 96 Гбайт GDDR7. За отвод тепла от них отвечает жидкостная система, которая также охватывает другие ключевые компоненты, в том числе ОЗУ. В оснащение входит DPU NVIDIA BlueField-3. Реализованы порты OSFP InfiniBand на базе ConnectX-8 SuperNIC. Опционально может быть добавлен модуль TPM 2.0 для обеспечения безопасности.
Источник изображения: Gigabyte Новинка получила шесть блоков питания мощностью 3200 Вт с сертификатом 80 PLUS Titanium и резервированием. Реализована технология Smart Ride Through (SmaRT) для защиты от потери данных при отключении питания. При возникновении сбоя встроенные в блок питания конденсаторы обеспечивают работу сервера в течение 10–20 мс — обычно этого достаточно, чтобы переключиться на резервный источник и продолжить работу без остановки.
20.07.2026 [15:55], Сергей Карасёв
Спрос на GPU-инфраструктуру в России за год взлетел в шесть разПотребление облачной инфраструктуры на основе GPU в России в I половине текущего года подскочило на 507 %, или примерно в шесть раз, по сравнению с аналогичным периодом 2025-го. Об этом сообщает «Коммерсантъ» со ссылкой на исследование провайдера «Рег.Облако». Основным драйвером роста названо внедрение готовых ИИ-сервисов в бизнес-процессы. Ускорители на базе GPU применяются для решения самых разных задач, связанных с нейросетевыми технологиями: от речевой аналитики и компьютерного зрения до клиентской поддержки и работы с корпоративными базами знаний. О росте спроса говорят и Cloud.ru с MWS. По оценкам, количество новых подключений в сегменте GPU-инфраструктуры в России в I полугодии 2026-го подскочило на 160 % в годовом исчислении. При этом ежемесячная активность пользователей увеличилась на 240 %. В сфере выделенных серверов и систем bare metal клиентская база с расходами более 500 тыс. руб. в месяц расширилась более чем в два раза, а доля таких пользователей в общем объёме потребления поднялась с 35 % до 49 %. Отмечается, что самыми востребованными GPU-ускорителями среди российских заказчиков являются NVIDIA RTX A4000 Ampere: такие карты применяют примерно 63 % клиентов. О быстром расширении рынка говорят и другие его участники. Так, провайдер K2 Cloud указывает на 4–5-кратный рост запросов на облачные GPU. При этом, как отмечается, востребованы такие изделия, как NVIDIA L4, L40S и H100. Отраслевые эксперты подчёркивают, что на российском рынке нет недостатка карт «начального уровня», при этом наблюдается дефицит в сегменте высокопроизводительных решений, которые необходимы в том числе для обучения крупных ИИ-моделей с большим количеством параметров. На этом фоне наблюдается трансформация сектора. Кроме того, заказчикам всё чаще нужны не просто ускорители, а готовые ИИ-решения и сервисы.
15.07.2026 [10:41], Сергей Карасёв
GPU-сервер MSI G4201-HE выполнен на платформе Intel Xeon Emerald RapidsКомпания MSI анонсировала сервер G4201-HE на аппаратной платформе Intel, подходящий для решения таких задач, как тонкая настройка больших языковых моделей (LLM), ИИ-инференс и пр. Устройство подходит для использования в инфраструктурах облачных провайдеров и в составе CDN-платформ. Новинка выполнена в форм-факторе 4U. Возможна установка двух процессоров Xeon Emerald Rapids (LGA 4677) с показателем TDP до 350 Вт. Доступны 32 слота для модулей оперативной памяти DDR5-5600 RDIMM/3DS суммарным объёмом до 8 Тбайт. Применено воздушное охлаждение. Сервер может нести на борту до восьми GPU-ускорителей в виде карт расширения FHFL с интерфейсом PCIe 5.0 x16 и максимальным энергопотреблением 600 Вт. Есть также дополнительные слоты PCIe 5.0 x16 и PCIe 4.0 x16 для карт стандарта FHFL. В оснащение входят контроллер ASPEED AST2600 и сетевой адаптер 1GbE (Intel I210AT). Во фронтальной части расположены 12 отсеков для LFF/SFF накопителей в конфигурации 2 × U.2 PCIe 4.0 (NVMe) и 10 × SATA-3. Допускается формирование массивов RAID 0/1/5/10. Кроме того, предусмотрены два внутренних коннектора для SSD M.2 2280/22110 (PCIe 3.0 x2). Опционально может быть добавлен модуль TPM 2.0 для обеспечения безопасности. На лицевую панель выведены по одному порту USB 3.0 Type-A и USB 2.0. Сзади находятся два разъёма USB 3.0 Type-A, коннектор D-Sub, последовательный порт (разъём RJ45), сетевой порт 1GbE RJ45 и выделенный сетевой порт управления. Установлены четыре блока питания мощностью 2700 Вт с резервированием и сертификатом 80 PLUS Titanium. Диапазон рабочих температур простирается от +10 до +35 °C.
02.07.2026 [10:30], Сергей Карасёв
GPU-серверы в 2026 году: когда видеокарта окупается, а когда достаточно VPSИнтерес к GPU-серверам вырос вместе с нейросетями и локальным запуском моделей. Но видеокарта нужна не каждому проекту. В одних задачах GPU сокращает обработку с часов до минут, в других остаётся дорогим ресурсом, который почти не используется. Специалисты AdminVPS отмечают: перед выбором сервера бизнесу важно оценивать не только запас мощности, но и характер нагрузки. Главное отличие GPU от CPU — не «больше мощности», а другой тип вычислений. Центральный процессор лучше подходит для последовательной логики: работы сайта, базы данных, API, CRM, интернет-магазина или бота. В таких проектах важны стабильные vCPU, RAM, быстрый NVMe-диск и корректно настроенное окружение. Если нагрузка связана с веб-сервисом, Docker-контейнерами, аналитикой или внутренними инструментами, обычно достаточно обычного виртуального сервера. GPU нужен там, где задача хорошо распараллеливается: обучение ML-моделей, инференс локальных LLM, обработка изображений и видео, 3D-рендеринг, компьютерное зрение, распознавание объектов, большие массивы однотипных вычислений. В таких сценариях видеокарта берёт на себя тысячи параллельных операций, с которыми CPU справляется заметно медленнее. Есть простой критерий: если проект использует готовые AI-сервисы через API, GPU на собственном сервере чаще всего не нужен. Нагрузка уходит на внешнюю платформу, а серверу остаются бизнес-логика, хранение данных, авторизация и интерфейс. Здесь важнее надёжный VPS, резервное копирование и возможность масштабировать CPU/RAM. Для таких задач рациональнее выбрать конфигурацию без видеокарты — например, сервер VPS с балансом производительности и стоимости. Другая ситуация — когда модель нужно запускать локально: важна скорость ответа, работа с внутренними данными, контроль окружения или запуск вычислений без привязки к стороннему сервису. Тогда сервер с графическим ускорителем становится рабочим инструментом. В AdminVPS GPU-серверы комплектуются NVMe-накопителями и защищены от DDoS. Для инференса моделей в реальном времени важна техподдержка 24/7, которая помогает с настройкой драйверов и CUDA-окружения. Перед переходом стоит ответить на несколько вопросов: есть ли у приложения параллельные вычисления; поддерживает ли стек CUDA или GPU-фреймворки; как долго идут расчёты на CPU; насколько часто они запускаются; что станет узким местом после ускорения — видеокарта, диск, память или сеть. Правильная стратегия — не сразу брать самый мощный сервер, а сопоставить инфраструктуру с задачей. Для сайтов, CRM, API, ботов и большинства корпоративных сервисов обычный VPS остаётся более экономичным решением. GPU-сервер нужен тогда, когда вычисления упираются в параллельную обработку данных, а ускоритель влияет на скорость продукта или себестоимость операций. Оценить конфигурации под ресурсоёмкие задачи можно в разделе VPS сервер с GPU на сайте AdminVPS.
02.06.2026 [01:04], Владимир Мироненко
ИИ-ускоритель Intel Crescent Island получит до 480 Гбайт LPDDR5XIntel сообщила новые подробности о своём будущем ИИ-ускорителе для ЦОД с кодовым именем Crescent Island, который был анонсирован в прошлом году. Новый GPU основан на архитектуре Xe3P, представляющей усовершенствованную версию Xe3, которая используется в процессорах Core Ultra 300 семейства Panther Lake. Ожидается, что Xe3P также будет использоваться в GPU Intel серии Arc-C для клиентских устройств. Компания отметила, что чип разработан специально для рабочих нагрузок агентного ИИ. В то время как традиционные ИИ-ускорители от NVIDIA и AMD полагаются на дорогую память HBM, в новом чипе Intel используется LPDDR5X, и он предназначен для работы в серверах с воздушным охлаждением, а не с жидкостным. Crescent Island будет поддерживать до 480 Гбайт памяти LPDDR5X, хотя базовая эталонная конфигурация рассчитана на 160 Гбайт. Intel заявила, что Crescent Island оптимизирован по производительности на Вт — до TDP 350 Вт в версии с воздушным охлаждением и интерфейсом PCIe. Сообщается, что GPU будет поддерживать широкий спектр форматов данных от FP4 до FP64, а также полностью открытый программный стек oneAPI, что идеально подходит для поставщиков услуг «токены как услуга» и сценариев использования для инференса. Концептуально новинка напоминает Rubin CPX, от которого NVIDIA отказалась. Intel уже оценивает свой открытый унифицированный программный стек для гетерогенных систем ИИ с помощью существующей линейки Arc Pro B-серии, поэтому будущие версии чипов получат доступ к этим оптимизациям на ранних этапах. Intel планирует начать тестирование GPU Crescent Island для клиентов во II половине 2026 года с общей доступностью в 2027 году.
11.05.2026 [15:13], Сергей Карасёв
Verda и Compal объединили усилия для создания ИИ-инфраструктуры следующего поколенияКомпании Compal Electronics и Verda (ранее известна как DataCrunch) объявили о стратегическом партнёрстве, направленном на формирование ИИ-инфраструктуры следующего поколения. Стороны сосредоточат усилия на реализации проектов в Европе и Азиатско-Тихоокеанском регионе. В рамках сотрудничества Compal будет поставлять серверные платформы высокой плотности на основе GPU-ускорителей. Говорится о применении жидкостного охлаждения. Серверы оптимизированы для ИИ-нагрузок нового типа, в том числе агентных приложений, которые используют машинное обучение для сбора и обработки огромных объёмов данных в реальном времени. Раннее сообщалось, что Verda готовится к развёртыванию систем на базе Arm AGI, а также GB300 и Vera Rubin. Отмечается, что готовящиеся к выпуску серверы обладают высокой тепловой эффективностью, что важно в плане устойчивого развития облачных решений Verda. Эта компания имеет дата-центры в Финляндии, полностью работающие на возобновляемой энергии. Кроме того, Verda управляет ЦОД в Исландии и намерена построить объект в Латвии. В целом, партнёрство направлено на усиление позиций Verda на рынке облачных услуг. Недавно компания сообщила о привлечении $117 млн для создания облачной инфраструктуры нового поколения для задач ИИ. Средства поступили от Lifeline Ventures, byFounders, Tesi, Varma и других инвесторов. В свою очередь, Compal усиливает собственную значимость в качестве инфраструктурного партнёра для неооблачных операторов. Compal обладает инженерными знаниями в области НРС, теплового проектирования и системной интеграции, что позволяет клиентам развёртывать энергоэффективные ИИ-инфраструктуры. Compal продолжает расширять свои производственные мощности на Тайване, во Вьетнаме и США, что помогает в удовлетворении потребностей заказчиков в различных регионах. При этом повышается надёжность работы цепочек поставок.
02.05.2026 [13:22], Сергей Карасёв
AMD EPYC и NVIDIA RTX Pro Blackwell: QNAP представила хранилище QAI-h1290FX для ИИ-задачКомпания QNAP Systems анонсировала сервер хранения QAI-h1290FX, предназначенный для решения ИИ-задач на периферии. Устройство подходит для работы с большими языковыми моделями (LLM), генеративными приложениями, поисковыми сервисами на базе RAG и пр. Новинка построена на платформе AMD с процессором EPYC Rome 7302P (16C/32T; до 3,3 ГГц). Объём оперативной памяти DDR4 ECC в базовой конфигурации составляет 128 Гбайт, в максимальной — 1 Тбайт. Во фронтальной части расположены 12 отсеков для SFF-накопителей U.2 с интерфейсом PCIe 4.0 x4 (NVMe) или SATA-3 с возможностью горячей замены. Система оснащена тремя слотами PCIe 4.0 x16 и одним слотом PCIe 4.0 x8. Возможна установка GPU-ускорителя NVIDIA RTX Pro 6000 Blackwell Max-Q Workstation Edition с 96 Гбайт памяти GDDR7 или NVIDIA RTX Pro 4500 Blackwell с 32 Гбайт памяти GDDR7. В первом случае обеспечивается возможность использования LLM с более чем 70 млрд параметров, во втором — 30 млрд параметров. Применена ОС QuTS hero h5.2.9. Упомянуты такие предустановленные ИИ-инструменты, как AnythingLLM, OpenWebUI, Ollama, Stable Diffusion, ComfyUI, n8n и vLLM. Устройство располагает двумя портами 2.5GbE и двумя 25GbE-портами SFP28 (SmartNIC), а также тремя разъёмами USB 3.0 Type-A (один находится спереди, два — сзади). Дополнительно может быть установлен сетевой адаптер 100GbE. Габариты сервера составляют 150 × 368 × 362 мм, масса — 10,4 кг. Диапазон рабочих температур — от 0 до +40 °C. Задействованы два вентилятора охлаждения диаметром 92 мм и блок питания мощностью 750 Вт. Производитель предоставляет на новинку пятилетнюю гарантию. |
|
