Материалы по тегу: ии

09.10.2026 [21:59], Владимир Мироненко

Apple Hills Digital: предобученные модели и интеграция с данными для заказчиков важнее стоимости ИИ-нагрузки

Аналитическая компания Apple Hills Digital представила совместно с Selectel исследование «Облачные сервисы для ИИ: серверы с GPU и AI/ML-платформы». В нём содержится анализ и описывается динамика российского рынка инфраструктурных и платформенных облачных решений для задач ИИ по трём ключевым сегментам: виртуальные серверы с GPU (Virtual Server), выделенные серверы с GPU (Bare Metal) и AI/ML-платформы класса PaaS за период с 2022 до 2025 гг., а также приводятся сценарии развития до 2030 года.

Согласно исследованию, совокупное потребление облачных серверов с GPU и AI/ML-платформ в 2025 году в стране составило 65,5 млрд руб., включая 40,8 млрд руб. (62 %), израсходованных на внутреннее потребление в экосистемах провайдеров, и 24,7 млрд руб. — на внешнее (затраты внешних заказчиков). Большая часть рыночного потребления приходится на публичное облако — 17,6 млрд руб. (71 %). Частные облака в основном используются на серверах с GPU (45 % рыночного потребления) и почти не используются для AI/ML платформ (3 %).

Совокупное потребление виртуальных и выделенных серверов с GPU в прошлом году составило 37 млрд руб., в том числе, рыночное — 15 млрд руб. (41 %), внутреннее — 22 млрд руб. (59 %). Доля внутреннего потребления в этом сегменте существенно выше, чем в среднем по облачному рынку, составляющем 14 % по данным исследования «Рынок облачных сервисов в РФ», поскольку крупные финансовые и телеком-группы размещают ИИ-нагрузки у собственных провайдеров, и суммарно эти нагрузки больше, чем у рыночных клиентов.

 Источник изображений: Apple Hills Digital

Источник изображений: Apple Hills Digital

Из 15 млрд руб. рыночного потребления серверов с GPU в публичном облаке получено 8,2 млрд руб. (55 %) выручки, в частных облаках — 6,8 млрд руб. (45 %). Для сравнения: в сегменте IaaS в целом на частные облака приходится 27 % рыночного потребления (AHD, 2026). Таким образом, доля частного облака в GPU-сегментах значительно больше, чем в среднем по облачной инфраструктуре. Это объясняется тем, что банки, госсектор и субъекты КИИ размещают ИИ-нагрузки с чувствительными данными в выделенном контуре. При этом объём рынка облачных серверов с GPU в публичном облаке в 2025 году, составивший 9 % сегмента IaaS, вырос год к году на 68,7 %. На виртуальные серверы с GPU приходится 4,3 млрд руб. (53 %), на выделенные серверы с GPU — 3,9 млрд руб. (47 %).

Совокупное потребление облачных AI/ML-платформ в 2025 году (все типы развёртывания) составило 28,5 млрд руб., включая рыночное потребление в размере 9,7 млрд руб. (34 %), внутреннее —18,8 млрд руб. (66 %). Исследователи отметили, что доля внутреннего потребления в AI/ML-платформах существенно выше, чем в PaaS в целом (36 %; AHD, 2026). В данном случае, финансовые и телеком-группы используют платформы собственных провайдеров для своих ИИ-нагрузок, и эти нагрузки больше, чем у рыночных клиентов.

В отличие от серверов с GPU, AI/ML-платформы потребляются почти исключительно из публичного облака. В собственном контуре заказчики, как правило, разворачивают ПО ИИ по лицензии. В публичном облаке рыночное потребление облачных AI/ML-платформ составило в прошлом году 9,4 млрд руб. (97 %), в частных облаках — 0,3 млрд руб. (3 %).

С 2022 по 2025 год рынок серверов с GPU в публичном облаке рос со среднегодовым темпом (CAGR) 48,4%, увеличившись с 2,5 до 8,2 млрд руб. Прогноз аналитиков включает два сценария: «Продолжение тренда», при котором торможение в 2026 году временное, и «Замедление роста», при котором оно закрепляется. К 2030 году рынок серверов с GPU в публичном облаке при первом сценарии составит до 36,5 млрд рублей (CAGR — 34,8 %), при втором — 21,2 млрд руб. (CAGR — 20,9 %).

В свою очередь, рынок AI/ML-платформ в период 2022–2025 гг. рос в среднем на 41,9 % в год. К 2030 году рынок AI/ML-платформ вырастет от 25,9 до 40,7 млрд рублей (22,4–34 %). В сумме это составит 47–77 млрд руб. против 17,6 млрд руб. в 2025 году.

Как сообщается, ИИ остаётся одним из приоритетов новых ИТ-бюджетов. На рост сегмента серверов с GPU в публичном облаке будет влиять не только спрос, но и доступность вычислительных ресурсов. В связи с высокой ключевой ставкой и ценой на оборудование, а также требованиями к безопасности и локализации данных для заказчиков аренда оборудования становится более выгодным вариантом по сравнению с покупкой.

Вместе с тем сегмент AI/ML-платформ растёт быстрее сегмента серверов с GPU в публичном облаке и даже в сценарии прогноза «Замедление роста» растёт в среднем на 22,4 % в год до 2030 года. Заказчики всё чаще приходят за готовой средой и моделями, а не за сервером, говорят исследователи.

Согласно проведённому опросу, 24 % компаний уже используют ИИ в облаке, еще 18 % планируют начать в течение 2026 года и 4 % проводят пилоты — итого 46 % респондентов. В числе главных причин перехода в облако респонденты назвали наличие готовых моделей и сервисов (36 %), ускорение экспериментов (32 %) и повышение безопасности (27 %).

41 % компаний работают с ИИ самостоятельно, провайдер лишь предоставляет инфраструктуру. У 29 % респондентов провайдеров принимает частичное участие. При выборе провайдера заказчики чаще называют в числе важнейших факторов предобученные модели (23 %) и интеграцию с данными и аналитикой (23 %), чем GPU-оборудование (17 %) и стоимость ИИ-нагрузок (16 %). В качестве предпочтительного варианта развёртывания ИИ респонденты назвали open-source ИИ в облаке (37 %); облачные ИИ-агенты и дообученные LLM указали 27 % участников опроса.

Постоянный URL: http://servernews.ru/1149723
09.10.2026 [21:47], Руслан Авдеев

Google «выжмет» из АЭС Constellation ещё 890 МВт для своих ИИ ЦОД

Google объявила о заключении долгосрочного стратегического соглашения с энергокомпанией Constellation Energy, забронировав значительные мощности АЭС для своей масштабной экосистемы ИИ ЦОД, сообщает Silicon Angle. PPA сроком на 20 лет позиционируется как «партнёрство в сфере чистой энергетики».

В рамках сделки Constellation потратит на обновление и модернизацию 11 энергоблоков на шести объектах в Иллинойсе, Нью-Джерси и Пенсильвании $4,3 млрд. Речь, в частности, идёт об установке новых передовых турбин, современных паровых генераторов и передовых цифровых систем контроля. Всё это поможет повысить эффективность электростанций и даст энергосистеме PJM Interconnection, обслуживающей 13 штатов и 67 млн потребителей, дополнительные 890 МВт.

Google не сообщила, сколько именно она будет платить за «обновлённую» атомную энергию, но соглашение даст PJM гарантии стабильной выручки, необходимой для многомиллиардной модернизации, и без роста расходов для рядовых потребителей. Кроме того, дополнительно заключён отдельный договор на 15 лет о поставках 2,7 ГВт с действующих электростанций Constellation.

Google Cloud в рамках сделки получила и нового клиента — компания обеспечит Constellation облачными вычислительными ресурсами в течение пяти лет, а также доступом к платформе Gemini Enterprise. Это позволит генерирующей компании применить ИИ для выбора новых площадок, управления отключениями энергии и ремонтом, а заодно защитить критически важную инфраструктуру и оптимизировать распределение нагрузок между генерирующими объектами.

Google пообещала, что соглашение позволит сохранить 4,4 тыс. рабочих мест для высококвалифицированных кадров. По словам Google, новый договор позволит обеспечить американцев дополнительной электроэнергией без строительства новых объектов. Подчёркивается, что в США действуют 94 реактора, поэтому страна располагает шансом эффективно нарастить возможности АЭС за счёт уже работающих энергоблоков.

 Источник изображения: Johannes Plenio/unsplash.com

Источник изображения: Johannes Plenio/unsplash.com

Ранее Google заключила соглашения с NextEra Energy о возобновлении работы «спящего» реактора Duane Arnold в Айове, а также с Southern Co., которая обязалась модернизировать две своих действующих электростанции. В мае 2025 года сообщалось, что Google и Elementl реализуют в США три 600-МВт атомных проекта. Кроме того, в конце 2025 года она договорилась с Commonwealth Fusion Systems о покупке термоядерной энергии, в августе того же года — с Kairos о подключении к SMR. В сентябре сообщалось, что Google заключила PPA с финской Fortum в расчёте на ресурсы местной АЭС.

Constellation уже взаимодействует с другими гиперскейлерами. Так, недавно она сообщила, что AWS согласилась покупать 690 МВт энергии АЭС Calvert Cliffs в Мэриленде в рамках соглашения сроком 20 лет. Сделка позволит направить $3 млрд на модернизацию энергоблоков. Одним из первых прямых соглашений с гиперскейлерами стала сделка с Microsoft, заключенная в 2024 году сроком на 20 лет. Контракт позволял дать «второе дыхание» АЭС Three Mile Island в Пенсильвании.

В числе прочих гиперскейлеров, инвестирующих в ядерную энергию — Oracle и Meta✴. Первая планирует использовать электричество АЭС в своём новом проекте ЦОД в Висконсине в рамках соглашения, позволяющего переложить $300 млн расходов на энергетику с потребителей коммунальных услуг на других участников рынка. Meta✴, в свою очередь, заключила PPA с Vistra Corp. на 20 лет.

Спрос на энергию подстёгивает и развитие SMR. Например, в августе Valar Atomics привлекла $1 млрд на финансирование массового производства своих прототипов SMR. X-energy Reactor привлекла $700 млн только в ноябре, всего за месяц до того, как Radiant Industries заручилась поддержкой на $300 млн на аналогичный проект.

Постоянный URL: http://servernews.ru/1149699
09.10.2026 [15:17], Андрей Крупин

Представлена операционная система KvadraOS Desktop для корпоративных рабочих мест

Российский бренд Kvadra компании «Ядро клиентские системы» (YADRO, входит в «ИКС Холдинг») выпустил KvadraOS Desktop — операционную систему для рабочих станций. Платформа предназначена для корпоративных и государственных клиентов и позволяет поэтапно переводить бизнес-процессы на отечественное программное обеспечение с сохранением привычных пользовательских сценариев и части существующего ПО.

KvadraOS Desktop позволяет взаимодействовать с веб-, Linux- и Android-приложениями. Windows-приложения из перечня совместимого ПО, включая Microsoft Office 2016, можно запускать через интегрированный слой совместимости. Для сценариев, которым требуется полноценная среда Windows, предусмотрено подключение к инфраструктуре виртуальных рабочих столов. Операционная система поддерживает подключение к домену Microsoft Active Directory, работу с VPN, сетевыми ресурсами, печать и подключение периферийных устройств. Обновления могут поступать с серверов Kvadra, также предусмотрены тиражирование подготовленного образа ОС и возврат устройства к исходным настройкам.

 Источник изображения: yadro.com

Источник изображения: yadro.com

Отдельное внимание в kvadraOS Desktop уделено безопасности рабочего окружения. Системная область доступна только для чтения, среды исполнения приложений изолированы друг от друга, а запуск ОС защищён механизмом доверенной загрузки. Платформа поддерживает шифрование пользовательских данных, TPM 2.0, ГОСТ-криптографию на базе «КриптоПро», многофакторную аутентификацию, российские корневые сертификаты, а также сценарии входа с помощью USB-токенов и смарт-карт «Рутокен» и JaCarta.

KvadraOS Desktop развивает линейку программного обеспечения компании «Ядро клиентские системы», в которую также входит мобильная операционная система KvadraOS Mobile для планшетных компьютеров Kvadra.

Постоянный URL: http://servernews.ru/1149706
09.10.2026 [14:49], Сергей Карасёв

Selectel выпустила серверную платформу на базе AMD EPYC 9005 Turin

Российская компания Selectel сообщила о выходе серверной платформы на базе AMD EPYC 9005 Turin для широкого спектра рабочих нагрузок. Решение выполнено на материнской плате собственной разработки SSE-MB-202, которая производится по оригинальной конструкторской документации.

Плата имеет размеры 424,4 × 368,4 мм. Допускается установка двух процессоров в исполнении SP5 (до 192 ядер и 384 потоков) с показателем TDP до 500 Вт. Предусмотрены 24 слота для модулей оперативной памяти DDR5-5600 ECC RDIMM суммарным объёмом до 12 Тбайт. Упомянуты два коннектора M.2, два слота PCIe 5.0 для карт формата FHFL, до пяти разъёмов PCIe 5.0 для карт HHHL и слот OCP 3.0.

Новинка предлагается в трёх модификациях — SSE-A212-E5, SSE-A212S-E5 и SSE-A212G-E5. Первая оптимизирована для типовых серверных задач: виртуализации, корпоративных приложений и баз данных. Возможно подключение до 12 накопителей SAS/SATA/NVMe (PCIe 4.0). Есть два универсальных райзера. Вторая версия имеет схожие характеристики, но позиционируется в качестве основы для систем хранения, баз данных и аналитики.

 Источник изображений: Selectel

Источник изображений: Selectel

Третья модель подходит для ИИ-инференса, обработки видео и инженерных расчётов: она поддерживает 12 накопителей SAS/SATA/NVMe (PCIe 5.0) и два полноразмерных GPU. Реализованы жёсткие райзеры и гибкий райзер x16. BMC-контроллер выполнен на отдельной OCP-плате с коннектором RJ45 для сетевого кабеля.

Новая серверная платформа доступна в составе выделенных серверов Selectel. Клиенты могут арендовать её в дата-центре производителя или заказать доставку на собственную площадку с правом выкупа.

Постоянный URL: http://servernews.ru/1149689
08.10.2026 [13:43], Сергей Карасёв

YADRO представила контейнерный ЦОД Borey с возможностью гибкого масштабирования

Компания YADRO анонсировала контейнерный дата-центр Borey, который позволяет оперативно разворачивать вычислительную инфраструктуру на неподготовленных объектах и размещать резервные мощности на удалённых площадках.

Решение представляет собой готовую вычислительную систему внутри изолированного модуля с возможностью размещения серверов, СХД и сетевого оборудования. Yadro Borey выпускается в 30-, 40- и 45-футовых исполнениях: в зависимости от конфигурации внутри могут быть установлены от двух до восьми стоек формата 42U или 48U.

Дата-центр оснащается системами электропитания (ИБП мощностью до 50 кВт с резервированием N+1, два ввода питания), мониторинга и удалённого управления, контроля доступа, видеонаблюдения и автоматического газового пожаротушения. Интегрированная система охлаждения построена с уровнем резервирования N+1: она обеспечивает отвод до 12 кВт тепла от каждой серверной стойки. В стандартном исполнении ЦОД рассчитан на работу при температуре окружающей среды от -45 до +45 °C, а опционально нижняя граница может быть расширена до -60 °C.

 Источник изображений: YADRO

Источник изображений: YADRO

Обеспечивается возможность гибкого масштабирования. В зависимости от потребностей заказчика устанавливается один автономный модуль или монтируются несколько контейнеров в виде многоуровневого комплекса с единой инженерной и логистической инфраструктурой. Допускается построение многоэтажных ЦОД с установкой лифтов и лестничных маршев, а также общим фасадом. При этом не требуется разрешение на капитальное строительство, что сводит к минимуму временные затраты на формирование полнофункционального объекта. Возможно размещение в любых регионах с разными климатическими условиями, включая территории со слабо развитой инфраструктурой.

Срок производства и комплектации контейнерного ЦОД составляет от 8 до 10 недель в зависимости от выбранного исполнения, а на его запуск и ввод в эксплуатацию требуется всего один рабочий день (без учёта доставки). Изделия изготавливаются на собственных площадях в Москве. Модули можно перевозить по дорогам общего пользования без специального разрешения и сопровождения: в транспортном положении решение неотличимо от стандартного ISO-контейнера, не имеет технологических отверстий и выступающих элементов. При необходимости ЦОД можно перевезти на другую площадку и повторно ввести в эксплуатацию на новом месте.

К услугам заказчиков — сервисные центры в регионах России, склад запчастей, оперативный выезд специалистов и техническая поддержка в режиме 24/7/365. Состояние инженерной инфраструктуры отслеживает централизованная система мониторинга с возможностью удалённого контроля. Через веб-интерфейс она позволяет получать данные о работе инженерных подсистем и автоматические уведомления, в том числе через мессенджеры. Предоставляется комплексная гарантия на все работы и оборудование (от 12 мес.).

Постоянный URL: http://servernews.ru/1149620
08.10.2026 [13:40], Сергей Карасёв

YADRO представила GPU-сервер G4208P G3 на базе Intel Xeon Emerald Rapids с СЖО

Компания YADRO, входящая в «ИКС Холдинг», анонсировала сервер G4208P G3 для ресурсоёмких задач, таких как обучение нейросетей, разработка ИИ-приложений, высокоскоростной рендеринг, видеоаналитика, предиктивное обслуживание оборудования, автоматизация технологических процессов, обработка больших массивов информации и пр.

Новинка, выполненная в форм-факторе 4U, использует аппаратную платформу Intel: возможна установка двух процессоров Xeon Sapphire Rapids или Xeon Emerald Rapids с TDP до 350 Вт. Поддерживается до 8 Тбайт DDR5-5600 RDIMM/LRDIMM ECC в виде 32 модулей по 256 Гбайт. Во фронтальной части расположены 12 отсеков для накопителей LFF/SFF в конфигурации 8 × SAS/SATA и 4 × SAS/SATA/NVMe. Возможно формирование массивов RAID 0/1/10/5/50/6/60, а опционально может быть добавлен суперконденсатор для защиты содержимого кеш-памяти при отключении питания.

Сервер способен нести на борту до восьми двухслотовых GPU с интерфейсом PCIe 5.0 х16 и энергопотреблением до 600 Вт каждый. Среди совместимых изделий названы NVIDIA H200 NVL, RTX PRO 6000 Blackwell, L40S, A30, A16, RTX 6000 Ada, RTX 4000 Ada, L4, а также MetaX C500. Реализована система жидкостного охлаждения, которая охватывает CPU и GPU. Отмечается, что в ходе испытаний при 100 % загрузке температура GPU не превышала 60 °C при температуре окружающей среды 22–23 °C и 77 °C — при 39 °C. При существенном росте температуры на площадке тепловой режим ускорителей сохранялся предсказуемым. Дополнительно задействованы 12 двухроторных вентиляторов с размерами 60 × 56 мм, резервированием N+2 и поддержкой горячей замены.

 Источник изображения: YADRO

Источник изображения: YADRO

В передней части машины находится один слот PCIe 5.0 x16 FHFL, в задней — восемь слотов PCIe 5.0 x16 FHFL, два разъёма PCIe 5.0 x16 FHFL и один слот OCP 3.0 (PCIe 5.0 x8). Питание обеспечивают четыре блока мощностью 3200 Вт с сертификатом 80 Plus Platinum и резервированием по схеме 2+2 или 3+1. Есть выделенный сетевой порт управления 1GbE RJ45, три порта USB 3.0 Type-A (один спереди), коннектор USB 2.0, а также два разъёма D-Sub (по одному спереди и сзади). Диапазон рабочих температур простирается от +5 до +40 °C. Габариты составляют 447 × 844,3 × 174,8 мм, масса — до 65 кг.

Говорится о совместимости с Windows Server, Ubuntu, «Альт СП Сервер», «Альт Сервер», «РЕД ОС», Astra Linux Special Edition, «РЕД Виртуализация», zVirt, moncloud, «Соболь», SberLinux, РОСА ХРОМ.

Постоянный URL: http://servernews.ru/1149619
07.10.2026 [16:14], Владимир Мироненко

Dell расширила возможности Dell AI Data Platform

Dell Technologies объявила о добавлении в ИИ-платформу Dell AI Data Platform новых возможностей, призванных повысить точность ответов ИИ-систем, снизить затраты на запуск ИИ-проектов и ускорить процесс производства, предоставляя приложениям и агентам надёжный текущий контекст из собственных данных компании.

В частности, Dell добавила единый семантический уровень (Unified Semantic Layer), чтобы дать ИИ-агентам представление о бизнес-значении корпоративных данных, а также граф корпоративных знаний (Enterprise Knowledge Graph), который объединяет связанные объекты в рамках организации.

Единый семантический уровень предоставляет структурированную и неструктурированную информацию, которая соответствует бизнес-смыслу с помощью правил, определений и глоссария с возможностью поиска, т.ч. термин означает одно и то же везде, где он встречается. Dell также использует открытую библиотеку NVIDIA Auto-Ontology, которая строит графы знаний на основе корпоративных данных, чтобы расширить семантический уровень. Работая в тандеме, Enterprise Knowledge Graph постоянно отображает происхождение, метаданные и поведение запросов за прошлые периоды как в структурированных таблицах, так и в неструктурированных документах.

Агенты знаний (Knowledge Agents) используют этот контекст для работы. Клиенты устанавливают правила: каким рекомендациям они следуют, какие данные могут просматривать, какой планку качества они должны достичь и сколько им разрешено потратить на вычисления.

 Источник изображения: Dell

Источник изображения: Dell

Dell также добавила новую возможность в Data Processing Engine, предназначенную для ускорения подготовки корпоративных данных для ИИ. Движок будет работать на GPU, использующих библиотеку NVIDIA cuDF. Сообщается, что Dell Data Processing Engine, работающий на базе cuDF и GPU NVIDIA RTX PRO 4500 Blackwell Server Edition, обрабатывает данные в среднем почти в четыре раза быстрее, чем только с помощью CPU, при различных рабочих нагрузках и до 20 раз быстрее при пакетной обработке.

Архитектурные усовершенствования нацелены на улучшенное извлечение данных, в том числе путём прямого подключения «сырых» файлов, баз данных и различных хранилищ непосредственно к конвейерам ИИ-агентов. NVIDIA cuDF ускоряет обработку, Apache Spark с GPU-ускорением подготавливает структурированные и неструктурированные данные, а Apache Arrow эффективно передаёт данные из хранилища на обработку с полной безопасностью на протяжении всего процесса. Платформа использует NVIDIA Nemotron Retriever для анализа, обучения и повторного ранжирования документов, в то время как NVIDIA cuVS обеспечивает ускоренную векторную индексацию и процедуры поиска.

СХД Dell PowerScale теперь поддерживает до 500 изолированных клиентов на кластер, используя mTLS over NFS для шифрования и аутентификации файлового трафика и более детализированный контроль доступа на основе ролей для управления каждым клиентом. Новый открытый инструмент Dell Storage Performance Tool позволяет заказчикам оценивать ИИ-инфраструктуру, сравнивать решения поставщиков и поддерживать работоспособность GPU, тестируя производительность своих S3-хранилищ в процессе обучения, инференса и проверки контрольных точек.

На данный момент доступны Dell Storage Performance Tool и сервисы по внедрению платформы Dell AI Data Platform. В ноябре 2026 года планируется выпуск решений для многопользовательского применения кластеров PowerScale и mTLS over NFS. Усовершенствования Dell Data Processing Engine с использованием NVIDIA Acceleration Stack появятся в декабре 2026 года, за которыми последует интеграция с ускорением с помощью Apache Arrow в первом полугодии 2027 года. Выпуск Unified Semantic Layer, Enterprise Knowledge Graph и контекстных платформ Knowledge Agent состоится в I полугодии 2027 года.

Постоянный URL: http://servernews.ru/1149581
07.10.2026 [08:32], Руслан Авдеев

Банк Англии призвал не ждать скорой экономической выгоды от ИИ

По словам главы Банка Англии Эндрю Бейли (Andrew Bailey), в отрасль ИИ направляется немало средств, и искусственный интеллект способен внести значительный вклад в британскую и мировую экономику, но эффект может оказаться ниже ожиданий финансовых рынков. При этом дожидаться экономической выгоды, возможно, придётся дольше, чем предполагалось, сообщает Computer Weekly

Согласно протоколу заседания Комитета по финансовой политике (Financial Policy Committee, FPC) Банка Англии от 25 сентября, развитие ИИ может повлиять на широкий круг инвесторов и финансовых рынков. Отмечено, что всё больше инвестиций привлекается за счёт выпуска долговых обязательств. Как предупредили в FPC, рост долговой нагрузки ИИ-бизнесов в комбинации с их непрозрачностью и всё более частыми «циклическими» схемами финансирования могут осложнить оценку рисков и увеличить потери, если ожидания не оправдаются.

Комитет также подчеркнул, что оценка перспектив роста и финансовые прогнозы отчасти зависят от ожиданий того, что развитие и внедрение ИИ обеспечит значительный рост производительности труда. Поэтому пересмотр ожиданий способен сказаться не только на стоимости связанных с ИИ активов, но и на рынках государственного долга.

 Источник изображения: Francais a Londres/unsplash.com

Источник изображения: Francais a Londres/unsplash.com

Дополнительно в FPC обсудили сложившуюся ситуацию сокращающегося разрыва между ИИ-моделями с открытыми и закрытыми весами. Предполагается, что это обеспечит широкий доступ к передовым ИИ-возможностям. При этом возникают и риски для IT-безопасности, поскольку открытыми моделями могут пользоваться, например, киберпреступники. Впрочем, это также означает, что современные ИИ-возможности станут доступны всем без необходимости платить за доступ к лучшим закрытым моделям.

Если open source модели обеспечат передовые ИИ-возможности, покупатели могут предпочесть более дешёвые открытые варианты решениям, предлагаемым компаниями вроде OpenAI и Anthropic. Кроме того, для использования открытых моделей обычно требуется менее производительное оборудование.

По прогнозам Gartner, инвесторам в ИИ-бизнесы, возможно, придётся ожидать измеримой экономической отдачи более пяти лет. В компании полагают, что совокупные инвестиции в ИИ не обеспечат необходимую для рентабельности доходность инвестированного капитала (ROIC) на уровне 12 % ранее 2032 года.

С точки зрения покупателей IT-продуктов и руководителей, отвечающих за IT-стратегию компаний, имеются вполне реальные риски того, что к тому времени некоторые бизнесы, у которых они приобрели ИИ-продукты, уже прекратят существование. Кроме того, не исключён рост стоимости инференса и машинного обучения, поскольку ИИ-бизнесы намерены как поднимать стоимость компании, так и продолжить инвестиции в дорогое ИИ-оборудование.

Ранее Gartner прогнозировала, что большинство кастомных ИИ-моделей и проектов генеративного ИИ ожидает провал, а Банк Англии намеревался проверить кредитование ЦОД на фоне возможного пузыря на рынке ИИ. На днях компания Bain & Company опубликовала доклад, согласно которому к 2031 году ИИ-индустрия должна приносить $6 трлн ежегодно, чтобы отбить затраты на инфраструктуру.

Постоянный URL: http://servernews.ru/1149530
06.10.2026 [22:44], Владимир Мироненко

NetApp представила зеттабайтную платформу храненния Novus для ИИ-фабрик с миллионами GPU

Компания NetApp представила дезагрегированную архитектуру нового поколения NetApp Novus, поддерживающую хранение данных зеттабайтного масштаба, которая позволит ИИ-фабрикам обеспечивать непрерывную подачу данных на миллионы GPU, повышая до максимума эффективность, уровень загрузки ресурсов и окупаемость инвестиций. NetApp позиционирует Novus как самую быструю на планете систему хранения.

Компания отметила, что неооблака и провайдеры GPUaaS создают ИИ-фабрики такого масштаба, на который не были рассчитаны традиционные архитектуры СХД. Это приводит к возникновению «узких мест», снижающих коэффициент использования GPU и увеличивающих затраты на инфраструктуру. При использовании традиционных архитектур загрузка GPU может падать ниже 30​%, если система не способна обеспечить подачу достаточного объёма данных для получения необходимых результатов и окупаемости вложений.

«ИИ-фабрики давно нуждались в инфраструктуре, способной масштабироваться со скоростью развития технологий ИИ», — отметил Сьям Наир (Syam Nair), директор по продуктам NetApp. По его словам, используя преимущества платформы NetApp, решение Novus обеспечивает совокупную пропускную способность 100 Тбайт/с с возможностью неограниченного горизонтального масштабирования.

 Источник изображения: NetApp

Источник изображения: NetApp

Ариндам Банерджи (Arindam Banerjee), главный архитектор платформ и технологий NetApp, пояснил, что Novus использует принцип федерации для объединения нескольких кластеров хранения в единое пространство имен, при этом пропускная способность системы растёт по мере добавления новых кластеров. Архитектура опирается на стандартные протоколы pNFS и Flex Files, что позволяет использовать стандартное ядро Linux.

Это избавляет операторов от необходимости развёртывать, обновлять и проверять проприетарные клиентские решения для тысяч образов узлов, различных поколений GPU и сред разных арендаторов. Такой подход устраняет значительный источник постоянных накладных расходов, сохраняя при этом единое пространство имен для совместной инфраструктуры ИИ. Novus переносит надёжность, безопасность и возможности многопользователького доступа платформы ONTAP в архитектуру, специально разработанную для ИИ-фабрик, говорит он.

Novus разделяет потоки метаданных и данных, позволяя каждому из них масштабироваться независимо. Банерджи отметил, что в Novus службы обработки метаданных разделены на независимо масштабируемые уровни (протоколов, состояний и каталогов). Это позволяет устранить «узкие места», возникающие при рабочих нагрузках ИИ, когда интенсивные операции чтения и записи данных сочетаются с масштабными операциями с метаданными. Серверы данных Novus будут работать под управлением ОС ONTAP, что позволит распространить на новую архитектуру уже существующие в решениях NetApp механизмы обеспечения целостности данных, отказоустойчивости, безопасности, изоляции и качества обслуживания (QoS).

 Источник изображения: NetApp

Источник изображения: NetApp

Единое пространство имен упрощает эксплуатацию. Когда данные задачи распределены по разным системам, их приходится перемещать, перемонтировать, перебалансировать, а также отслеживать каждую копию. Единое пространство имён зеттабайтного масштаба устраняет эту проблему, обеспечивая постоянную доступность наборов данных, контрольных точек и артефактов модели по мере роста среды. Архитектура Novus позволяет операторам добавлять ёмкость и повышать производительность без необходимости внесения изменений в приложения, прерывания работы или сбоев в работе клиентов. Вместо того, чтобы делать топологию хранения видимой для каждой рабочей нагрузки, Novus предоставляет единую согласованную среду данных, созданную для масштабов ИИ-фабрики.

Первые версии Novus объединяют ПО для управления метаданными NetApp Novus Data Director (работающее на сертифицированной инфраструктуре Supermicro) и сервисы обработки данных NetApp ONTAP, реализованные на базе систем AFF A90. В совокупности они формируют дезагрегированную архитектуру, рассчитанную на пропускную способность свыше 100 Тбайт/с и высокую степень загрузки сотен тысяч GPU, при этом сохраняя надёжные корпоративные сервисы обработки данных ONTAP, которым доверяют клиенты.

Как отметил ресурс Blocks​&​Files, системы ONTAP на базе платформ AFF (A800, A90 и аналогичных) поддерживают технологию GDS (GPU Direct Storage) c NFS поверх RDMA, начиная с версии ONTAP 9.12.1. Опубликованные результаты демонстрируют показатели ~171 ГиБ/с (для A800) и ~351 ГиБ/с (для кластера A90), так что Novus с запасом превзойдёт эти цифры. Решение NetApp AFX (дезагрегированная версия ONTAP для ИИ) сертифицировано для использования с NVIDIA DGX SuperPOD и прошло тестирование с технологией Magnum IO GPUDirect Storage. NetApp зафиксировала устойчивую пропускную способность 457 ГиБ/с при работе восьми узлов AFX. В документации AFX заявлена поддержка NFS/RDMA, включая технологии GPU Direct, pNFS и Session Trunking.

 Источник изображения: NetApp

Источник изображения: NetApp

По словам гендиректора NetApp Джорджа Куриана (George Kurian), благодаря пропускной способности в 100 Тбайт/с и доступу к объёму данных, превышающему 1 Збайт, в рамках единого пространства имен, NetApp Novus поможет ускорить научные исследования: например, учёные смогут в реальном времени запускать сложные симуляции и модели, а биологи — задействовать десятки тысяч компьютеров для отслеживания поведения каждой молекулы белка в клетке.

Как отметила NetApp, клиенты, внедряющие архитектуру Novus, получают следующие преимущества:

  • Максимальная эффективность использования GPU: Novus обеспечивает высокую загрузку GPU путём отделения сервисов обработки метаданных от путей передачи данных, устранения «узких мест» в системе хранения и бесперебойной подачи высокопроизводительных потоков данных в ИИ-инфраструктуру.
  • Масштабирование без фрагментации: Novus позволяет наращивать объёмы данных (включая миллиарды файлов и массивные наборы данных для ИИ) в рамках единого пространства имен. Это обеспечивает независимое масштабирование метаданных, пропускной способности и ёмкости без создания изолированных хранилищ или усложнения операционных процессов.
  • Повышение эффективности ИИ-инфраструктуры: Novus позволяет масштабировать только те ресурсы, которые необходимы для конкретной рабочей нагрузки, снижая затраты на электроэнергию, занимаемую площадь и обслуживание инфраструктуры, и одновременно сохраняя отказоустойчивость, безопасность и возможности мультиарендности, необходимые для совместного использования ИИ-сред.
Постоянный URL: http://servernews.ru/1149374
06.10.2026 [18:31], Сергей Карасёв

Bull удвоила мощности по производству суперкомпьютерных стоек во Франции

Компания Bull, выкупленная властями Франции у Atos Group за €404 млн, объявила о запуске модернизированного производственного комплекса в Анже — примерно в 300 км к юго-западу от Парижа. Мощность площадки увеличилась в два раза — с 6 до 12 суперкомпьютерных стоек в месяц, а в 2027 году объемы выпуска планируется довести до 24 единиц.

Инвестиции в проект составили €80 млн. Общая площадь завода составляет примерно 20 тыс. м2, из которых 10,7 тыс. м2 отведено непосредственно под производство. На объекте смонтированы более 3500 фотоэлектрических панелей с суммарной пиковой мощностью 1500 кВт. Используется электроэнергия из возобновляемых источников. Кроме того, реализована система рекуперации, улавливающая тепло от оборудования: в перспективе в сеть централизованного теплоснабжения планируется подавать до 5 ГВт·ч/год.

 Источник изображения: Bull

Источник изображения: Bull

По заявления Bull, модернизация позволила создать уникальный для Европы промышленный комплекс, на базе которого может выполняться широчайший спектр операций — от проектирования и сборки систем до их тестирования и интеграции. На площадке будут изготавливаться суперкомпьютеры, ИИ-оборудование, корпоративные серверы, а в дальнейшем — и квантовые решения. Запуск модернизированного завода является частью более масштабного проекта реконструкции, завершение которого запланировано на 2028 год.

Bull играет важную роль в формировании европейской сети суперкомпьютеров, на создание которой Европейский союз выделил €7 млрд в 2021–2027 годах. В частности, компания участвует в проекте второго европейского суперкомпьютера экзафлопсного класса — системы Alice Recoque. Кроме того, Bull займётся созданием европейского ИИ-суперкомпьютера LUMI-AI стоимостью €387,8 млн. В целом, компания выиграла 15 из 18 тендеров, объявленных Европейским совместным предприятием по развитию высокопроизводительных вычислений (EuroHPC JU).

Постоянный URL: http://servernews.ru/1149537

✴ Входит в перечень общественных объединений и религиозных организаций, в отношении которых судом принято вступившее в законную силу решение о ликвидации или запрете деятельности по основаниям, предусмотренным Федеральным законом от 25.07.2002 № 114-ФЗ «О противодействии экстремистской деятельности»;