Материалы по тегу: x

25.07.2025 [17:41], Сергей Карасёв

SoftBank развернула крупнейшую в мире ИИ-платформу на базе NVIDIA DGX B200

Японский холдинг SoftBank объявил о расширении вычислительной ИИ-инфраструктуры на платформе NVIDIA DGX SuperPOD: развёрнуты системы DGX B200, насчитывающие в общей сложности 4 тыс. ускорителей поколения Blackwell. О планах SoftBank по созданию первого в мире ИИ-суперкомпьютер на базе NVIDIA DGX B200 стало известно в конце прошлого года. Вычислительная система использует интерконнект Quantum-2 InfiniBand и поддерживается программной платформой NVIDIA AI Enterprise.

Холдинг SoftBank изначально внедрил DGX SuperPOD с более чем 2 тыс. ускорителями поколения NVIDIA Ampere в сентябре 2023 года: на тот момент производительность достигала 0,7 Эфлопс на операциях ИИ (точность вычислений не раскрывается). В октябре 2024 года завершился первый этап модернизации, в ходе которого были добавлены 4000 ускорителей семейства NVIDIA Hopper. В результате, суммарное быстродействие поднялось до 4,7 Эфлопс. После установки DGX B200 показатель вырос до 13,7 Эфлопс.

Отмечается, что на сегодняшний день новая вычислительная инфраструктура SoftBank является крупнейшей в мире ИИ-платформой на основе DGX B200. При этом в общей сложности задействованы свыше 10 тыс. ускорителей. Изначально систему будет использовать SB Intuitions Corp. — дочерняя структура SoftBank, которая специализируется на разработке собственных больших языковых моделей (LLM), адаптированных для Японии. SB Intuitions уже создала LLM с примерно 460 млрд параметров, а в текущем 2025 финансовом году, который заканчивается 31 марта 2026-го, компания планирует представить коммерческую ИИ-модель Sarashina mini с 70 млрд параметров.

Нужно отметить, что ранее SoftBank и OpenAI объявили о формировании совместного предприятия SB OpenAI для развития корпоративных ИИ-сервисов в Японии. Кроме того, SoftBank участвует в мегапроект Stargate — это совместное предприятие с OpenAI и Oracle по развитию ИИ-инфраструктуры в США. Предполагается, что суммарные затраты на реализацию Stargate достигнут $500 млрд. Впрочем, пока проект продвигается с большим трудом.

Постоянный URL: http://servernews.ru/1126572
22.07.2025 [17:54], Владимир Мироненко

Всё своё, от «железа» до ПО: «Группа Астра» и YADRO строят полностью российское облако

«Группа Астра» в сотрудничестве с YADRO строит на базе российских решений альтернативу западным облачным платформам, которая позволит российским компаниям ускорить переход на цифровые сервисы. YADRO выступает ключевым партнёром в масштабном развитии облачной инфраструктуры Astra Cloud, в основе которой лежат её серверы, СХД и сетевые решения.

В частности, в инфраструктуре Astra Cloud используются серверы VEGMAN R220 G2, СХД корпоративного уровня TATLIN.UNIFIED GEN2, а также сетевые коммутаторы KORNFELD производства YADRO. В дальнейшем в рамках проекта может быть расширен спектр используемых аппаратных решений YADRO. В частности, планируется тестирование сценариев использования TATLIN.OBJECT и TATLIN.BACKUP.

 Источник изображения: «Группа Астра»

Источник изображения: «Группа Астра»

В рамках совместного проекта будет установлено 300 серверов VEGMAN, две СХД и 38 коммутаторов с последующим расширением инфраструктуры до тысяч серверов в ближайшие годы по мере развития сервиса. Первый этап проекта планируется завершить в III квартале 2025 года.

Благодаря реализации проекта становятся более доступными в инфраструктуре Astra Cloud такие продукты «Группы Астра», как почтовый сервер RuPost, корпоративное файловое хранилище Astra Disk, платформа виртуализации рабочих мест Termidesk и другие сервисы. Astra Cloud ориентируется как на бизнес, так государственный сектор, гарантируя соответствие регуляторным требованиям, говорит компания. В зависимости от потребностей заказчиков Astra Cloud обеспечивает развёртывание изолированной и аттестованной моделей, включая возможность создания выделенных инсталляций.

Сотрудничество со стратегическим партнёром создаёт прочную основу для предоставления программных решений «Группы Астра» по подписочной модели — в полностью отечественном облаке, говорит «Астра Облако». «Вместе мы создаём рынок, на котором заказчики могут быть уверены: всё, от оборудования до ПО и сервисов, разрабатывается и поддерживается в России. Такой подход позволяет клиентам строить как локальные инфраструктуры, так и надёжные облачные сервисы на единой технологической базе, сохраняя высокий уровень производительности и безопасности», — отмечает YADRO.

Постоянный URL: http://servernews.ru/1126355
22.07.2025 [12:30], Сергей Карасёв

AAEON выпустила индустриальный одноплатный компьютер PICO-TWL4 на базе Intel Twin Lake

Компания AAEON пополнила ассортимент одноплатных компьютеров моделью PICO-TWL4 для задач промышленной автоматизации. Изделие выполнено в форм-факторе Pico-ITX с размерами 100 × 72 мм, а в основу положена аппаратная платформа Intel Twin Lake.

В зависимости от модификации установлен чип Intel Processor N150 (четыре ядра; до 3,6 ГГц; 6 Вт) или Core i3-N355 (восемь ядер; до 3,9 ГГц; 15 Вт). Процессоры наделены графическим ускорителем Intel UHD Graphics. Объём оперативной памяти DDR5-4800 Non-ECC достигает 16 Гбайт (один модуль SO-DIMM).

В оснащение входят сетевые контроллеры Intel I226 2.5GbE и Realtek RTL8111H-CG 1GbE с разъёмами RJ45, звуковой кодек Realtek ALC256 (опционально), полноразмерный слот mSATA/mPCIe, слот M.2 2230 E-Key для адаптера Wi-Fi/Bluetooth и модуль TPM 2.0 для обеспечения безопасности. Накопитель может быть подключён к порту SATA-3. Есть два порта USB 3.2 Gen2 и коннектор HDMI 1.4 с возможностью вывода изображения с разрешением до 3840 × 2160 пикселей (30 Гц).

 Источник изображения: AAEON

Источник изображения: AAEON

Через разъёмы на плате могут быть задействованы четыре последовательных порта (по два RS-232/422/485 и RS-232), интерфейс LVDS (1920 × 1200 точек; 60 Гц) или eDP 1.4 (3840 × 2160 пикселей; 60 Гц), четыре порта USB 2.0, линейный аудиовыход и пр. Питание (12 В) подаётся через двухконтактный разъём Phoenix. AAEON отмечает, что диапазон напряжений можно расширить до 9–36 В с помощью дополнительной платы-адаптера. Новинка может эксплуатироваться при температурах от 0 до +60 °C. Предусмотрен четырёхконтактный разъём для подключения вентилятора охлаждения. Заявлена совместимость с Windows 10/11 и Ubuntu 22.04.2 (ядро 5.19).

Постоянный URL: http://servernews.ru/1126320
21.07.2025 [09:27], Сергей Карасёв

10 долгих лет: состоялся официальный запуск экзафлопсного суперкомпьютера Aurora

В Аргоннской национальной лаборатории (ANL) Министерства энергетики США (DOE) в Иллинойсе состоялась церемония торжественного разрезания ленты в честь официального запуска суперкомпьютера Aurora экзафлопсного класса. В мероприятии приняли участие руководители и исследователи Intel, HPE и DOE. Церемония была скорее формальностью, поскольку Aurora стала доступна исследователям со всего мира в начале текущего года.

Aurora является одним из трёх суперкомпьютеров DOE с производительностью более 1 Эфлопс. Наряду с El Capitan в Ливерморской национальной лаборатории имени Лоуренса (LLNL) и Frontier в Национальной лаборатории Оук-Ридж (ORNL) эти НРС-комплексы занимают первые три места как в списке TOP500 самых быстрых суперкомпьютеров мира, так и в бенчмарке HPL-MxP для оценки производительности ИИ.

У суперкомпьютера непростая судьба. Анонс машины состоялся в 2015 году — система с FP64-производительностью на уровне 180 Пфлопс по плану должна была заработать в 2018 году. Однако планы неоднократно корректировались, а проект в конце концов был кардинально пересмотрен. Первые тестовые кластеры системы заработали более двух лет назад, а частично запущенная система попала в TOP500 в конце 2023 года. Целиком она заработала в 2024 году.

 Источник изображения: ANL / Intel

Источник изображения: ANL / Intel

В проекте по созданию Aurora принимали участие Intel и HPE. Машина построена на платформе HPE Cray EX — Intel Exascale Compute Blade: задействованы процессоры Intel Xeon CPU Max и ускорители Intel Data Center GPU Max, объединённые интерконнектом HPE Slingshot. В общей сложности применяются 63 744 ускорителей, что делает Aurora одним из крупнейших в мире суперкомпьютеров на базе GPU.

 Источник изображения: ANL / Intel

Источник изображения: ANL / Intel

Установлена ОС SUSE Linux Enterprise Server 15 SP4. Производительность в тесте Linpack составляет 1,012 Эфлопс, а теоретический пиковый показатель достигает 1,980 Эфлопс. НРС-комплекс занимает площадь около 930 м2. Развёрнута современная инфраструктура жидкостного охлаждения. Общая протяжённость соединений превышает 480 км, а количество конечных точек сети достигает 85 тыс.

Aurora останется по-своему уникальным суперкомпьютером: CPU с HBM на борту больше не планируются, от Ponte Vecchio компания отказалась в пользу Habana Gaudi и Falcon Shores. Но и последние на рынок не попадут, а будут использоваться для внутренних тестов и обкатки технологий. На смену им должны прийти Jaguar Shores, но точных дат Intel не называет.

Вычислительные мощности Aurora, как отмечается, помогают в решении сложнейших задач в самых разных областях. В биологии и медицине исследователи используют ИИ-возможности суперкомпьютера для прогнозирования эволюции вирусов, улучшения методов лечения рака и картирования нейронных связей в мозге. В аэрокосмической сфере Aurora используется для создания двигательных установок нового поколения и моделирования аэродинамических процессов. Комплекс играет важную роль в развитии технологий термоядерной энергетики, квантовых вычислений и пр.

Постоянный URL: http://servernews.ru/1126243
19.07.2025 [15:58], Владимир Мироненко

Intel прекратила поддержку фирменного дистрибутива Clear Linux OS

Intel объявила о прекращении поддержки оптимизированного для производительности дистрибутива Clear Linux OS. «Начиная с этого момента, Intel больше не будет предоставлять исправления безопасности, обновления или техническое обслуживание Clear Linux OS, а репозиторий Clear Linux OS на GitHub будет заархивирован и доступен в режиме только для чтения», — указано в заявлении компании на странице Clear Linux Project.

Всем, кто в настоящее время использует Clear Linux OS, компания рекомендовала запланировать переход на другой активно поддерживаемый дистрибутив. Intel также отметила, что по-прежнему инвестирует в экосистему Linux, активно поддерживая различные проекты и дистрибутивы Linux с открытым исходным кодом и внося свой вклад в их оптимизацию для аппаратного обеспечения. Clear Linux был известен глубокой оптимизацией для x86-64, причём в производительности от этого выигрывали не только платформы Intel, но и AMD. Тем не менее, дистрибутив оставался достаточно нишевым.

 Источник изображения: clearlinux.org

Источник изображения: clearlinux.org

Как сообщил ранее ресурс Phoronix, в этом месяце Intel покинул Кирилл Шутемов (Kirill Shutemov) после 14 лет работы в компании, который внёс значительный вклад в развитие основных компонентов Intel для ядра Linux. Сообщается, что в последнее время Шутемов работал над аспектами управления памятью в ядре, а также принимал участие в реализации TDX в Intel.

Согласно данным Phoronix, последний раунд увольнений Intel сильнее повлиял на разработку ПО, чем некоторые из предыдущих. В этот раз компанию покинули сразу несколько разработчиков Linux.

Постоянный URL: http://servernews.ru/1126231
15.07.2025 [18:18], Сергей Карасёв

В SelectOS появились функции автоматической установки на выделенных серверах и запуска через облако

Selectel сообщила о выпуске обновлённой версии платформы SelectOS — серверной операционной системы корпоративного класса на базе Debian. Реализованные улучшения призваны снизить нагрузку на IT-специалистов при обеспечении высокого уровня безопасности и оптимизации затрат.

В перечень ключевых нововведений вошли возможность автоматической установки на выделенных серверах и поддержка запуска через облако. Для SelectOS заявлена совместимость более чем с 500 конфигурациями аппаратного обеспечения, тестирование которых осуществляется в лаборатории Selectel.

Говорится о расширении репозитория приложений, адаптированных под технологию DPDK. Изменения положительно отразятся на работе потоковых сервисов, для которых важны стабильность передачи данных и эффективная обработка больших потоков информации. В частности, как утверждает Selectel, расходы на передачу данных могут быть уменьшены в три раза при одновременном повышении эффективности использования одного ядра CPU до 120 %. В результате, операторы стриминговых платформ смогут обслуживать больше пользователей без необходимости наращивания серверных мощностей и без потери качества трансляций.

 Источник изображения: Selectel

Источник изображения: Selectel

«Мы развиваем SelectOS как специализированное решение для серверных задач, предлагая клиентам не набор разрозненных инструментов, а готовую оптимизированную платформу. Наша цель — не просто предложить альтернативу иностранному ПО, а создать систему, которая эффективно решает задачи бизнеса», — говорит продуктовый менеджер SelectOS.

Отмечается, что с момента коммерческого запуска SelectOS в середине ноября 2024 года платформа была развёрнута более 2000 раз (подразумевается установка дистрибутива и запрос базовых пакетов из репозитория, без которых ОС не заработает). Количество полноценных установок ОС ежемесячно увеличивается примерно на 30 %. Selectel предлагает клиентам различные уровни экспертной и технической поддержки с возможностью выделения собственного специалиста для решения поставленных заказчиком задач.

Постоянный URL: http://servernews.ru/1126002
14.07.2025 [13:06], Сергей Карасёв

iBase выпустила плату MBB1005 на основе Intel Core Ultra 200S для периферийных систем

Компания iBase Technology пополнила ассортимент материнских плат моделью MBB1005, которая предназначена для создания промышленных систем — платформ мониторинга и автоматизации, устройств для периферийных вычислений и пр. Основой служит процессор Intel Core Ultra 200S поколения Arrow Lake-S.

Новинка выполнена в форм-факторе ATX с габаритами 305 × 244 мм. Применён набор логики Q870: допускается установка чипа в исполнении LGA1851. Доступны четыре слота U-DIMM для модулей оперативной памяти DDR5-5600 суммарным объёмом до 192 Гбайт. Накопители могут быть подключены к четырём портам SATA-3.

Плата располагает одним слотом PCIe 5.0 x16, двумя разъёмами PCIe 4.0 x4, одним слотом PCIe 4.0 x1 и двумя классическими разъёмами PCI. Есть два коннектора M.2 M-Key 2280 для SSD (PCIe x4; NVMe), слот M.2 B-Key 3052 (USB 3.2 + PCIe x1) для сотового модема и коннектор M.2 E-Key 2230 (USB 2.0 + PCIe x1) для адаптера Wi-Fi / Bluetooth. В оснащение входят сетевые контроллеры Intel I226LM (iAMT) и Intel I226V стандарта 2.5GbE с гнёздами RJ45 для сетевых кабелей, а также звуковой кодек Realtek ALC888S формата 5.1 и I/O-чип Fintek F81964D-I.

 Источник изображения: iBase

Источник изображения: iBase

Возможен вывод изображения одновременно на несколько мониторов через интерфейс HDMI 2.0b и три разъёма DisplayPort 1.4a (DP++). Реализованы четыре последовательных порта в конфигурации 2 × RS232/422/485 и 2 × RS232 (два могут быть задействованы через коннекторы на плате), пять портов USB 3.2 Gen2 (один через разъём на плате), по два интерфейса USB 3.0 и USB 2.0 (через коннекторы на плате), набор аудиогнёзд на 3,5 мм. Упомянут модуль dTPM 2.0. Диапазон рабочих температур простирается от 0 до +60 °C.

Постоянный URL: http://servernews.ru/1125914
13.07.2025 [10:57], Сергей Карасёв

CoreWeave запустила первые общедоступные инстансы на базе NVIDIA RTX Pro 6000 Blackwell Server Edition

Оператор ИИ-облака CoreWeave объявил о запуске инстансов с ускорителями NVIDIA RTX Pro 6000 Blackwell Server Edition для генеративных приложений, рендеринга в реальном времени и работы с большими языковыми моделями (LLM). Утверждается, что это первые общедоступные облачные экземпляры, построенные на базе названных GPU.

Изделия RTX Pro 6000 Blackwell Server Edition на архитектуре Blackwell насчитывают 24 064 ядра CUDA, 752 тензорных ядра пятого поколения и 188 ядер RT четвёртого поколения. В оснащение входят 96 Гбайт памяти GDDR7 с пропускной способностью до 1,6 Тбайт/с.

CoreWeave заявляет, что по сравнению с инстансами на основе NVIDIA L40S новые экземпляры обеспечивают 5,6-кратное повышение производительности при LLM-инференсе, 3,5-кратное увеличение быстродействия на операциях преобразования текста в видео и более чем 2-кратное повышение скорости тонкой настройки ИИ-моделей. Заявленная ИИ-производительность в режиме FP4 достигает 3,8 Пфлопс.

 Источник изображения: CoreWeave / NVIDIA

Источник изображения: CoreWeave / NVIDIA

Инстансы CoreWeave с ускорителями NVIDIA RTX Pro 6000 Blackwell Server Edition доступны в конфигурациях, насчитывающих до восьми GPU. Задействованы два процессора Intel Xeon поколения Emerald Rapids, а также DPU NVIDIA BlueField-3. Экземпляры предоставляют свыше 7 Тбайт пространства для хранения данных на основе NVMe SSD.

Говорится о поддержке служб CoreWeave Observability Services, которые отвечают за детальный мониторинг использования ресурсов, а также предоставляют данные о системных ошибках, температуре и пр. Это помогает быстро обнаруживать и устранять проблемы, минимизируя сбои в рабочих процессах. Новые инстансы доступны посредством CoreWeave Kubernetes Service (CKS) и Slurm on Kubernetes (SUNK) в американском регионе CoreWeave US-EAST-04.

Постоянный URL: http://servernews.ru/1125885
08.07.2025 [17:41], Андрей Крупин

Российская «Ред ОС» 8 портирована на одноплатный компьютер Orange Pi Zero 2W

Компания «Ред Софт» сообщила об успешном завершении тестирования операционной системы «Ред ОС» 8 на одноплатном компьютере Orange Pi Zero 2W. Соответствующая сборка программной платформы и инструкции по её установке доступны для скачивания на сайте разработчика.

Orange Pi Zero 2W был представлен командой Orange Pi в сентябре 2023 года. Устройство комплектуется процессором Allwinner H618 с квартетом ядер Arm Cortex-A53 и тактовой частотой 1,5 ГГц. Объём оперативной памяти стандарта LPDDR4 может составлять 1, 1,5, 2 или 4 Гбайт. Графический блок выполнен на контроллере Arm Mali-G31 MP2, также имеется VPU-узел. Предусмотрен разъём Micro HDMI 2.0 для вывода изображения.

В оснащение компьютера входят адаптеры Wi-Fi 5 и Bluetooth 5.0, два порта USB 2.0 Type-C, слот для карты microSD, 40-контактная колодка GPIO, совместимая с Raspberry Pi (I2C, SPI, UART, PWM), а также 24-контактный интерфейсный разъём. Питание подаётся через один из портов USB 2.0 Type-C (5 В / 2 А). Габариты устройства составляют 65 × 30 × 1,2 мм.

 Orange Pi Zero 2W (источник изображения: orangepi.org)

Orange Pi Zero 2W (источник изображения: orangepi.org)

По заверениям компании «Ред Софт», использование Orange Pi Zero 2W с «Ред ОС» 8 открывает широкие возможности для реализации разнообразных проектов, в том числе решений в сфере робототехники, умного дома, мультимедийных систем и многого другого.

Постоянный URL: http://servernews.ru/1125611
08.07.2025 [14:55], Руслан Авдеев

Groq запустила свой первый европейский ЦОД в Хельсинки

Компания Groq, предлагающая сервисы ИИ-инференса, объявила о расширении своей сети дата-центров, открыв свой первый в Европе ЦОД в Хельсинки (Финляндия). Это поможет удовлетворить растущие потребности европейских клиентов, сообщает пресс-служба компании.

Как заявил глава Groq Джонатан Росс (Jonathan Ross), спрос на ИИ-инференс растёт всё быстрее, а европейский дата-центр позволит местным клиентам получить минимальную задержку и готовую инфраструктуру для инференса уже сегодня. Кроме того, данные хранятся на территории Европы. Новый объект создан в Хельсинки на площадке Equinix. Партнёрство Equinix и Groq позволяет клиентам Equinix Fabric организовать инференс на платформе GroqCloud. Новые и действующие пользователи в США и EMEA получат доступ к мощностям для инференса через инфраструктуру Equinix Fabric — публичную, частную или суверенную.

В Equinix подчеркнули, что Скандинавия — отличное место для ИИ-инфраструктуры. Благодаря политике поддержки экоустойчивой энергетики, возможности использования фрикулинга для охлаждения и надёжности электросети Финляндия стала приоритетным выбором для размещения новых мощностей.

 Источник изображения: Groq

Источник изображения: Groq

Европейские государственные и негосударственные структуры рассчитывают получить полный контроль над развёртываемой инфраструктурой, в местах, которые выбирают они сами — они пытаются сохранить баланс между потребностью в обеспечении суверенитета данных и защиты их конфиденциальности и обеспечением мобильности этих данных. Благодаря новому проекту клиенты могут получать доступ к GroqCloud через частные подключения.

Экспансия в Европе расширяет мощности Groq на площадках Equinix и DataBank в США, Bell Canada в Канаде и HUMAIN в Саудовской Аравии. Они уже генерируют более 20 млн токенов в секунду по всей сети Groq. В некоторой степени это отражает спрос на ИИ-ускорители Groq LPU (Language Processing Unit).

Чуть более года назад Groq объявила, что больше не продаёт свои ИИ-ускорители, предлагая вместо этого совместно создавать ЦОД и облачные сервисы. Как заявляют в Groq, компания обеспечивает самую низкую стоимость за токен без ущерба качеству, что делает масштабное использование ИИ экономически выгодным как для ИИ-стартапов, так и для крупных корпораций по всему миру.

Постоянный URL: http://servernews.ru/1125581