Материалы по тегу: облако

04.09.2026 [23:16], Владимир Мироненко

Crusoe заключила крупнейшую за свою историю облачную сделку с Jane Street — $13 млрд за 5 лет

Crusoe, американский провайдер ИИ-инфраструктуры, заключил сделку с фирмой Jane Street, занимающейся проп-трейдингом, в рамках которой последняя выплатит около $13 млрд в течение пяти лет, сообщил Bloomberg со ссылкой на информированные источники. Согласно условиям сделки, Crusoe предоставит Jane Street кластеры передовых ИИ-чипов, и другую инфраструктуру, необходимую для обучения и инференса ИИ-моделей с использованием облачной платформы Crusoe.

Ранее Jane Street заключила облачный контракт на $6 млрд с CoreWeave и вложила $1 млрд в акционерный капитал компании, в результате чего её инвестиции в двух облачных провайдеров достигли примерно $19 млрд, отметил Bloomberg. Ресурс также отметил, что это будет крупнейший облачный контракт, подписанный Crusoe на сегодняшний день. Ранее компания заключала крупные сделки по предоставлению мощностей с Oracle, Microsoft и Meta, но те соглашения касались физических площадей в ЦОД, а не собственной облачной платформы Crusoe.

 Источник изображения: Crusoe

Источник изображения: Crusoe

Где именно будут размещены вычислительные мощности, пока не уточняется. У Crusoe есть действующие или находящиеся в стадии разработки ЦОД по всей территории США, в Техасене один) и Вайоминге (но он, вероятно, перейдёт к Google), а также проекты в Миссури (для Meta) и Вирджинии. Компания также арендует мощности в ЦОД сторонних компаний для своей облачной платформы. Согласно веб-сайту Crusoe, компания располагает 1,26 млн м2 площади ЦОД общей мощностью 4,9 ГВт. Неясно, какая часть этих мощностей уже эксплуатируется, пишет DataCenter Dynamics.

Bloomberg сообщал на прошлой неделе, что Crusoe ищет кредит под залог чипов, обеспеченный контрактами с Jane Street, то есть до объявления сделки. Такая схема стала стандартной для ИИ-рынка. Контрактная выручка используется в качестве залога по долгу, который используется для покупки оборудования для обслуживания контракта, и вся структура работает до тех пор, пока клиент продолжает платить. По словам источника, знакомого с ситуацией, эта сделка помогла привлечь больше внимания к последнему раунду финансирования Crusoe. Crusoe обсуждала ранее привлечение инвестиций в размере около $3 млрд при оценке рыночной стоимости примерно в $30 млрд.

Квант-трейдинг, используемый Jane Street, всегда требовал больших вычислительных мощностей. Модели ценообразования, системы управления рисками и анализ сигналов работают на том же оборудовании, что и языковые модели, и компания масштаба Jane Street скорее предпочтёт зарезервировать мощности, чем участвовать в тендере, отметил ресурс TNW. Jane Street также инвестирует в цепочку поставок. Она возглавила раунд финансирования в размере $700 млн в разработчика ИИ-ускорителй Etched при оценке в $21 млрд, а также вложилась в MatX, что представляет собой совершенно иную стратегию, чем аренда серверов.

 Источник изображения: Crusoe

Источник изображения: Crusoe

Как пишет TNW, Crusoe находится в новой, переполненной категории. Она конкурирует с CoreWeave, Lambda, Nscale, Nebius и другими неооблаками — все они продают одно и то же обещание более быстрой поставки вычислительных мощностей, чем это может сделать более крупный провайдер. При этом Crusoe, в отличие от других игроков, довольно долго в большей степени фокусировалась на предоставлении физической инфраструктуры для других заказчиков. С CoreWeave у Jane Street тоже есть облачное соглашение на $6 млрд.

Финансовые детали сделки также весьма скудны. Цифра приблизительная, получена от знакомых с ситуацией людей, а не от какой-либо из компаний, и ни Crusoe, ни Jane Street не подтвердили её публично. Вместе с тем сделка подтверждает, что в борьбе за чипы изменился расклад сил. Когда торговая фирма может выделить $13 млрд на вычислительные мощности без необходимости продавать сторонним заказчикам ИИ-модели, спрос со стороны ИИ-компаний перестает быть сдерживающим фактором для развития ИИ-инфраструктуры.

Постоянный URL: http://servernews.ru/1148012
04.09.2026 [18:44], Руслан Авдеев

Equinix представила решения Fabric One и Inference Exchange для распределённого ИИ-инференса в системах NVIDIA и Together AI

Компания Equinix расширяет платформу ЦОД и межсетевого взаимодействия, добавив взаимодополняющие сервисы, обеспечивающие распределённую эксплуатацию вычислительных ресурсов. Equinix Fabric One обеспечивает подключение между корпоративными площадками, облаками и ИИ-провайдерами, а Equinix Inference Exchange позволяет объединить эталонные решения NVIDIA Enterprise Reference Architectures с открытой платформой для инференса компании Together AI в пределах экосистемы Equinix.

Сервисы позволят решить распространённую проблему архитектуры данных, когда корпоративная информация, приложения и пользователи распределены по разным объектам, облакам и юрисдикциям с отдельными правовыми нормами, а обслуживающие эти ресурсы вычислительные системы отделены от них и работают в других локациях. Equinix рассчитывает превратить распределение рабочих нагрузок и управление подключениями в единый управляемый сервис вместо того, чтобы реализовать сетевые подключения в рамках отдельных ИИ-проектов.

Fabric One позволит клиентам описывать необходимый результат подключений на естественном языке. Equinix будет самостоятельно определять и организовывать маршрутизацию, облачные подключения, шифрование, управлять отказоустойчивостью и переключением на резервные ресурсы.

 Источник изображения: Equinix

Источник изображения: Equinix

Основными партнёрами по интеграции выступят AWS и Google Cloud, Fabric One будет использовать открытые спецификации OpenAPI 3.0 Interconnect, разработанные в рамках программ AWS и Google по организации мультиоблачных сетей, к которым присоединились Microsoft Azure и OCI. Приложения и инфраструктурные агенты смогут программно запрашивать необходимые соединения вместо того, чтобы полагаться на ручную координацию кросс-соединений и ручное предоставление сетевых ресурсов.

Inference Exchange представляет собой распределённую платформу для ИИ-инференса. Equinix будет поставлять объекты, электроэнергию, передовые системы охлаждения, обеспечит эксплуатацию инфраструктуры после ввода в эксплуатацию и подключение через Equinix Fabric.

NVIDIA обеспечит развёртывание с помощью проверенных эталонных архитектур Enterprise Reference Architectures, а Together AI обеспечит платформу для инференса с более 200 open source ИИ-моделей. Платформа будет поддерживать общие многопользовательские проекты и выделенные среды для отдельных клиентов, которым требуются гарантированные объёмы ресурсов и высокий уровень «изоляции» данных.

 Источник изображения: Equinix

Источник изображения: Equinix

По данным Storage Review, платформа Inference Exchange ориентирована на три ключевых топологии развёртывания. Во-первых, для инференса на уровне городских периферийных узлов организации способны запускать модели в рамках агломераций, с быстрым откликом API-обращений к открытым базовым моделям. Во-вторых, её можно использовать для перехода от закрытых проприетарных API на модели с открытым исходным кодом. Наконец, для обеспечения суверенного ИИ и выполнения нормативных требований локальных регуляторов — компании из регулируемых сфер могут обеспечить инференс и обработку данных в пределах заданных географических границ.

Предполагается, что бета-тестирование Fabric One начнётся до конца 2026 года, а полная доступность сервиса запланирована на 2027 год, сначала в Северной Америке. Inference Exchange будет доступен в I квартале 2027 года. Стратегическим преимуществом Equinix является инфраструктура компании и плотность сосредоточенной вокруг неё экосистемы. На конец 2025 года она управляла 280 ЦОД на 77 рынках 36 стран. Платформа объединяет более 10,5 тыс. компаний, около 3 тыс. поставщиков облачных и IT-сервисов, а также более 500 тыс. физических и виртуальных интерконнектов.

Объекты совредоточены в мегаполисах и городских агломерациях, где пересекаются телеком-операторы, облачные провайдеры, корпорации, платформы с контентом и и финансовые площадки. Для распределённого инференса близость всех игроков может быть важнее масштаба вычислительных ресурсов, поскольку часто корпоративные данные невозможно переместить в удалённый регион из-за требований к задержке, стоимости, управлению, безопасности, юрисдикции и т. п.

Fabric One и Inference Exchange координируют два уровня физической инфраструктуры Equinix — на одном находятся объекты International Business Exchange (IBX), предназначенные для разных клиентов, на другом — дата-центры xScale для крупных заказчиков, в том числе гиперскейлеров. Fabric One координирует подключения между разными инфраструктурными доменами, а Inference Exchange позволяет размещать и эксплуатировать мощности для инференса ближе к локациям, где корпоративный спрос максимален. Впрочем, это не сделает инфраструктуру Equinix однородной, поскольку, например, некоторые IBX могут быть ограничены по своим проектным техническим характеристикам. Новые объекты IBX проектируются с расширенными возможностями в контексте электропитания и охлаждения.

Постоянный URL: http://servernews.ru/1147974
04.09.2026 [09:58], Руслан Авдеев

Саудовскую Аравию превращают в крупный ИИ-хаб

В Саудовской Аравии активно формируется инфраструктура для ИИ и облачных вычислений. Одним из инициаторов трансформация выступает местная, поддерживаемая государством Humain, принадлежащая саудовской структуре Public Investment Fund (PIF).

Одним из ключевых элементов инфраструктуры станет облачный регион AWS в Саудовской Аравии, создание которого анонсировали ещё в марте 2024 года. Предполагаемые инвестиции — $5,3 млрд. Регион будет включать три зоны доступности обеспечит локальный доступ к AWS с учётом требований к размещению данных в стране и минимальным задержкам. Регион должен уже в декабре 2026 года. Параллельно AWS при участии Humain развивает т. н. AI Zone в Эр-Рияде (Ryadh). О намерении создать её говорили в мае 2025 года, речь шла приблизительно об $5 млрд инвестиций. В ноябре того же года AWS и Humain объявили, что зона должна получить порядка 150 тыс. ИИ-ускорителей, в т.ч. NVIDIA GB300 и AWS Trainium.

Названы и конкретные сроки. Первые 50 МВт AI Zone намерены ввести в эксплуатацию к 2028 году. Проект рассматривается AWS как инфраструктура для обучения и эксплуатации ИИ-моделей на разных типах ускорителей. Впрочем, Humain тоже не ограничивается одним проектом и совместно с американской Together AI объявила о решении создать ещё один ИИ ЦОД на 250 МВт для обучения ИИ и инференса. Humain будет предоставлять физическую инфраструктуру, а Together AI — облачную платформу AI Native Cloud, экосистему для разработчиков и др. Проект предусматривает предоставление мощностей как саудовским, так и зарубежным клиентам.

 Источник изображения: Mishaal Zahed (Meschael Zahède)/unsplash.com

Источник изображения: Mishaal Zahed (Meschael Zahède)/unsplash.com

Именно это играет ключевую роль в стратегии Саудовской Аравии, поскольку та намерена превратить энергетические и инфраструктурные активы не в локальные ЦОД, а в экспортируемый вычислительный сервис. Потенциально партнёрство Humain и Together AI обеспечит более $5 млрд годовой выручки уже в первый год совместной работы. В инфраструктурных программах Humain также фигурируют AMD, Cisco, Qualcomm и другие техногиганты, что позволяет компании обеспечить себе более гибкие условия для технологических «манёвров» без привязки к одному типу ускорителей или одной архитектуре.

Дополнительно стало известно, что в начале сентября Nokia открыла в Саудовской Аравии свой первый исследовательский центр для разработки сетевых решений с применением ИИ. Он будет заниматься технологиями, обеспечивающими сетям автоматизированную конфигурацию, обнаружение и устранение неполадок, оптимизацию производительности и снижение энергопотребления. Nokia будет вести исследования и в других сферах, связанных с ИИ и сетевыми решениями для повышения эффективности инфраструктуры. Центр будет участвовать и в разработке связанных с ИИ технологий 6G и ПО, которые будут применяться далеко за пределами Саудовской Аравии. Одновременно будут готовиться местные специалисты.

 Источник изображения: Nojood Al Aqeel/unsplash.com

Источник изображения: Nojood Al Aqeel/unsplash.com

В целом инициативы компаний укладываются в общий саудовский проект Vision 2030, в рамках которого облачные вычисления и ИИ рассматриваются как возможность диверсифицировать экономику и в меньшей степени полагаться на нефтегазовую отрасль. При этом сохраняется проблема обеспечения безопасности региона. Развитие происходит на фоне затянувшегося конфликта с Ираном. Объекты AWS уже были атакованы в регионе — два в ОАЭ и один в Бахрейне. Последний удар по ЦОД в Бахрейне был зарегистрирован в конце июля, хотя тот уже и так не работал.

Опыт безусловно важен в контексте развития инфраструктуры в Саудовской Аравии. Страна фактически оказалась в парадоксальной ситуации. С одной стороны она стремительно наращивает энергетические и инфраструктурные возможности, с другой — находится в регионе, где соответствующая инфраструктура находится буквально под прямой угрозой. Иран грозил нанести удар по строящемуся ЦОД Stargate в ОАЭ.

Постоянный URL: http://servernews.ru/1147940
02.09.2026 [15:38], Андрей Крупин

Yandex B2B Tech запустила новый формат частных облаков BareMetal Extend

Yandex B2B Tech представила решение BareMetal Extend. Новый сервис позволяет бизнесу получить готовую IT-инфраструктуру на физическом оборудовании без необходимости закупки и обслуживания собственных дорогостоящих систем.

В отличие от классических частных облаков, где ресурсы заказчика логически изолированы в рамках общего публичного пула, архитектура BareMetal Extend предполагает физическое разделение инфраструктуры клиента. Это обеспечивает компаниям максимальный контроль над данными при сохранении гибкости облачных технологий.

В составе Yandex BareMetal Extend представлены три преднастроенных модуля: Virtualization, Managed Service for Kubernetes и Yandex Cloud Stackland. Первый компонент разработан в партнёрстве с K2Cloud, которая отвечает за установку и настройку системы виртуализации на выделенных серверах, а также за техническое сопровождение в этой части. Второй модуль предоставляет готовую Kubernetes-инфраструктуру, третий — on-premise-платформу контейнеризации с интегрированными PaaS-сервисами Yandex Cloud. Выбор конкретного стека зависит от задач бизнеса: от запуска критичных бизнес-систем до создания сред для разработки ПО.

 Как устроен Yandex BareMetal Extend (источник изображения: yandex.cloud)

Как устроен Yandex BareMetal Extend (источник изображения: yandex.cloud)

Платформа Yandex BareMetal Extend ориентирована на организации, которые хотят получить максимально управляемую инфраструктуру, но не могут мигрировать в публичное облако из-за внутренних политик информационной безопасности. Решение соответствует первому уровню защищённости персональных данных и обеспечивает защиту на уровнях ЦОД, сети и сервиса. Систему можно безопасно подключать к облачным или локальным ресурсам с использованием приватного соединения Cloud Interconnect.

Постоянный URL: http://servernews.ru/1147849
02.09.2026 [14:30], Руслан Авдеев

Microsoft и Amazon представили 100-Гбит/с «мост» для простой связи Azure и AWS

Microsoft анонсировала сервис частного прямого подключения облаков Azure и AWS, что позволит упростить клиентам использование сразу нескольких облаков, сообщает The Register, хотя ранее оба провайдера уверяли, что никаких проблем не было раньше. Однако ещё в прошлом году AWS и Google Cloud разработали открытые спецификации для объединения своих сетей. Они же лежат и в основе предлагаемого Microsoft и AWS решения.

В Microsoft заявляют, что взаимодействуют с AWS, работая над решением, которое объединяет сервисы Azure Multicloud Interconnect с AWS Interconnect-multicloud. Ранее к последнему сервису присоединилась OCI. Мультиоблачное решение позволяет клиентам создавать частные, высокоскоростные каналы связи между инфраструктурами двух платформ. Совсем недавно для объединения сред Azure и AWS требовалось тщательно координировать физическое сетевое соединение, маршрутизацию, выделение ресурсов, мониторинг и управление инфраструктурой. В результате на поиск решения, которое в теории должно было быть довольно простым, по данным Microsoft, уходили недели или месяцы.

 Источник изображения: Jesper Christiansen/unsplash.com

Источник изображения: Jesper Christiansen/unsplash.com

Впрочем, AWS заявляла британскому регулятору, что никаких существенных технических барьеров для мультиоблачной стратегии клиентов нет, и те могут использовать несколько облаков и переходить между облачными провайдерами, «когда захотят». В Microsoft и вовсе говорили, что клиенты мало заинтересованы в мультиоблачной модели, за исключением специализированных случаев — поскольку работать в мультиоблачных средах «непросто и неудобно».

Теперь Microsoft заявляет, что Azure Multicloud Interconnect в корне меняет ситуацию, давая клиентам доступен и быстрый способ развёртывания облачных архитектур со 100-Гбит/с каналами с первого дня. При этом возможно увеличение пропускной способности и далее, а открытая спецификация API позволит улучшить совместимость между облачными провайдерами гиперскейл-уровня. Azure Multicloud Interconnect находится в режиме предварительного тестирования, поэтому Microsoft предупреждает, что доступность функций, производительность и сроки внедрения могут измениться по мере приближения коммерческого запуска сервиса.

В октябре 2025 года в AWS произошел крупный сбой, который вывел из строя ряд сервисов, включая Fortnite, Alexa и Snapchat. Позже сбои наблюдались и в Microsoft Azure, и в Cloudflare, что вызвало опасения, связанные с использованием лишь нескольких крупных поставщиков интернет-инфраструктуры. Ранее AWS, Google Cloud и Microsoft Azure уже сделали шаг навстречу друг другу, отказавшись от платы за выгрузку данных при переезде в другое облако.

Постоянный URL: http://servernews.ru/1147842
02.09.2026 [14:16], Владимир Мироненко

AWS объявила о доступности инстансов EC2 R9g и R9gd на базе фирменных Arm-процессоров Graviton5

AWS сообщила о доступности инстансов EC2 R9g и R9gd на базе Arm-процессоров Graviton5. Инстансы R9g оптимизированы для работы с памятью и обеспечивают до 25 % более высокую вычислительную производительность по сравнению с R8g на базе Graviton4.

R9g предназначены для обработки ресурсоёмких рабочих нагрузок, включая базы данных, кеши in-memory (Valkey, Redis, MemCached), аналитику больших данных в реальном времени, рабочие нагрузки на базе Linux, включая контейнеризированные и микросервисные приложения (например, Kubernetes, Docker, EKS, ECS), а также приложения, созданные с использованием C/C++, Rust, Go, Java, Python, .NET Core, Node.js, Ruby и PHP.

 Источник изображений: Amazon

Источник изображений: Amazon

Инстансы R9gd включают локальное блочное хранилище на основе NVMe SSD, подходящее для ресурсоёмких рабочих нагрузок, требующих быстрого локального хранилища с низкой задержкой, таких как СУБД, распределённая аналитика больших данных в реальном времени, большие in-memory базы данных и большие нагрузки по кешированию.

Благодаря использованию процессоров Graviton5 инстансы R9g обеспечивают на 25 % выше производительность на vCPU по сравнению с R8g. Также используется память DDR5-8800 (по сравнению с DDR5-5600 в Graviton4), а L3-кеш у CPU впятеро больше для лучшей локализации данных. R9g обеспечивают вдвое более высокую пропускную способность сети и EBS для самых больших размеров экземпляров (до 100 Гбит/с сети, до 72 Гбит/с EBS на 48xlarge) и втрое более высокую производительность обработки пакетов.

Инстансы R9g и R9gd поддерживают настройку пропускной способности инстанса Instance Bandwidth Configurations (IBC), которая позволяет скорректировать распределение полосы между EBS и VPC на 25%. Это помогает оптимизировать производительность для рабочих нагрузок со специфическими требованиями к пропускной способности, таких как базы данных и кеширование. Инстансы используют систему AWS Nitro. При этом инстансы R9g и R9gd оснащены механизмом изоляции Nitro (NIE), который использует формальную верификацию для обеспечения математической точности гарантий изоляции.

Инстансы R9g и R9gd доступны в 11 размерах, от среднего до metal-48xl, с количеством vCPU в пределах от 1 до 192, объёмом оперативной памяти — 8–1536 ГиБ. Пропускная способность сетевого подключения составляет от 15 до 100 Гбит/с, пропускная способность томов EBS — от 12 до 72 Гбит/с. Экземпляры R9gd обеспечивают ту же вычислительную и сетевую производительность, что и R9g, но дополнительно оснащены локальными NVMe SSD — до трёх штук по 3,8 Тбайт каждый

Amazon EC2 R9g и R9gd доступны в регионах US East (Северная Вирджиния, Огайо), US West (Орегон) и Europe (Франкфурт) в рамках тарифных планов Savings Plans, On-Demand, Spot Instances, Dedicated Instances или Dedicated Hosts. Ранее компания также объявила о доступности семейств C9g и C9gd, рассчитанных на вычисления, и инстансов общего назначения M9g и M9gd.

Постоянный URL: http://servernews.ru/1147823
01.09.2026 [16:30], Владимир Мироненко

Selectel усиливает ИИ-платформу новой функциональностью в кaталоге ИИ-моделей

Selectel, крупнейший независимый провайдер ИT-инфраструктуры в России, обновил каталог ИИ-моделей (Foundation Models Catalog) для работы с большими языковыми моделями. Обновления усиливают возможности платформы для корпоративных заказчиков: компания обеспечила приватный доступ к моделям, пополнила каталог продвинутыми генеративными моделями, а также расширила возможности для построения геораспределённых систем за счёт добавления нового региона ru-6. Эти изменения позволят бизнесу быстрее запускать ИИ-решения, снижать операционные расходы и соблюдать стандарты информационной безопасности при работе с чувствительными данными.

Каталог ИИ-моделей входит в состав ИИ-платформы Selectel — экосистемы сервисов для обучения и запуска генеративных моделей, которая помогает компаниям ускорить интеграцию ИИ-решений. Это даёт бизнесу возможность использовать большие языковые модели, инструменты агентской разработки и другие ИИ-технологии без необходимости самостоятельной настройки ИТ-инфраструктуры, существенно снижая технические барьеры на пути к внедрению инноваций.

 Источник изображения: Selectel

Источник изображения: Selectel

Теперь сервис стал доступен в новом отказоустойчивом регионе на базе трёх независимых зон доступности. Клиенты могут развернуть два одинаковых инференс-сервиса в разных зонах доступности и строить мультирегиональные схемы, снижая риски простоя за счёт геораспределённости инфраструктуры.

При создании инференс-сервиса теперь можно выбрать тип доступа: публичный (через интернет) или приватный (доступ только внутри приватной сети пользователя, без выхода трафика в интернет). Компании смогут построить приватный канал между собственной инфраструктурой и дата-центрами Selectel через услугу Direct Connect и направлять запросы к каталогу ИИ-моделей через него. Это позволит бизнесу с повышенными требованиями к безопасности работать с моделями в изолированном контуре, что особенно актуально для финансовых, медицинских и государственных организаций, обрабатывающих чувствительные данные.

Каталог пополнился новыми моделями в квантизации NVFP4, которая повышает производительность при незначительном снижении точности. Технология оптимизирована под GPU поколения Blackwell, что позволяет запускать ресурсоёмкие модели на компактных конфигурациях. Стали доступны модели семейства Queen с максимальным размером контекста — 262 000 токенов, что позволяет работать с большими документами и долгими агентскими сценариями с сохранением высокой точности. В ближайшее время появятся и другие популярные модели в квантизациях FP8 и NVFP4, оптимизированные под GPU, которые доступны в новом регионе ru-6.

Постоянный URL: http://servernews.ru/1147728
01.09.2026 [16:00], Владимир Мироненко

Broadcom представила частное ИИ-облако VMware AI Factory, позаимствовав у NVIDIA термин для партнёрства с AMD

Компания Broadcom представила решение VMware AI Factory в качестве программно-определяемой основы для VMware Private AI Cloud, предлагающей клиентам более простой путь к внедрению ИИ благодаря инновациям в автоматизации развёртывания готовой к ИИ инфраструктуры, её сопровождении и поддержке. Как утверждает Broadcom, с помощью её ИИ-фабрики клиенты смогут ускорить развёртывание первой модели и лучше управлять токеномикой ИИ.

«Мы предоставляем клиентам программно-определяемую основу, которая автоматизирует развёртывание инфраструктуры, объединяет управление жизненным циклом и позволяет им выбирать предпочтительное оборудование и проверенные модели. В результате — ускорение развёртывания первой модели, предсказуемые затраты на частное облако и лучший контроль над токеномикой ИИ», — заявил главный директор по продуктам подразделения VMware Cloud Foundation.

VMware AI Factory предоставляет ИИ-приложения непосредственно к частным данным предприятия в защищённой среде частного облака. Благодаря возможностям автоматизации инфраструктуры VCF время от развёртывания на физическом сервере до запуска первой ИИ-модели сокращается с недель до нескольких часов. VMware AI Factory упрощает управление ИИ-инфраструктурой, полностью автоматизируя выделение оборудования, включение программного стека и управление жизненным циклом от начала до конца.

 Источник изображения: Broadcom

Источник изображения: Broadcom

VMware AI Factory построена на платформе VMware Cloud Foundation (VCF), которая объединяет и совместно использует ресурсы GPU в масштабах всей организации, позволяя командам запускать несколько моделей на общем оборудовании вместо выделения инфраструктуры для каждой рабочей нагрузки. Новые и готовящиеся к запуску частные ИИ-сервисы включают:

  • Многопользовательское совместное использование моделей: Model Runtime теперь поддерживает безопасное совместное использование ИИ-моделей через изолированные пространства имен.
  • Единое управление моделями в локальных и облачных средах через единый интерфейс потребления, обеспечивающее доступ к локально размещенным моделям с такими улучшениями, как интеллектуальная маршрутизация запросов, ограничение скорости использования токенов и авторизация приложений.
  • Безопасные песочницы и управление ИИ, гарантирующие, что агенты не будут превышать свои полномочия или получать доступ к запрещённым для них ресурсам.

VMware AI Factory поддерживает сертифицированные узлы VCF AI ReadyNodes от Cisco, Dell, Lenovo и Supermicro, а также других производителей. Broadcom также объявила о сотрудничестве с AMD для интеграции VCF с GPU AMD Instinct и программной экосистемой ROCm. Любопытно, что идею ИИ-фабрики (AI Factory) первой предложила NVIDIA в качестве эталонной архитектуры, описывающей всё оборудование и ПО, необходимые для выполнения ИИ-нагрузок. ИИ-фабрики NVIDIA основаны на собственном оборудовании и ПО, а также на серверах Dell, Lenovo, HPE и др., которые тоже называют свои продукты ИИ-фабриками.

Вице-президент по маркетингу продуктов в подразделении VCF компании Broadcom, сообщил изданию The Register, что VMware AI Factory — это «эволюция» VMware Private AI Foundation with NVIDIA, добавив, что NVIDIA является «нашим самым давним партнёром среди поставщиков GPU». Несмотря на давнее партнёрство, VMware позаимствовала название продукта NVIDIA для конкурирующего предложения, продвигающего её главного соперника AMD. Впрочем, VMware сообщила, что не исключает возможность создания AI Factory for NVIDIA.

Постоянный URL: http://servernews.ru/1147771
01.09.2026 [14:15], Руслан Авдеев

Alibaba Cloud запустила свой первый облачный регион в Бразилии — два новых ЦОД и агентные ИИ-сервисы для местных бизнесов

Облако Alibaba Cloud запустило свой первый регион в Бразилии. Он будет состоять из двух дата-центров, сообщает Datacenter Dynamics. Новый регион даст бизнесам, стартапам, разработчикам и государственным структурам доступ к портфолио облачных сервисов на основе местной инфраструктуры. Сервисы разработаны для критически важных задач, требующих низких задержек, надёжности, возможности управления данными и др. Также компания рассчитывает представить в регионе агентные ИИ-сервисы корпоративного уровня.

Это первый региона Alibaba Cloud в Южной Америке, кроме того, компания в целом расширяет присутствие в западном полушарии, поскольку в феврале 2025 года уже запустила регион в Мексике. По словам Alibaba Cloud, Бразилия является одной из наиболее динамично развивающихся цифровых экономик мира и ключевым рынком для экспансии компании в регионе. Рост присутствия там поддержит развитие ИИ и облачных возможностей бразильских компаний, одновременно обеспечивается их связь с глобальной сетью ЦОД компании.

 Источник изображения: Vanessa Bumbeers/unsplash.com

Источник изображения: Vanessa Bumbeers/unsplash.com

Чтобы удовлетворить растущий спрос на ИИ, компания намерена запустить в Бразилии агентные корпоративные сервисы, включая ACS Agent Sandbox, DAS Agent, Data Agent for Analytics, Meta Agent, DataWorks Data Agent, STAROps, NAPal, Agent Security Center, AI Security Guardrails 2.0 и Agentic SOC. Решения предназначены для разработки и защиты ИИ-агентов, а также управления ими в крупных масштабах.

Также Alibaba Cloud заключила соглашение об укреплении своей экосистемы в стране. Бразильский провайдер технологических решений Insi будет использовать облако Alibaba и портфолио сервисов компании для создания кастомизированных решений корпоративным клиентам. В компании уверены, что новый локальный регион позволит обеспечить модернизацию бизнеса с необходимой безопасностью, производительностью и надёжностью. А 4Linux, специализирующаяся на open source и IT-сервисах, обеспечит доступ к ИИ компаниям страны, комбинируя модели Qween самой Alibaba Cloud с собственной экспертизой в области внедрения и обучения ИИ.

Запуск в Бразилии стал новым этапом экспансии Alibaba Cloud в регионах, в частности, уже действующей локаций в Мексике, Франции, ОАЭ, Японии, Южной Корее и Малайзии. Теперь портфолио компании включает 106 зон доступности в 31 облачном регионе по всему миру. Alibaba Cloud в рамках глобального плана инвестиций в ИИ-инфраструктуру намерена потратить $53 млрд.

Постоянный URL: http://servernews.ru/1147761
31.08.2026 [17:36], Андрей Крупин

ИИ-направление принесло Cloud.ru более половины выручки в I полугодии 2026 года

Российский провайдер облачных сервисов Cloud.ru опубликовал финансовые результаты по МСФО за первые шесть месяцев 2026 года. Выручка компании достигла 37,6 млрд рублей (+2 % г/г), показатель EBITDA составил 27,5 млрд рублей (рентабельность снизилась до 73 %), чистая прибыль зафиксирована на уровне 6 млрд рублей (-21 % г/г), рентабельность — 16 %.

Главным драйвером роста стало направление технологий машинного обучения и искусственного интеллекта на базе нейронных сетей. Выручка от сервисов и инфраструктуры для работы с ИИ составила 19,3 млрд руб., или 51,3 % от общей выручки компании. За первые восемь месяцев 2026 года объём потребления языковых моделей на платформе вырос в 18 раз, достигнув отметки в 480 млрд токенов.

 Источник изображения: cloud.ru

Источник изображения: cloud.ru

В I полугодии 2026 года Cloud.ru инвестировал 8,5 млрд руб. в закупку оборудования, разработку ПО и другие нематериальные активы. Основными направлениями инвестиций стали IT-инфраструктура, информационная безопасность и новые технологии. В сфере безопасности компания развивает защищённые облачные платформы для размещения государственных информационных систем и объектов критической информационной инфраструктуры. В сфере ИИ провайдер делает акцент на развёртывании платформ и сервисов для практического применения интеллектуальных решений.

На данный момент инфраструктура Cloud.ru включает более 46 тыс. единиц IT-оборудования (в том числе свыше 32 тыс. серверов) в девяти дата-центрах общей мощностью 58 МВт.

Постоянный URL: http://servernews.ru/1147723

Входит в перечень общественных объединений и религиозных организаций, в отношении которых судом принято вступившее в законную силу решение о ликвидации или запрете деятельности по основаниям, предусмотренным Федеральным законом от 25.07.2002 № 114-ФЗ «О противодействии экстремистской деятельности»;