Материалы по тегу:
|
21.07.2026 [14:44], Руслан Авдеев
Z.AI построила гигантский ИИ ЦОД исключительно на китайских ускорителяхZ.AI (Zhipu) завершила строительство гигантского дата-центра в Китая, в котором предусмотрено использование только ИИ-чипов производства КНР. Это важный шаг в попытках Пекина заменить подсанкционные ускорители NVIDIA для безопасной разработки проектов в сфере ИИ, сообщает Bloomberg. Для борьбы с дефицитом вычислительных мощностей Китай готовится потратить около ¥2 трлн ($295 млрд) на строительство ЦОД по всей стране. Компания начала частично эксплуатировать 1-ГВт кампус, предназначенный для разработки её ИИ-моделей GLM (General Language Model). У Z.AI уже есть несколько ИИ-кластеров, использующих более 10 тыс. чипов. Новый ЦОД станет одним из крупнейших серверных хабов, построенных Z.AI. Компания жёстко конкурирует с пекинским стартапом Moonshot, на днях выступившим с ИИ-моделью Kimi K3, и Alibaba, также выпустившей на днях новую модель семейства Qwen — обе новинки способны бросить вызов передовым моделям OpenAI и Anthropic
Источник изображения: Shivendu Shukla/unsplash.com Zhipu (Z.AI) совсем недавно привлекла миллиарды долларов благодаря IPO в Гонконге и продаже акций. Компания добивается ежегодной регулярной выручки (ARR) в объёме $1 млрд — после того, как в июне добилась выполнения планов продаж на 2026 год. Создание нового дата-центра — важная веха для стартапа, пытающегося стать важным поставщиком ИИ-решений для компаний и корпораций.
21.07.2026 [13:14], Руслан Авдеев
Google создаёт ИИ-ускоритель Frozen v2, оптимизированный специально для GeminiКомпания Google работает над новым ИИ-ускорителем под неформальным названием Frozen v2, который позволит интегрировать элементы ИИ-модели Gemini непосредственно в «железо», что позволит эффективнее исполнять ИИ-нагрузки, сообщает The Information. Чип, как ожидается, поможет разрешить проблему нехватки вычислительных мощностей для ИИ, уже заставившую Google Cloud отказаться от сделок с клиентами. По имеющимся данным, Google намерена начать внедрение новых чипов в 2028 году, хотя работы над новой архитектурой продолжаются. Кроме того, пока неизвестно, какая часть модели будет «прошита» в аппаратной составляющей. Предполагается, что чипы могут быть в 6–10 раз эффективнее, чем новейшие TPU, в пересчёте на количество токенов на Вт. При этом новые чипы призваны дополнить TPU, а не заменить их. По словам представителя Google Cloud, команды компании постоянно занимаются исследованиями и экспериментируют с инновационными решениями. Проектируя аппаратное и программное обеспечения с нуля, компания обеспечивает интеграцию и высокую степень оптимизации систем. Как сообщает Silicon Angle, чипы, предлагаемые «по умолчанию», обычно включают компоненты, которые клиентам не нужны вовсе. Например, использование традиционных GPU для инференса делает ненужными блоки рендеринга. Разработка кастомных чипов помогает решить проблему. Компания может исключить ненужные модули, тем самым снижая цену производства, или же заменить ненужные элементы на модули, оптимизированные для специальных задач. Повышенная эффективность будет достигнута разными способами. В частности, в компании рассчитывают, что Froxen v2 позволит снизить количество вычислений для Gemini. Также ожидается снижение масштабов перемещения данных. Google может оснастить Frozen v2 достаточным количеством памяти для запуска Gemini полностью на чипе. Подобный дизайн избавил бы от необходимости отправлять данные к RAM и обратно.
21.07.2026 [12:24], Сергей Карасёв
Chelsio представила 400GbE-решения седьмого поколения для ИИ ЦОДКомпания Chelsio Communications анонсировала интерконнект седьмого поколения для дата-центров, систем хранения и инфраструктур, ориентированных на ИИ. В состав представленной платформы AI Interconnect Platform входят сетевые адаптеры SmartNIC, контроллеры хранения и процессоры обработки данных (DPU). В основу AI Interconnect Platform положена архитектура Chelsio Unified Wire: она обеспечивает поддержку стандарта 400GbE и технологии Unified RDMA, объединяющей несколько протоколов удалённого прямого доступа к памяти (iWARP и RoCEv2). Кроме того, задействованы средства ускорения работы систем хранения и оптимизации ИИ-инфраструктуры для облачных, корпоративных развёртываний и гиперскейлеров. Среди ключевых особенностей платформы названы встроенные криптографические модули для протоколов QUIC, kTLS и IPsec/TLS/kTLS, различные варианты исполнения (PCIe 5.0, OCP 3.0) и лучшие в отрасли показатели производительности в расчёте на ватт потребляемой энергии. Говорится о поддержке виртуализации SR-IOV (Single Root I/O Virtualization), виртуальной коммутации vSwitch и пр.
Источник изображений: Chelsio Communications В число анонсированных решений входят двух- и четырёхпортовые адаптеры S7250 / S7450 / S7450-OCP SmartNIC с поддержкой 1/10/25/50GbE. Эти изделия оптимизированы для виртуализации, встраиваемых систем и периферийных развёртываний. Кроме того, дебютировали решения S72200 / S72200-OCP SmartNIC с поддержкой 40/50/100/200GbE для масштабных облачных сред, HPC и ИИ-инфраструктур. Представлен также однопортовый адаптер S71400 SmartNIC класса 400GbE с возможностью работы в режимах 4 × 100GbE и 2 × 200GbE: устройство рассчитано на сверхмасштабные сетевые инфраструктуры. ![]() Кроме того, Chelsio выпустит контроллеры хранения T72200/T7450. Они предназначены для ускорения выполнения задач, связанных с обработкой данных. Обеспечивается аппаратная разгрузка для NVMe/TCP, NVMe-oF, iSCSI, RDMA и пр. Устройства будут предлагаться в форм-факторах PCIe и OCP. Все перечисленные изделия уже доступны для заказа. В декабре начнётся производство полностью программируемых карт T72200-DPU / T7450-DPU, которые сейчас доступны для ознакомления.
21.07.2026 [10:30], Сергей Карасёв
РТК-ЦОД запустил облачный мониторинг качества каналов связи для 20 тысяч объектов заказчиков «Ростелекома»РТК-ЦОД, ведущий ИТ-сервис-провайдер полного цикла, внедрил единую систему мониторинга для контроля качества каналов связи, предоставляемых «Ростелекомом» государственным заказчикам. Решение охватывает порядка 20 тысяч объектов, расположенных во всех регионах России. Система мониторинга построена на базе платформы Smart Control, разработанной в РТК-ЦОД. Платформа контроля качества телекоммуникационных услуг Smart Control развёрнута в облаке РТК-ЦОД, а на объектах связи заказчиков устанавливаются специальные метрологические зонды для измерения параметров каналов. В непрерывном режиме 24/7 решение анализирует состояние коммуникационных каналов по ключевым метрикам: сетевые задержки передачи данных и их вариации (джиттер), доля потерянных пакетов, пропускная способность каналов, соблюдение SLA. При этом система не оказывает влияния на стабильность и производительность основных сервисов заказчика. В случае обнаружения отклонений Smart Control автоматически инициирует регламентированные процедуры реагирования и передаёт информацию в техническую поддержку «Ростелекома». Это позволяет устранить деградацию качества канала связи до того, как она станет заметна пользователям. Все данные о состоянии каналов связи консолидированы в едином веб-интерфейсе. Таким образом, заказчик и оператор могут в реальном времени наблюдать за метриками качества. На сегодняшний день услугой мониторинга качества каналов связи РТК-ЦОД уже пользуются более 20 заказчиков «Ростелекома». Внедрение платформы Smart Control, разработанной РТК-ЦОД, обеспечило «Ростелекому» и его заказчикам возможность действовать в едином информационном пространстве, что кардинально повысило прозрачность и оперативность контроля. Благодаря работе системы мониторинга время реакции на инциденты сократилось в среднем в 6–8 раз. «Мониторинг качества каналов связи на базе Smart Control — это комплексная услуга с полным циклом сопровождения. Платформа изначально спроектирована как тиражируемое решение — мы можем подключать новых абонентов и масштабировать систему на дополнительные объекты без необходимости доработки архитектуры. Такой подход позволяет оперативно наращивать покрытие и сохранять единые стандарты качества для всех заказчиков», — заявил технический директор РТК-ЦОД Алексей Забродин. РТК-ЦОД развивает комплексное решение Smart Control с 2020 года, проект реализуется командой из более 30 разработчиков. Smart Control автоматизирует эксплуатацию ИТ-инфраструктуры и контролирует качество предоставления сетевых, вычислительных и облачных сервисов. Продукт полностью замещает функциональность решения BMC Patrol и IBM Tivoli. В состав платформы входят дополнительные модули: подсистема единого каталога пользователей «Smart Control. Домен», подсистема инвентаризации и управления «Smart Control. Инвентаризация и управление», подсистема управления идентификацией и доступом «Smart Control. IAM», а также модуль зонтичного мониторинга. Smart Control и все его модули входят в Реестр отечественного ПО.
20.07.2026 [21:41], Владимир Мироненко
Microsoft внедрит новейшую платформу AMD Helios AI в облако AzureAMD объявила о расширении стратегического партнёрства с Microsoft, охватывающего ускорители, процессоры, сетевое оборудование и ПО на платформе Azure. AMD начнёт поставки Helios клиентам, включая Microsoft, во II половине 2026 года, но именно Microsoft первой среди «большой тройки» облаков публично заявила о массовом развёртывании новой платформы. В рамках партнёрства Microsoft внедрит в ЦОД Azure платформу AMD Helios AI с EPYC Venice и MI455X. Эти решения будут лежать в основе трёх будущих семейств инстансов Azure: HDv2 для обработки данных, HXv2 для автоматизации проектирования электроники (EDA) и ND MI455X v7 для рабочих нагрузок ИИ-инференса. Инстансы HDv2, разработанные совместно с AMD, предназначены для самых ресурсоёмких задач, связанных с ИИ, включая подготовку данных, поиск, обучение с подкреплением и координацию агентов. Благодаря почти 500 физическим ядрам в составе AMD EPYC Venice, 4 Тбайт RAM, 32 Тбайт локального NVMe-хранилища и 400GbE DPU Azure Boost, HDv2 способны удовлетворить потребности самых требовательных клиентов в области ИИ, отметила Microsoft. Инстанcы HXv2 развивают сильные стороны виртуальных машин HX, запущенных в партнёрстве с AMD в 2023 году. HXv2 тоже предлагает дифференциацию для рабочих нагрузок моделирования на уровне RTL и тоже использует технологию 3D V-Cache, вместе с тем получив значительные улучшения в части производительности ядер и памяти в однопоточных задачах. ВМ HXv2 будут оснащены 176 ядрами процессоров EPYC Venice с тактовой частотой более 5 ГГц, наполовину большим кешем, доступному каждому ядре, и порядка 2 или 4 Тбайт RAM. При этом Azure HXv2 поддерживает более широкий спектр технических вычислительных задач, включая научное моделирование, инженерный анализ и другие приложения с распределённой памятью. Значительно повышенная производительность на ВМ и на ядро, а также наличие 800G-подключения InfiniBand, позволяют проводить крупномасштабные симуляции на основе MPI и делают HXv2 идеальным решением для широкого круга клиентов, использующих HPC, сообщила Microsoft. В свою очередь, инстансы ND MI455X v7 разработаны для ИИ-инференса в производственных масштабах — для рабочих нагрузок рассуждений, поиска и агентных вычислений, лежащих в основе современных ИИ-сервисов. Сотрудничество также распространяется на сетевой уровень. DPU Pensando уже активно используются Microsoft, а теперь компании интегрируют Azure Boost с технологиями AMD для повышения производительности сети, эффективности и обработки подключений в облачном масштабе. Сотрудничество расширяет доступ к ИИ-инфраструктуре AMD в Azure. Разработчики передовых моделей смогут использовать инфраструктуру на базе AMD для обучения и обслуживания крупномасштабных ИИ-моделей, а корпоративные клиенты могут развёртывать и масштабировать рабочие нагрузки ИИ в производственной среде с помощью управляемых вычислительных ресурсов Azure Foundry.
20.07.2026 [18:47], Владимир Мироненко
Nebius заложила свои GPU. чтобы купить ещё GPUПровайдер облачных ИИ-сервисов Nebius (ранее Yandex N.V.) объявил о заключении первого соглашения о предоставлении обеспеченного кредита на сумму около $775 млн с целью дальнейшего ускорения глобального развёртывания своей полнофункциональной облачной платформы для ИИ. Как пояснила компания, кредит обеспечен развёрнутой инфраструктурой на базе GPU и гарантированными денежными потоками по соглашению с клиентом инвестиционного уровня. Срок погашения кредита — 31 октября 2030 года, процентная ставка — SOFR + 2,50 %. По словам Nebius, вместе с денежными потоками от соглашения с клиентом кредит полностью покрывает более 100 % капитальных затрат, необходимых для развёртывания базовой инфраструктуры GPU. Nebius отметила, что поскольку контракт находится на стадии обслуживания, это финансирование можно направить на инвестиции в мощности, которые будут обслуживать клиентов в сфере ИИ, и корпоративных клиентов на полнофункциональной облачной ИИ-платформе Nebius. Похожую схему для получения кредита использовало неооблако CoreWeave, взявшее под залог имеющихся ускорителей NVIDIA заём на гораздо более крупную сумму в размере $2,3 млрд. Nebius, по всей видимости, планирует и дальше использовать кредитные ресурсы для расширения деятельности. Она сообщила, что такая схема позволяет ей использовать действующий инфраструктурный актив для привлечения финансирования на уровне активов для других долгосрочных проектов у клиентов. Имея уже заключённые контракты на сумму более $40 млрд с клиентами с инвестиционным рейтингом, такими как Microsoft и Meta✴, Nebius рассчитывает привлечь дополнительный капитал на аналогично привлекательных условиях. Она сообщила, что недавно завершила очередной плановый этап развёртывания мощностей для Microsoft и продолжает выполнять оставшиеся поставки в соответствии с условиями контрактного графика. Сообщается, что финансирование прошло на фоне высокого спроса со стороны кредиторов и было значительно переподписано. MUFG выступила в качестве структурирующего агента, единственного букраннера и андеррайтера, а ABN AMRO, Bank of America, Deutsche Bank и HSBC участвовали в качестве уполномоченных ведущих организаторов. Citi, Crédit Agricole CIB, ING и Morgan Stanley выступили в качестве старших ведущих организаторов. В синдикате также участвовала компания Goldman Sachs.
20.07.2026 [17:16], Руслан Авдеев
Британская Orcadian построит в Северном море автономный 200-МВт ЦОД — на природном газе и с захватом углеродаБританская нефтегазовая компания Orcadian Energy Plc анонсировала строительство в британской части Северного моря дата-центра, работающего от газовой электростанции и размещённого на морской платформе, сообщает Datacenter Dynamics. Газ будет поступать с принадлежащих компании месторождений Earlham и Orwell. Это первый проект морского ЦОД компании. Предполагается, что газ для выработки электроэнергии будет использоваться на месте, а выбрасываемый углекислый газ будут захватывать и закачивать обратно в резервуары месторождения Earlham для долговременного хранения. По мнению экспертов Orcadian, это намного эффективнее доставки газа на берег по трубам, поскольку, например, газ с Earlham на 49 % состоит из CO2. В компании подчёркивают, что это подтверждает способность естественного резервуара удерживать углекислоту под землёй длительное время. По оценкам Orcadian, запасы Earlham составляют более 3,2 млрд м3 газа, а повторная разработка уже порядком истощённого месторождения Orwell обеспечит ещё около 878 млн м3. Газ с месторождений будет смешиваться для обеспечения среднего содержания метана на уровне 50 %.
Источник изображения: Richmond Offshore Energy На первом этапе предполагается развернуть электростанцию и один машинный зал на 200 МВт. Позже могут быть установлены дополнительные генераторы и построены новые, а совокупная мощность «за счётчиком» может превысить 1 ГВт. Для реализации проекта создаётся дочерняя компания Earlham Gigagrid Ltd. Ей же намерены передать лицензию на газовое месторождение. Для этого потребуется одобрение британского Управления по переходу к нулевым выбросам Северного моря (North Sea Transition Authority, NSTA). Orcadian намерена привлечь к проекту гиперскейлеров уровня Google, Amazon, Meta✴ и Microsoft или неооблачные компании — CoreWeave, Nebius, Lambda Labs, Crusoe Cloud и Vultr. Утверждается, что структура Earlham Gigagrid позволяет внешним инвесторам вкладывать средства без риска «размытия» долей имеющихся акционеров Orcadian. Предполагается, что новый проект позволит «повысить ценность» выданной компании лицензии P2680 на разведку и добычу нефти и газа.
20.07.2026 [15:55], Сергей Карасёв
Спрос на GPU-инфраструктуру в России за год взлетел в шесть разПотребление облачной инфраструктуры на основе GPU в России в I половине текущего года подскочило на 507 %, или примерно в шесть раз, по сравнению с аналогичным периодом 2025-го. Об этом сообщает «Коммерсантъ» со ссылкой на исследование провайдера «Рег.Облако». Основным драйвером роста названо внедрение готовых ИИ-сервисов в бизнес-процессы. Ускорители на базе GPU применяются для решения самых разных задач, связанных с нейросетевыми технологиями: от речевой аналитики и компьютерного зрения до клиентской поддержки и работы с корпоративными базами знаний. О росте спроса говорят и Cloud.ru с MWS. По оценкам, количество новых подключений в сегменте GPU-инфраструктуры в России в I полугодии 2026-го подскочило на 160 % в годовом исчислении. При этом ежемесячная активность пользователей увеличилась на 240 %. В сфере выделенных серверов и систем bare metal клиентская база с расходами более 500 тыс. руб. в месяц расширилась более чем в два раза, а доля таких пользователей в общем объёме потребления поднялась с 35 % до 49 %. Отмечается, что самыми востребованными GPU-ускорителями среди российских заказчиков являются NVIDIA RTX A4000 Ampere: такие карты применяют примерно 63 % клиентов. О быстром расширении рынка говорят и другие его участники. Так, провайдер K2 Cloud указывает на 4–5-кратный рост запросов на облачные GPU. При этом, как отмечается, востребованы такие изделия, как NVIDIA L4, L40S и H100. Отраслевые эксперты подчёркивают, что на российском рынке нет недостатка карт «начального уровня», при этом наблюдается дефицит в сегменте высокопроизводительных решений, которые необходимы в том числе для обучения крупных ИИ-моделей с большим количеством параметров. На этом фоне наблюдается трансформация сектора. Кроме того, заказчикам всё чаще нужны не просто ускорители, а готовые ИИ-решения и сервисы.
20.07.2026 [15:39], Руслан Авдеев
Четыре плана «Б» и все провальные: запуск 2,45-ГВт ИИ ЦОД Project Jupiter для Oracle и OpenAI задержится из-за проблем с поставками газа
bloom energy
hardware
oracle
stack infrastructure
stargate
дефицит
полезные ископаемые
сша
цод
электропитание
энергетика
План аренды Oracle 2,45-ГВт мегакампуса ИИ ЦОД Project Jupiter (в рамках инициативы Stargate) с генерацией «за счётчиком» столкнулся с серьёзными препятствиями. Из -за проблем с поставками газа для топливных элементов Bloom Energy реализация может быть отложена на год или два, сообщает Semi Analysis. Предложенный Oracle проект в Нью-Мексико фактически невозможно реализовать с запланированной мощностью до тех пор, пока не построят трубопровод Green Chile Pipeline протяжённостью около 27 км с подключением к системе El Paso Natural Gas (EPNG). Ранее Oracle под давлением общественности отказалась от использования газовых турбин, отдав предпочтение твердооксидным топливным элементам Bloom Energy, тоже работающим на природном газе, но считающимися более экобезопасными. Проблема в том, что точка подключения находится на земле штата, а тот уже дважды отказал в подключении, причём последний раз — 14 июля. Договорный срок ввода трубопровода в эксплуатацию — 15 августа, а пока не утверждён даже маршрут прокладки. Для решения проблемы Oracle могла бы использовать альтернативные варианты снабжения объекта газом, но пока все значимые варианты либо отклонены, либо не соответствуют заявленной мощности кампуса ЦОД. Стоящая за планом прокладки компания Transwestern («дочка» Energy Transfer) подала заявку регулятору Federal Energy Regulatory Comission (FERC) по упрощённой процедуре. Заинтересованные стороны и FERC необходимо было уведомить за 60 дней, и строительство можно было бы организовать при отсутствии возражений. Тем не менее, у FERC возникли возражения по целому ряду причин. В результате, окно для урегулирования закрылось 13 мая, и теперь полноценная процедура рассмотрения заявки займёт в соответствии с законом 18–24 мес.
Источник изображения: Tim Broadbent/unsplash.com Затем Transwestern попыталась вывести проект из-под юрисдикции FERC. Регулятор сам запросил в июне, не подпадает ли газопровод под действие т.н. Hinshaw Amendment — поправки к закону Natural Gas Act, позволяющей полностью избавиться от необходимости получения разрешения от FERC. Данная поправка обычно распространяется на небольшие проекты внутри отдельных штатов, но в итоге Transwestern сама признала, что проект не соответствует необходимым критериям. Третий по счёту вариант решения проблемы, предложенный подрядчиком, предполагал прокладку газопровода в обход государственных земель. Однако предпочтительный маршрут отклонили, а владелец земель на пути альтернативного маршрута не дал своего разрешения. Ещё один альтернативный маршрут и вовсе существует только на словах, поскольку не проводились исследования возможности его использования, оценка стоимости, экологическая экспертиза и т.п. Четвёртый и последний план «Б» подразумевает доставку сжиженного газа грузовиками, пока не будут получены необходимые разрешения для Green Chile. Впрочем, такой «виртуальный газопровод» может обеспечить в лучшем случае лишь 100–200 МВт мощностей — только на 100 МВт потребовалось бы доставлять приблизительно по 55 цистерн с газом ежедневно. Крупнейший известный подобный проект в США рассчитан лишь на 135 МВт. Кроме того, даже без учёта проблем с газопроводом, сам план энергогенерации до сих пор не одобрен. В апреле Oracle и BorderPlex Digital Assets анонсировали переход с газовых турбин на ячейки Bloom Energy, но и для них разрешение на выбросы (Air Permit) к середине июля всё ещё не было выдано. Власти штата назначили публичные слушания, но пока не назвали даже дату их проведения. Пока Project Jupiter реализуется с наибольшими задержками среди всех проектов семейства Stargate. Тем временем сама Bloom Energy вполне процветает. Например, в конце мая сообщалось, что дата-центры Nebius в США получат именно её топливные элементы, 328 МВт только на первом этапе проекта. Дата-центры Oracle получат топливные элементы компании на 2,8 ГВт, но большая часть, надо полагать, приходится именно на Project Jupiter. Впрочем, инвесторов это не отпугивает.
20.07.2026 [14:21], Сергей Карасёв
Стартап Reflection AI приобретёт вычислительные мощности Nebius на $1 млрдНеооблачная компания Nebius (бывшая Yandex N.V.), по сообщению ресурса TechCrunch, заключила соглашение о предоставлении вычислительных мощностей американскому стартапу Reflection AI, который занимается проектами в области ИИ. Стоимость договора составляет $1 млрд. Сообщается, что в рамках партнёрства с Nebius фирма Reflection AI получит доступ к ускорителям NVIDIA, включая изделия GB300. Соглашение охватывает период вплоть до 2029 года. Фирму Reflection AI основали в 2024 году Миша Ласкин (Misha Laskin) и Иоаннис Антоноглу (Ioannis Antonoglou) — бывшие исследователи Google DeepMind. Стартап специализируется на открытых фундаментальных моделях и на создании автономных агентов для автоматизации разработки ПО. Одним из первых продуктов компании является система Asimov для генерации кода. На сегодняшний день Reflection AI получила около $2,6 млрд финансирования от таких инвесторов, как NVIDIA, Sequoia Capital и Lightspeed Venture Partners. Оценка стартапа находится на уровне $25 млрд. Штаб-квартира расположена в Бруклине (Нью-Йорк, США). Нужно отметить, что ранее Reflection AI заключила аналогичный договор со SpaceX: компания Илона Маска предоставит стартапу вычислительные мощности на общую сумму до $6,3 млрд. Это соглашение также будет действовать до 2029-го, что предполагает ежемесячные платежи в размере $150 млн. В рамках договора Reflection AI немедленно получит доступ к системам NVIDIA GB300. В целом, резервирование значительного количества вычислительных ресурсов поможет стартапу ускорить создание открытых ИИ-моделей, которые смогут составить конкуренцию решениям OpenAI и Anthropic. |
|

