Материалы по тегу: ии
|
25.09.2026 [11:09], Сергей Карасёв
Giga Computing развернула ИИ-полигон GAIFA на базе NVIDIA GB300 NVL72Компания Giga Computing, являющаяся подразделением Gigabyte, объявила о создании площадки GAIFA (Gigabyte AI Factory Accelerator) — своего первого вычислительного центра в области ИИ. Он расположился в Синьбэе (Новом Тайбэе) на территории Тайваня. GAIFA представляет собой полигон для проверки и отладки сверхплотных серверных стоек, систем жидкостного охлаждения и электропитания, а также других компонентов и модулей, которые применяются в составе современных ИИ-инфраструктур. Причём специализация GAIFA выходит за рамки аппаратного обеспечения, охватывая весь процесс формирования ИИ ЦОД: от планирования объекта до установки вычислительных и сетевых узлов. В среде GAIFA могут тестироваться самые разные нагрузки — от обучения больших языковых моделей (LLM) с огромным количеством параметров до инференса и профессиональных визуальных вычислений.
Источник изображений: Gigabyte Архитектура площадки выполнена по модульному принципу. В частности, задействованы две стойки NVIDIA GB300 NVL72. Каждая из них объединяет 18 вычислительных лотков, содержащих по два Arm-процессора Grace (72 ядра Neoverse V2) и по четыре чипа Blackwell Ultra. В сумме это даёт 36 изделий Grace и 72 экземпляра Blackwell Ultra на стойку (включая 17 Тбайт памяти LPDDR5X и 20 Тбайт HBM3E). Применяются сетевые адаптеры NVIDIA ConnectX-8 SuperNIC. ![]() Кроме того, в состав GAIFA входит одна стойка на основе серверов G4L4-SD3-LAX7, использующих аппаратную платформу NVIDIA HGX B300 (восемь SXM-ускорителей Blackwell Ultra). Эти машины наделены системой прямого жидкостного охлаждения (DLC) с функцией обнаружения протечек. Дополнительно установлены серверы XL44-SX2-AAS1 с восемью ускорителями NVIDIA RTX Pro 6000 Blackwell Server Edition (96 Гбайт памяти GDDR7). Наконец, применены 10-узловые серверы B683-Z80-LAS1 на платформе AMD EPYC 9005 Turin с СЖО. На текущем этапе общая мощность площадки GAIFA находится на уровне 700 кВт. В дальнейшем показатель будет увеличиваться — по мере расширения объекта и добавления дополнительного оборудования.
25.09.2026 [11:02], Руслан Авдеев
К 2030 году Microsoft инвестирует в страны Персидского залива $10 млрдMicrosoft объявила о намерении инвестировать более $10 млрд в страны Персидского залива к 2030 году. Деньги выделяются на инвестиции в проекты на территории ОАЭ, Саудовской Аравии, Катара и Кувейта. Основной фокус — на облачной и ИИ-инфраструктуре, сообщает Datacenter Dynamics. Дополнительно Microsoft объявила об инвестициях в подводную и наземную телекоммуникационную инфраструктуру на Ближнем Востоке в размере ещё $400 млн к 2030 году. Новые меры принимаются для поддержки партнёрства компании в регионе, в т.ч. с G42 в Абу-Даби, в которую Microsoft уже инвестировала $1,5 млрд в 2024 году. Также в числе партнёров — Humain в Саудовской Аравии и Qai в Катаре. Компания отметила, что поддержка двух последних компаний не означает, что она получит доли в их капитале. Также Microsoft заявила, что в рамках инвестиционного проекта будет искать способы обеспечить водно-положительный баланс своих операций на Ближнем Востоке, а также помогать партнёрам добиться того же. По данным компании, в числе прочего предполагается оптимизация водопользования, восстановление водных ресурсов и внедрение инновационных решений для управления ими. По словам представителя Microsoft, по мере распространения облачной и ИИ-инфраструктуры в Кувейте, Катаре, Саудовской Аравии и ОАЭ внимание будет уделяться обеспечению «ответственного роста». Компания будет работать с местными партнёрами с учётом своих глобальных экологических целей, касающихся сокращения углеродных выбросов, переработки отходов и достижения положительного водного баланса (сама компания уже сообщала, что добилась этого). В том числе речь идёт о приоритетном использовании технологий охлаждения с нулевым расходом воды там, где это возможно.
Источник изображения: Hongbin/unsplash.com В Microsoft добавили, что компания будет стремиться расширить доступ к «чистой» энергии благодаря взаимодействию с ближневосточными регуляторами, коммунальными компаниями и партнёрами для создания на рынке условий, необходимых для наращивания закупок «безуглеродного» электричества и стимулирования инвестиций в новые мощности по получению «чистой» энергии. Также в компании отметили влияние текущего военного конфликта в регионе, поскольку большинство стран региона пострадали от атак беспилотников, в том числе и американские дата-центры. Так, ЦОД Amazon (AWS) в Бахрейне похоже, выведен из строя надолго, поскольку компания заявила, что не может восстановить доступ к ним после иранских атак. В связи с нестабильностью в регионе Microsoft объявила, что расширит обязательства по обеспечению суверенитета защиты данных и обеспечит непрерывную работу сервисов для правительственных структур. Ранее компания уже заявляла о разработке нового подхода к обеспечению физической безопасности ЦОД. Также она подтвердила поддержку расширения операций по обеспечению киберзащиты в странах Персидского залива, что должно обеспечить местным правительствам высокий уровень компетенций в сфере кибербезопасности. В последние годы Microsoft потратила значительные средства на расширение присутствия на Ближнем Востоке. В прошлом году компания обязалась потратить в ОАЭ $7,9 млрд только в 2026–2029 гг. $5,5 млрд из этой суммы будут использованы на «продолжающуюся и запланированную экспансию» облачной и ИИ-инфраструктуры компании. Оставшиеся $2,4 млрд приходятся на плановые операционные расходы и оплату себестоимости продаж. У Microsoft есть облачный регион в Дубае (ОАЭ) с тремя зонами доступности, запущенный в 2019 году. Также компания имеет регионы в Катаре и Израиле, а в 2024 году она завершила строительство облачного региона в Саудовской Аравии, который должен заработать уже в 2026 году. Наконец, в 2025 году были анонсированы планы создания облачного региона в Кувейте. Интересы компании не ограничиваются Ближним Востоком. Например, в апреле она сообщила, что намерена инвестировать $10 млрд в развитие ИИ-инфраструктуры в Японии.
24.09.2026 [20:41], Владимир Мироненко
Crusoe подписала соглашение с Thinking Machines Lab на $65 млн о предоставлении услуг инференсаCrusoe объявила о заключении ежегодного соглашения на сумму $65 млн с ИИ-стартапом Thinking Machines Lab основанным в феврале 2025 года Мирой Мурати (Mira Murati), занимавшей ранее пост технического директора OpenAI. В рамках соглашения Thinking Machines Lab получит доступ к платформе Crusoe Cloud для проведения инференса ИИ-моделей. С помощью сервиса Crusoe Managed Inference она будет обрабатывать ряд производственных нагрузок, включая свои модели Inkling, а также GLM 5.2 и 5.3, на специализированных системах. Также на этой платформе будут работать её собственные дообученные (fine-tuned) версии моделей. Рабочие задачи будут выполняться на выделенной инфраструктуре, состоящей из систем NVIDIA HGX B200 с интерконнектом NVIDIA Quantum-2 InfiniBand. Crusoe будет самостоятельно эксплуатировать и обслуживать этот кластер в рамках формата Tailored Deployment (индивидуальное развёртывание). Клиент предоставляет модель и определяет требования, а Crusoe берёт на себя остальные аспекты развёртывания. Это означает предоставление выделенной, протестированной на производительность конечной точки с гарантированным уровнем обслуживания (SLA). Благодаря этому Thinking Machines Lab избавляется от необходимости самостоятельно управлять стеком для выполнения инференса. Компании также рассматривают возможность использования пакетного инференса (batch inference) для масштабной генерации синтетических данных. «Crusoe Managed Inference позволил нам быстро перейти от оценки к промышленной эксплуатации и обеспечил соответствие стандартам, которые мы предъявляем к собственным системам. Это дало нам необходимые масштабы и экономическую эффективность для реинвестирования в исследования, лежащие в основе нашей деятельности», — сказал Майл Отт (Myle Ott), руководитель отдела инфраструктуры машинного обучения Thinking Machines Lab. «У Thinking Machines Lab очень сильная инженерная команда, которая ожидает, что партнёры будут соответствовать их высоким стандартам по мере роста», — заявил Эрван Менар (Erwan Menard), старший вице-президент по управлению продуктами в Crusoe Cloud. Как сообщается, благодаря этой сделке менее чем через год после запуска Crusoe Managed Inference законтрактованный объём годовой регулярной выручки (ARR) в сегменте управляемых услуг инференса компании превысил $100 млн.
24.09.2026 [17:15], Руслан Авдеев
Финское неооблако Verda Cloud Oy привлекло $189 млн на строительство передовой ИИ-инфраструктурыБазирующаяся в Хельсинки финская компания Verda Cloud Oy, ранее известная как DataCrunch, объявила о привлечении $189 млн финансирования. Средства предназначены для расширения облачной ИИ-инфраструктуры компании, включая вычислительные мощности и платформенные сервисы, сообщает Silicon Angle. Раунд финансирования серии B возглавила компания Emergence Capital, участие приняли и MUFG Innovation Partners, Supermicro, Varma Mutual Pension Insurance Co., Lifeline Ventures, 6 Degrees Capital, byFounders, а также Tesi. К нему также присоединился ряд бизнес-ангелов, включая представителей Meta✴ и Core Automation. В результате финансирования общий объём привлечённых средств компании вырос до более чем $450 млн в форме акционерного и долгового капитала. Verda рассчитывает обеспечить крупномасштабный ИИ-инференс корпоративным клиентам «там, где им необходимо, когда им необходимо, с высокой степенью оптимизации и надёжности». Компания разрабатывает собственные компиляторы и ПО для обслуживания моделей, а также выполняет инженерные задачи для обеспечения производительности и отказоустойчивости.
Источник изображения: Tapio Haaja/unsplash.com Собственная ИИ-лаборатория Verda предназначена для выполнения настоящих исследовательских задач на платформе и решения инженерных задач вроде оптимизации использования ИИ-ускорителей, инференса и др. Компания утверждает, что непрерывная работа в этих направлениях обеспечивает клиентам максимальную отдачу от инфраструктуры. В Verda подчёркивают, что в Европе открылось окно возможностей для создания ключевых компаний нового поколения, но оно останется открытым не слишком долго. В данный момент Verda намерена управлять мощностями объёмом более 250 МВт к 2027 году. ЦОД уже работают в Финляндии, а новые мощности скоро появятся в Европе, Великобритании, США и Азии. По данным компании, она готовит в ближайшие месяцы одни из первых суперкомпьютеров на основе NVIDIA Vera Rubin NVL72. Неооблачная компания также обеспечивает выполнение ИИ-задач для организаций в более чем 50 странах, включая как стартапы, так и крупных корпоративных клиентов. В том числе речь идёт об инфраструктуре Aleph Alpha GmbH, занимающейся разработкой суверенного ИИ, а также о системе инференса для компании Magnific, предлагающей генерацию медиаконтента, — ежедневно к её сервисам поступают миллионы обращений. Epsilon Health обучает собственные кастомные ИИ-модели для радиологии на мощностях выделенного кластера Verda. Последняя утверждает, что будет использовать средства для адаптации бизнеса в соответствии с потребностями пользователей. Современные задачи значительно отличаются от тех, которые клиенты пытались решить всего несколько лет назад. Сессии с ИИ стали длиннее, накопился контекст в ходе диалогов и агентных сценариев использования. Современные задачи требуют ускоренного выделения ресурсов и быстрой настройки мгновенных кластеров, поэтому компания подчёркивает, что инвестирует в ИИ-лабораторию для работы с другими ИИ-структурами, open source-проектами и создателями инструментов для разработчиков. Это позволяет понять, как именно используются вычислительные ресурсы, какие архитектуры моделей появляются, а также какие механизмы оптимизации формируют современные рабочие нагрузки. Компания заявила, что также будет уделять внимание опыту разработчиков, выпуская функции и возможности, помогающие укрепить доверие корпоративных пользователей, обеспечить новые инструменты, повышающие отказоустойчивость своей платформы. Финляндия становится всё популярнее и среди более сильных конкурентов. Буквально на днях Google сообщила о намерении инвестировать €13 млрд ($15,13 млрд) в цифровую инфраструктуру страны в 2027–2028 гг., а Alibaba Cloud рассчитывает в скором будущем открыть там новый облачный регион.
24.09.2026 [14:43], Андрей Крупин
Yandex B2B Tech расширила экосистему сервисов для бизнесаКомпания Yandex B2B Tech в рамках конференции Yandex Scale 2026 представила ряд новых продуктов и сервисов для корпоративного сегмента. Среди ключевых анонсов — новое направление информационной безопасности, платформа для объединения работы с данными, автономные ИИ-агенты для разработки и расширенная версия корпоративного ИИ-ассистента. ИБ-направление Yandex B2B Tech получило название Yandex Security. Компания сосредоточится не только на защите облачной инфраструктуры клиентов, но и будет развивать решения для гибридной, локальной и мультиоблачной безопасности. Также Yandex B2B Tech усилила свой продуктовый портфель новыми продуктами: среди них — инструменты для беспарольной авторизации и поиска избыточных прав доступа в системе.
Источник изображений: yandex.cloud Сервисы Yandex Security позволяют защищать инфраструктуру, размещённую у разных облачных провайдеров. Клиентам доступен мониторинг безопасности мультиоблачной архитектуры в едином интерфейсе. В нём автоматически собираются все данные о защите инфраструктуры: мониторинг доступов к системе, анализ рисков и ошибок в конфигурации и многое другое. Всё это позволяет устранить «слепые зоны» и видеть полную картину безопасности в едином интерфейсе независимо от того, в каком облаке размещены ресурсы. Yandex B2B Tech также анонсировала DataLens Platform — платформу, которая объединяет все этапы работы с данными: от загрузки и хранения до визуализации и ИИ-аналитики. Решение позволяет работать с данными компании в одном месте, быстро находить их источники и получать инсайты с помощью ИИ-агента. Общедоступный релиз продукта запланирован на начало 2027 года. Сначала DataLens Platform будет доступна в Yandex Cloud. Позднее Yandex B2B Tech планирует выпустить версии продукта для размещения в собственной инфраструктуре компании и для гибридного сценария. ![]() На платформе SourceCraft появилась возможность подключать и настраивать автономных ИИ-агентов — например, для разработки и проверки безопасности кода, или создавать агентов с собственными специализациями под ключ. Каждый агент работает под собственной учётной записью как самостоятельный участник команды, выполняет поручение и передаёт результат на проверку. Если ему не хватает данных или требуется согласование, он сам обращается к пользователю. Наконец, ещё одно крупной новинкой стала «Алиса AI Про» для бизнеса — расширенная версия корпоративного ИИ-ассистента, предлагающая более 120 навыков для сотрудников разных профессий и более 20 плагинов для подключения к внешним приложениям. ![]() «Алиса AI Про» способна решать сложные многосоставные задачи. Её можно использовать практически в любом отделе, от дизайна и маркетинга до бухгалтерии, HR и юридического департамента. Достаточно сформулировать поручение простым языком, и помощник выполнит его, используя те же приложения, которыми обычно пользуется сам сотрудник — например, CRM-системы или сервисы для работы с документами и бухучёта. Для решения задач «Алиса AI Про» сама создаёт себе команду специализированных ИИ-агентов. Пока они собирают информацию и работают с документами и корпоративными системами, ИИ-помощник координирует их работу, проверяет и объединяет результаты. С запуском «Алисы AI Про» компании смогут выбирать между двумя версиями ассистента. «Алиса AI для бизнеса», которую «Яндекс» представил в начале сентября, пригодится тем, кому нужно готовое решение. «Алиса AI Про» — тем, у кого есть потребность развернуть продукт на собственной инфраструктуре и настроить его под конкретные задачи.
24.09.2026 [09:12], Владимир Мироненко
Crusoe предоставит инфраструктуру и ПО для PerplexityCrusoe, американский провайдер ИИ-инфраструктуры, сообщил о заключении соглашения с компанией Perplexity о предоставлении ей в аренду инфраструктуры Crusoe Cloud. Согласно соглашению, Perplexity будет обеспечивать полный жизненный цикл своих моделей на единой платформе Crusoe: обучать передовые модели на выделенных кластерах Crusoe с чипами NVIDIA GB300 NVL72 и решениями NVIDIA InfiniBand, а также предоставлять к ним доступ в производственной среде через сервис управляемого инференса Crusoe (Crusoe Managed Inference). «Компаниям, которые быстрее всех внедряют ИИ, нужна инфраструктура, способная поддерживать весь жизненный цикл модели и масштабироваться по мере роста компании, — говорит Чейз Лохмиллер (Chase Lochmiller), соучредитель и генеральный директор Crusoe. — Perplexity создаёт будущее, в котором люди смогут находить ответы на свои вопросы, а Crusoe — ключевой партнёр, который делает это возможным, от первого электрона до последнего токена». Crusoe отметила, что продукты Perplexity работают в режиме реального времени для миллионов пользователей — в среде, где задержка при инференсе и пропускная способность — не теоретические показатели, а реальные характеристики. Сервис Crusoe Managed Inference создан именно для этого: инференса на уровне промышленного производства с использованием собственных оптимизаций, разработанных для повышения производительности и снижения затрат при работе с популярными моделями. Облако Crusoe обеспечит глубину и масштаб операций, необходимые для роста Perplexity, утверждает компания. Согласно соглашению, 1800 сотрудников Crusoe получат доступ к ИИ-сервисам Perplexity в рамках подписки Perplexity Enterprise Pro и Max для поиска информации в интернете и внутри компании, многоэтапных исследований, анализа данных с использованием передовых ИИ-моделей. Финансовые условия сделки не разглашаются. По словам Нейта Каппа (Nate Kupp), вице-президента по инженерным разработкам, корпоративному и инфраструктурному обеспечению в Perplexity, несмотря на то, что Perplexity является крупным клиентом облачного подразделения Amazon.com, Amazon Web Services, и других крупных провайдеров, Crusoe помогает стартапу получить более широкий доступ к чипам NVIDIA GB300, которые важны для его работы. Как отметил Bloomberg, Crusoe пытается расширить подразделение, которое конкурирует с неооблачными компаниями, такими как CoreWeave и Nebius Group NV, предоставляя клиентам чипы и ПО для ИИ. Недавно Crusoe заключила сделку на $13 млрд с компанией Jane Street, которой тоже предоставит кластеры передовых ИИ-чипов, и другую инфраструктуру, необходимую для обучения и инференса ИИ-моделей с использованием облачной платформы Crusoe. В свою очередь, Perplexity заключила в этом году долгосрочное соглашение с CoreWeave об аренде чипов, а также с Microsoft.
23.09.2026 [15:49], Руслан Авдеев
Firebird готовится превратить Армению в американский ИИ-хабАрмения активно стремится превратиться в один из ключевых ИИ-хабов для американской инфраструктуры. В августе стартап Firebird из Сан-Франциско запустил в стране ИИ ЦОД на 15 МВт, который к концу следующего года должен вырасти до 70 тыс. передовых ускорителей и 300 МВт мощности. 20 % вычислительных возможностей зарезервировали для местных пользователей, остальное достанется иностранным компаниям, включая американские, например, Perplexity AI, сообщает Bloomberg. Комплекс расположен в городе Раздане в 45 км от Еревана и готовится стать крупнейшим вычислительным кластером в регионе и одним из крупнейших в Европе. Компания расширяет присутствие на юге Кавказа и в Центральной Азии — в этих регионах крупные структуры конкурируют за создание экономического коридора в обход России связывающего Европу и Китай. По некоторым данным, сделка с участием чипов NVIDIA продемонстрировала нестандартный подход Трампа к переговорному процессу с манипуляциями разрешениями на экспорт ИИ-технологий. С одной стороны, администрация Трампа пользуется ограничениями, введёнными ещё при Байдене, c другой — и критикует их, и проявляет гибкость в данной сфере для достижения политических целей.
Источник изображения: Gevorg Avetisyan/unsplash.com NVIDIA в феврале 2022 года перевела часть разработчиков из Москвы в офис в Ереване. В октябре 2022 года администрация Байдена фактически запретила КНР и России покупать передовые ИИ-чипы на основе американских технологий. Вашингтон был обеспокоен тем, что Россия сможет получать через эту страну американские комплектующие и оборудование, и вскоре начал требовать специальные экспортные лицензии для поставок ИИ-ускорителей в Армению и более 40 других стран. Даже на получение 64-х NVIDIA H100 в те времена ушло более года. Сейчас же помимо Firebird свой проект реализует Eleveight AI. Для крупных ЦОД разрешения США необходимы до сих пор. Хотя Трамп смягчил экспортную политику в этой сфере, введённые в 2023 году правила в значительной степени сохраняются, пока ведётся разработка новой системы глобального регулирования экспорта. Например, ОАЭ и Саудовская Аравия не могли получить лицензии на покупку чипов, пока не согласились на правила, прямо ограничивающие доступ к этим технологиям Китая. Firebird и её партнёры запросили разрешение на покупку ускорителей NVIDIA в начале 2025 года, до официального начала работы компании через несколько месяцев. Первая партия была получена в августе 2025 года. В конце 2025 года появилась информация, что США одобрили экспорт передовых ИИ-чипов в Саудовскую Аравию, ОАЭ и Армению. Firebird уже получила разрешение на поставку более чем вдвое большего количества ускорителей, чем намного более богатая Humain. Однако существенная разница в том, что на Ближнем Востоке большая часть чипов будет использоваться для внутренних нужд, а не для обслуживания американских компаний.
22.09.2026 [23:59], Руслан Авдеев
К 2050 году из-за ИИ контейнеры с электронными отходами смогут шесть раз опоясать ЗемлюСогласно докладу, представленному НКО Basel Action Network (BAN), к 2050 году электронными отходами от ИИ-инфраструктуры можно будет заполнить цепочку морских контейнеров, способную шесть раз опоясать Землю, сообщает The Register. Хотя эти отходы, как ожидается, будут направлены на утилизацию, авторы отмечают тот факт, что существующие оценки в десятки раз занижают масштаб проблемы. Ранее при оценках внимание уделялось в основном серверам и ускорителям, на которые по массе приходится всего 13 % оборудования ЦОД. Если учитывать системы распределения энергии, резервные источники питания, охлаждение, сетевое оборудование и прочую инфраструктуру, отходов может и вовсе оказаться в 40–60 раз больше, чем прогнозируют сегодня известные эксперты. Всего речь идёт о 7 тыс. т отходов для условного ИИ ЦОД мощностью 100 МВт — при модернизации объекта значительная часть оборудования подлежит замене. В докладе How Big Is the AI Waste Wave? Исходят из заявленных отраслью планов строительства новых объектов. На основе этих планов рассчитывается потенциальный объём отходов, который, вероятно, возникнет благодаря ИИ-буму. С 2025 по 2050 гг. на ИИ-инфраструктуру придётся 395–617 млн т электронных отходов, которыми можно заполнить 15–23 млн морских контейнеров. Даже 20 млн поставленных друг за другом контейнеров растянутся на 244 тыс. км, что примерно в шесть раз больше длины окружности Земли.
Источник изображения: Nathan Cima Оценка учитывает несколько допущений. Предполагается, что медь, сталь, охлаждающее и электрораспределительное, а также сетевое оборудование и вычислительные модули в современных ЦОД будут работать по несколько лет, а не десятилетиями — поскольку технологии будут морально устаревать. Так, при замене стоек мощностью 5–15 кВт на стойки 50–140 кВт, поддерживающие ИИ-нагрузки, придётся заменить и большую часть силовой инфраструктуры. Только в кабелях и шинопроводах ЦОД на 100 МВт содержится 2,7 тыс. т меди. ИИ-ускорители, по оценкам BAN, приходится менять каждые два-три года, тогда как у «классических» серверов жизненный цикл составляет порядка в 5–7 лет. Модель предполагает, что владельцы меняют серверы целиком, поскольку OEM-производители обычно поставляют полностью собранное и предварительно сконфигурированное системы. Для прочего оборудования циклы обновления разнятся. Так, для сетевой инфраструктуры цикл составляет 3–4 года, системы распределения электропитания меняют раз в восемь лет, а резервного электропитания — раз в пять лет, как и системы охлаждения. Это лишь первый доклад из серии исследований. Второй, как ожидается, позволит оценить возможности переработки и повторного использования компонентов для снижения электронных отходов. Третий посвятят потенциальной токсичности таких компонентов, включая загрязнение PFAS-химикатами, а четвёртый — способам снижения связанных рисков. Пока что ни один гиперскейлер или международная структура не публиковали планов переработки и использования электронных отходов в прогнозируемых НКО масштабах. Подчёркивается, что существующей инфраструктуры не хватает даже для безопасной переработки отходов в нынешних объёмах. По словам BAN, до сих пор связанные с ИИ дискуссии уделяли основное внимание электроснабжению, углеродным выбросам и водопользованию, в основном, не рассматривая вопрос того, что происходит непосредственно с оборудованием. В организации подчёркивают, что масштабное строительство ИИ-инфраструктуры может привести к катастрофическому кризису, если бизнес и власти не будут планировать действий в отношении «цунами отходов».
22.09.2026 [19:23], Владимир Мироненко
Alibaba представила новый ИИ-ускоритель Zhenwu V900 — самый мощный в Китае, и заявила о планах увеличить мощность ЦОД до 20 ГВтКомпания Alibaba Group представила ИИ-ускоритель Zhenwu V900, разработанный её подразделением T-Head Semiconductor (Pingtouge Semiconductor), пишет SCMP. Кампания заявила, что это «самый мощный чип для ИИ в Китае на сегодняшний день». По данным Alibaba, Zhenwu V900 в три раза превосходит по производительности своего предшественника — Zhenwu M890, но точные показатели не приводятся. Сообщается, что Zhenwu V900 оснащён 216 Гбайт HBM, поддерживает вычисления в формате FP32–FP4 и обладает усовершенствованным тензорным вычислительным блоком Tensor Core, который значительно повышает точность выполнения инструкций в форматах FP8/FP4. Также сообщается о пропускной способности межчипового интерконнекта 1,2 Тбайт/с. Конфигурации размеров блока в форматах MXFP8 и MXFP4 позволяют стабилизировать производительность при масштабировании вычислений в ходе обучения и инференса, пишет The Register. Как сообщил Гао Хуэй (Gao Hui), вице-президент T-Head, серийное производство что Zhenwu V900 запустят в I квартале 2027 года. Вычислительные ИИ-кластеры на базе V900 могут объединять до 500 тыс. ускорителей с использованием коммутаторов ICN Switch собственной разработки, обеспечивая достаточно вычислительной мощности для обучения и инференса моделей с 5–10 трлн параметров. Также на I квартал 2027 года намечен выход суперускорителя Panjiu, оснащенного чипами Zhenwu V900, коммутаторами ICN Switch, картами SmartNIC Panmai и контроллерами Zhenyue. Заодно T-Head представила предварительную версию ИИ-ускорителя нового поколения Zhenwu J900, в основе которого лежит архитектура параллельных вычислений собственной разработки. Его выпуск запланирован на III квартал 2028 года. Компания сообщила о планах по созданию собственных центральных процессоров (CPU) нового поколения, оптимизированных для задач агентного ИИ — Yitian 720 и Yitian 730, выпуск которых стартует в 2027 году. При этом Yitian 730 станет первым процессором T-Head, созданным на базе собственной микроархитектуры, возможно, RISC-V. Yitian 710 использовал архитектуру Arm. Глава Alibaba У Юнмин (Wu Yongming) представил план развития компании, выделив «ИИ-модели, ИИ-чипы и ИИ-облако» в качестве трёх краеугольных камней «машинного интеллекта». Сообщается, что подразделение T-Head завершило разработку полной линейки основных микросхем для ЦОД, охватывающей четыре основные категории: ускорители Zhenwu, CPU Yitian, SmartNIC Panmai и интерконнект ICN. При этом все основные микросхемы, необходимые для формирования сверхбольших ИИ-кластеров, были разработаны самостоятельно. Юнмин заявил о планах компании увеличить мощность глобальных дата-центров Alibaba Cloud до более чем 20 ГВт к 2032 году, что примерно в 10 раз превышает их мощность до появления генеративного ИИ. Для реализации проекта компания инвестирует более $53 млрд в ближайшие три года в строительство ИИ-инфраструктуры. Также компания намерена значительно увеличить поставки чипов для ИИ. И всё же, если сравнивать с ИИ-индустрией США, цифры выглядят не столь впечатляюще. Например, компания Cushman & Wakefield, занимающаяся коммерческой недвижимостью, на прошлой неделе сообщила, что только в США в настоящее время ведётся строительство ЦОД общей мощностью 37,7 ГВт. Часть из них будет задействована в проекте Stargate, в рамках которого к 2029 году планируется ввести в эксплуатацию 10 ГВт.
22.09.2026 [15:40], Сергей Карасёв
Huawei представила ИИ-систему Atlas 960E SuperPoD на базе UnifiedBus и NPOHuawei анонсировала ИИ-систему Atlas 960E SuperPoD. Это, как утверждается, первый в отрасли кластер с технологией NPO (Near-Packaged Optics), предназначенный для работы с большими языковыми моделями, насчитывающими до 10 трлн параметров. В составе Atlas 960E SuperPoD применяются оптические модули Hi-ONE на базе NPO. Данная технология предполагает монтаж оптического движка в виде отдельного узла на плате рядом с ASIC: преимуществами подхода являются снижение задержек и энергопотребления, а также возможность замены компонента при выходе из строя. Пропускная способность достигает 7,2 Тбит/с. Atlas 960E SuperPoD может оснащаться ИИ-ускорителями Huawei Ascend 960, включая будущие изделия 960DT и 960PR. Посредством NPO могут быть связаны до 4096 карт: в случае Ascend 960DT суммарная FP4-производительность составит до 16 Эфлопс. При этом 5500 оптических движков Hi-ONE могут заменить 48 тыс. традиционных оптических модулей стандарта 800G. Это снижает энергопотребление более чем на 550 кВт, одновременно удваивая время безотказной работы системы: показатель доступности достигает 99,8 %. Платформа предполагает применение интерконнекта нового поколения UnifiedBus (UB), который обеспечивает пропускную способность в несколько Тбайт/с и задержку (RTT) на уровне 2 мкс. UnifiedBus даёт возможность сформировать единый пул памяти объёмом до 256 Тбайт. Через сеть UnifiedBus и RoCE отдельные экземпляры SuperPoD можно объединять в суперкластеры (SuperCluster). В частности, двухуровневая четырёхплоскостная архитектура Clos позволяет связать воедино до 512 тыс. NPU. А в сочетании с топологией Multi-rail такой кластер может насчитывать до 1 млн ускорителей. |
|



