Материалы по тегу: ии
|
03.09.2026 [18:04], Андрей Крупин
Состоялся релиз Basis Workplace 3.4 с поддержкой виртуализации отдельных приложенийКомпания «Базис» (входит в ГК «РТК-ЦОД») сообщила о выпуске новой версии платформы виртуализации рабочих мест Basis Workplace 3.4. Ключевым новшеством релиза стала виртуализация приложений. IT-администраторы могут централизованно определять наборы программ, которые автоматически устанавливаются на виртуальные рабочие места пользователей. Гибкие политики доступа позволяют назначать конкретные софтверные продукты определённым сотрудникам или группам. В результате пользователь получает полностью готовую рабочую среду с первого сеанса без необходимости ручных запросов в техподдержку. Другим значимым нововведением стал режим мультиклиента. Новая функция позволяет администраторам работать одновременно в нескольких инсталляциях Basis Workplace с одного рабочего места. Единая точка управления упрощает обслуживание VDI-инфраструктуры, распределённой по разным дата-центрам, филиалам и контурам безопасности, а также ускоряет переключение между средами при реагировании на инциденты.
Архитектура платформы Basis Workplace (источник изображения: basis.ru) Существенным доработкам были подвергнуты средства управления пулами ресурсов. В персонализированных пулах была добавлена поддержка персональных дисков пользователей и возможность их перемещения между пулами. Также реализован механизм рекомпозиции: при изменении базового шаблона система может пересобирать виртуальные машины внутри пула для приведения их к актуальному состоянию. Для заказчиков, использующих Basis Workplace 2.6.4 и планирующих переход на версию платформы 3.4, создан новый инструмент миграции пулов. Он переносит объекты и их настройки, поддерживает миграцию сессионных, персональных и терминальных пулов. Для персональных пулов предусмотрена возможность отката миграции. Помимо этого, в релизе были расширены средства мониторинг пользователей и управления сертификатами, а также обновлён протокол Basis Connect. Список поддерживаемого платформой Basis Workplace ПО пополнили операционные системы Windows 11 и «Альт» 11 в качестве гостевых и клиентских ОС, а также платформа виртуализации VMware vCenter Server 6.7u3.
03.09.2026 [14:46], Руслан Авдеев
Cerebras получит 165-МВт дата-центр в ФинляндииВ Миккели (Mikkeli, Финляндия) стартовало строительство 165-МВт кампуса ЦОД для компании Cerebras. Пока началась реализация первого этапа проекта мощностью 50 МВт, сообщает Datacenter Dynamics. Кампус строится совместно с Compute Nordic Finland. В новом дата-центре будут применять замкнутую систему охлаждения, предусмотрен и отвод «мусорного» тепла на нужды отопления. По словам Compute Nordic Finland, партнёрство с Cerebras — не спекулятивная ставка на будущий спрос, а проект из нескольких этапов, объёмы которого закреплены контрактами, где точно зафиксировано, сколько вычислительных ИИ-мощностей понадобится рынку с в каком направлении будет развиваться спрос. Строительство начнут с 50-МВт объекта, позже мощность увеличат до 80 МВт, а потом и до 165 МВт. В проект предполагается инвестировать €1–€1,7 млрд ($1,16–$1,97 млрд). Миккели находится на юге Финляндии, приблизительно в 230 км от Хельсинки. В начале года сообщалось, что Compute Nordic начала расширение принадлежащих ей участков. Тогда же было выдвинуто предположение, что на этой территории могут построить два ЦОД по 100 МВт. Compute Nordic также управляет одним проектом в Норвегии. Проекты в Миккели рассчитывают реализовать FCDC, Orka Technologies и Regant Oy.
Источник изображения: Cerebras Cerebras наиболее известна благодаря огромным царь-чипам и облачными ИИ-сервисами. Ранее компания сообщала, что намерена к концу 2027 года довести работающие в Европе мощности до 200 МВт. Основное внимание будут уделять проектам во Франции и северных странах. Кроме того, компания заключила соглашение об аренде 40 МВт мощностей в ЦОД Digi Power X в Колумбиане (Columbiana, Алабама). Сегодня компания располагает кластерами для инференса в Санта-Кларе и Стоктоне (Калифорния), последний — на плавучем ЦОД Nautilus, а также в Далласе (Техас). Cerebras занимается развёртыванием кластеров в Миннеаполисе (Миннесота) и тесно взаимодействует с G42, включая проект по созданию суперкомпьютера в Индии. В Канаде Cerebras готовится арендовать мощности в Монреале на объекте Bit Digital, а также у Bell — в провинциях Саскачеван и Манитоба. Дополнительно предполагается развернуть системы Cerebras в Гайане. Во время последнего квартального отчёта компания объявила, что выручка достигла $210 млн, значительно увеличившись г/г, но чистый убыток при этом составил $450,4 млн. Для сравнения, в о II квартале 2025 года речь шла о чистой прибыли в объёме $309,5 млн. В течение последнего отчётного квартала ввели в эксплуатацию новые мощности ЦОД и были заключены контракты на получение дополнительных мощностей до конца 2027 года. В результате общий объём мощностей составит более 600 МВт, а в перспективе перешагнёт гигаваттный рубеж.
03.09.2026 [14:37], Руслан Авдеев
Принадлежащая SoftBank компания SB Energy подала на IPO, получив поддержку NVIDIAИнфраструктурная компания SB Energy, основным владельцем которой является японская SoftBank, подала заявку на IPO, сообщает The Wall Street Journal. Объявлено, что она останется подконтрольной SoftBank и будет торговаться под тикером SBE. Также компания намерена предложить акции розничным инвесторам в Великобритании при посредничестве площадки Marex Financial. Количество акций, которые планируется предлагать в ходе IPO, а также цена ценных бумаг пока не раскрыты. В целом SB Energy намерена привлечь $5–$7 млрд. NVIDIA уже обязалась стать одним из ключевых инвесторов, вложив в компанию $3 млрд. Правда, эту сумму разделят — некоторое количество акций продадут NVIDIA в закрытом режиме одновременно с IPO, оставшиеся средства приходятся на предоплаченный форвардный контракт. Ранее NVIDIA вложилась в Cloverleaf и Lancium, которые также занимаются подготовкой энергообеспеченных участков для ЦОД. Также SB Energy выпустила 4 млн варрантов для OpenAI, вероятно, на сумму $5,5 млрд. Разработчика ChatGPT наделят правом назначать своего представителя в совет директоров до тех пор, пока будет владеть более 5 % акций компании, имеющихся в обращении. SoftBank и OpenAI стали долгосрочными арендаторами в трёх кампусах ЦОД SB Energy, хотя ни один из них пока не готов. Судя по поданным для IPO документам, арендные платежи по соответствующим соглашениям составят значительную часть выручки компании в ближайшем будущем. SB Energy рассчитывает на выручку от своих ЦОД уже с IV квартала текущего года. Компания заявила, что уже законтрактованы 8,8 ГВт мощностей, из них 803 МВт — на стадии строительства. Также имеется 5,5 ГВт мощностей солнечных электростанций и аккумуляторных систем хранения энергии. После полного завершения строительства крупнейший кампус компании — Ports-Pike Technology в Огайо обеспечит 10 ГВт. Проект, за которым стоят SB Energy, OpenAI и NVIDIA, должен стать крупнейшим кампусом ЦОД в мире. При этом, согласно заявлениям самой SB Energy, только ему может потребоваться кредитная поддержка в объёме $6 млрд, в частности — в форме аккредитивов, которые пока не отражаются в текущем балансе компании. В рамках лицензионного соглашения с компанией об использовании товарного знака, SB Energy обязуется выплачивать SoftBank 1 % валовой прибыли, а также заплатит OpenAI $50 млн до 2028 года за её ПО и инструменты. Компания уже привлекла более $1,8 млрд на строительство инфраструктуры, в том числе от OpenAI.
02.09.2026 [15:38], Андрей Крупин
Yandex B2B Tech запустила новый формат частных облаков BareMetal ExtendYandex B2B Tech представила решение BareMetal Extend. Новый сервис позволяет бизнесу получить готовую IT-инфраструктуру на физическом оборудовании без необходимости закупки и обслуживания собственных дорогостоящих систем. В отличие от классических частных облаков, где ресурсы заказчика логически изолированы в рамках общего публичного пула, архитектура BareMetal Extend предполагает физическое разделение инфраструктуры клиента. Это обеспечивает компаниям максимальный контроль над данными при сохранении гибкости облачных технологий. В составе Yandex BareMetal Extend представлены три преднастроенных модуля: Virtualization, Managed Service for Kubernetes и Yandex Cloud Stackland. Первый компонент разработан в партнёрстве с K2Cloud, которая отвечает за установку и настройку системы виртуализации на выделенных серверах, а также за техническое сопровождение в этой части. Второй модуль предоставляет готовую Kubernetes-инфраструктуру, третий — on-premise-платформу контейнеризации с интегрированными PaaS-сервисами Yandex Cloud. Выбор конкретного стека зависит от задач бизнеса: от запуска критичных бизнес-систем до создания сред для разработки ПО.
Как устроен Yandex BareMetal Extend (источник изображения: yandex.cloud) Платформа Yandex BareMetal Extend ориентирована на организации, которые хотят получить максимально управляемую инфраструктуру, но не могут мигрировать в публичное облако из-за внутренних политик информационной безопасности. Решение соответствует первому уровню защищённости персональных данных и обеспечивает защиту на уровнях ЦОД, сети и сервиса. Систему можно безопасно подключать к облачным или локальным ресурсам с использованием приватного соединения Cloud Interconnect.
02.09.2026 [15:15], Руслан Авдеев
Exascale Labs и EnergyBank предложили объединить морские ветрогенераторы, ИИ-серверы и энергохранилищаExascale Labs Holdings и EnergyBank намерены изучить необычный вариант решения проблемы дефицита электроэнергии для ИИ ЦОД. Модульные вычислительные мощности предполагается размещать в непосредственной близости от плавучих ветрогенераторов и систем долговременного хранения электроэнергии, сообщает Converge! Digest. На первом этапе предполагается реализовать пилотный проект на базе плавучей морской ветроустановки Zephyros-One, управляемой Sustainable Energy Norway. Целевая мощность гарантированных вычислений должна составить до 800 кВт. Ожидается, что EnergyBak организует финансирование проекта за счёт частных инвестиций и, возможно, государственного финансирования, а Exascale в рамках инициативы предоставит собственную архитектуру модульного ЦОД. Более масштабная задача — создать воспроизводимую архитектуру, включающую энергогенерацию, хранение энергии, охлаждающие и вычислительные мощности, не зависящие от подключения к магистральным электросетям. Заявляется, что в будущем многотурбинные и многомодульные конфигурации потенциально смогут обеспечивать до 10 МВт на турбину. Системы длительного хранения энергии играют важную роль для морских ветрогенераторов, поскольку инфраструктуре для GPU необходимо чрезвычайно стабильное питание, а сами турбины обеспечить этого не могут. Exascale разрабатывает модульные ЦОД, системы охлаждения высокой плотности, HVDC-решения и системы хранения энергии — не считая её бизнеса GPUaaS, поэтому имеет необходимые компетенции для реализации сложных проектов такого типа.
Источник изображения: Zephyros Research Institute Компании намерены изучить вопрос технологической целесообразности проекта, утвердить базовую архитектуру для его пилотной реализации и разработать план возможных крупномасштабных инициатив. Подписание меморандума о взаимопонимании не влечёт за собой юридических обязательств, а 800 кВт для пилотного варианта и 10 МВт на турбину — не утверждённые мощности, а лишь целевые показатели. Будущее проекта будет зависеть от результатов технической оценки, окончательных соглашений, финансирования, возможности получения разрешений и др. К размещению в море оборудования выдвигаются дополнительные технические требования, как к монтажу, так и к обслуживанию и др., с такими проблемами наземные ИИ ЦОД обычно не сталкиваются. Необычность нового проекта связана с намерением напрямую превратить морскую ветряную турбину в вычислительный ресурс, вместо того чтобы передавать всю вырабатываемую энергию на берег. Это в теории позволит монетизировать энергию непосредственно на месте производства. Модульная конструкция позволит наращивать вычислительные мощности по мере появления доступных генерирующих ресурсов. Важен масштаб проекта. В сравнении с современными проектами гиперскейлеров 800 кВт не представляют особенной ценности для крупных компаний. Даже в случае обеспечения по 10 МВт на турбину вряд ли можно говорить о создании гигаваттных кампусов, по аналогии с теми, что строятся для крупнейших ИИ-кластеров. Впрочем, именно это и интересно. Такая архитектура может позволить организовать распределённые вычисления. Однако им могут понадобиться развитые каналы связи, как наземные, так и подводные. В марте сообщалось, что американская Aikido, поставщик плавучих генераторов, представила оффшорную ветроэнергетическую установку, объединённую с модульным дата-центром, рассчитанным на ИИ-нагрузки. Платформа включает ветряную турбину мощностью 15–18 МВт, способную обеспечить до 10–12 МВт IT-мощности. Непосредственно под стальной оболочкой платформы размещаются три вычислительных модуля мощностью 3–4 МВт каждый.
02.09.2026 [14:00], Руслан Авдеев
PwC: глобальные инвестиции в ИИ-инфраструктуру составят $31,6 трлн к 2050 годуСогласно прогнозам аудиторской и консалтинговой группы PwC, мировые инвестиции в ИИ-инфраструктуру к 2050 году составят рекордные $31,6 трлн. Компания изложила основные прогнозы в отчёте Global Data Centre Outlook. В годовом выражении капитальные затраты на дата-центры вырастут с приблизительно $800 млрд в 2026 году до $1,8 трлн к 2050 году. Роль лидера, вероятно, будет играть США, играющие ключевую роль в экосистеме передовых полупроводниковых решений. Ожидается, что доля страны в этих затратах составит 48 % или $15,1 трлн. Второе место займёт Азиатско-Тихоокеанский регион с совокупными капитальными издержками $8,2 трлн, лидерами в котором станут Китай и Индия. В то же время стратегии обретения ИИ-суверенитета будут способствовать росту инвестиций в Европе и на Ближнем Востоке. В отличие от регулярно начинающихся и замедляющихся инфраструктурных «бумов», инвестиции в ИИ будут только ускоряться в обозримой перспективе. Одна из основных причин в том, что ИИ-ускорители и вспомогательное ИИ-оборудование необходимо обновлять каждые несколько лет, доля оборудования в инвестициях будет постоянно расти — с 70 % сейчас до 93 % к 2050 году.
Источник изображения: PwC Отмечены пять факторов, которые определят направление мировых инвестиций. Ключевым является доступ к электроэнергии — на многих рынках весьма трудно получить доступную, надёжную и низкоуглеродную электроэнергию в требуемых объёмах. Качество связи, безопасность, предсказуемость государственной политики, согласие на строительство ЦОД со стороны местных жителей и доступность ИИ-ускорителей также будут влиять на распределение инвестиций. В рамках подробного анализа рассмотрены сценарии, позволяющие оценить, как могут повлиять на мировые инвестиции и ИИ-инфраструктуру изменения торговой политики, экспортных ограничений и требований к цифровому суверенитету. В первом случае ужесточение экспортных нормативов нарушит мировые цепочки поставок полупроводников. Уже к 2030 году ежегодные инвестиции сократятся приблизительно на 50 % от базового прогнозируемого уровня, после чего последует постепенное восстановление по мере адаптации цепочек. Впрочем, даже после этого мировой объём инвестиций в ИИ составит «всего» $25,5 трлн, на $6 трлн меньше базового прогноза. Второй сценарий предполагает, что усиление внимания к обеспечению цифрового суверенитета и надёжной национальной инфраструктуры не приведёт к значительному сокращению инвестиций, хотя распределение по регионам несколько изменится. Общемировые расходы незначительно сократятся, но инвестиции сместятся в страны с высоким внутренним спросом и относительно неразвитой инфраструктурой ЦОД. Это будет происходить потому, что правительство и регулируемые отрасли будут отдавать приоритет местной инфраструктуре.
Источник изображения: PwC По словам PwC, «развитие ИИ-инфраструктуры — не прилив, который автоматически поднимет все лодки», поскольку для привлечения инвестиций необходимо активно занимать выгодные позиции, а инвесторам стоит рассматривать ЦОД как гибридные активы со сложным профилем рисков. Отчёт стал первым исследованием подобного рода, с долгосрочным прогнозом капитальных затрат до 2050 года. В нём рассматриваются показатели 46 стран и территорий, учитывается как строительство зданий ЦОД, так и размещение в них оборудования. В конце августа американская аналитическая компания Dell’Oro Group существенно повысила прогноз по объёму капитальных затрат на мировом рынке дата-центров. Предполагалось, что к 2030 году капитальные затраты в области ЦОД превысят «всего» $3 трлн. При этом такие показатели вдвое выше тех, что компания приводила в январе 2026 года.
01.09.2026 [16:30], Владимир Мироненко
Selectel усиливает ИИ-платформу новой функциональностью в кaталоге ИИ-моделейSelectel, крупнейший независимый провайдер ИT-инфраструктуры в России, обновил каталог ИИ-моделей (Foundation Models Catalog) для работы с большими языковыми моделями. Обновления усиливают возможности платформы для корпоративных заказчиков: компания обеспечила приватный доступ к моделям, пополнила каталог продвинутыми генеративными моделями, а также расширила возможности для построения геораспределённых систем за счёт добавления нового региона ru-6. Эти изменения позволят бизнесу быстрее запускать ИИ-решения, снижать операционные расходы и соблюдать стандарты информационной безопасности при работе с чувствительными данными. Каталог ИИ-моделей входит в состав ИИ-платформы Selectel — экосистемы сервисов для обучения и запуска генеративных моделей, которая помогает компаниям ускорить интеграцию ИИ-решений. Это даёт бизнесу возможность использовать большие языковые модели, инструменты агентской разработки и другие ИИ-технологии без необходимости самостоятельной настройки ИТ-инфраструктуры, существенно снижая технические барьеры на пути к внедрению инноваций. Теперь сервис стал доступен в новом отказоустойчивом регионе на базе трёх независимых зон доступности. Клиенты могут развернуть два одинаковых инференс-сервиса в разных зонах доступности и строить мультирегиональные схемы, снижая риски простоя за счёт геораспределённости инфраструктуры. При создании инференс-сервиса теперь можно выбрать тип доступа: публичный (через интернет) или приватный (доступ только внутри приватной сети пользователя, без выхода трафика в интернет). Компании смогут построить приватный канал между собственной инфраструктурой и дата-центрами Selectel через услугу Direct Connect и направлять запросы к каталогу ИИ-моделей через него. Это позволит бизнесу с повышенными требованиями к безопасности работать с моделями в изолированном контуре, что особенно актуально для финансовых, медицинских и государственных организаций, обрабатывающих чувствительные данные. Каталог пополнился новыми моделями в квантизации NVFP4, которая повышает производительность при незначительном снижении точности. Технология оптимизирована под GPU поколения Blackwell, что позволяет запускать ресурсоёмкие модели на компактных конфигурациях. Стали доступны модели семейства Queen с максимальным размером контекста — 262 000 токенов, что позволяет работать с большими документами и долгими агентскими сценариями с сохранением высокой точности. В ближайшее время появятся и другие популярные модели в квантизациях FP8 и NVFP4, оптимизированные под GPU, которые доступны в новом регионе ru-6.
01.09.2026 [16:08], Андрей Крупин
UserGate представила межсетевой экран NGFW X10 для работы в экстремальных температурных условияхUserGate объявила о выпуске межсетевого экрана NGFW X10. Решение предназначено для защиты автоматизированных систем управления технологическими процессами (АСУ ТП) и может эксплуатироваться при температуре окружающего воздуха от −40 до +60 °C и отн. вл. 80 %. UserGate NGFW X10 монтируется на DIN‑рейку, имеет габариты 58,5 × 146 × 150 мм и весит 1,4 кг. В основу устройства положены 4‑ядерный Arm‑процессор с частотой 1,8 ГГц, 16 Гбайт DDR4 и SSD ёмкостью 128 Гбайт. Сетевое соединение обеспечивают шесть портов RJ-45 (два из них поддерживают bypass) и один интерфейс SFP+. Также доступепн один порт USB 3.0 Type-A. Максимальная потребляемая мощность — 24 Вт. Функциональные возможности брандмауэра включают контроль состояния сессий, систему предотвращения вторжений (IPS), идентификацию пользователей, дешифрование SSL, защиту от DoS-атак, контентную фильтрацию (более 230 млн URL в 88 категориях), блокировку по GeoIP, поддержку протоколов динамической маршрутизации (OSPF, BGP, RIP) и построение защищённых VPN-каналов (IKEv2). Реализована поддержка 35 протоколов АСУ ТП, в том числе BACnet, DNP3, IEC 104, MMS, Modbus, OPC UA, Profinet IO over DCE/RPC, S7Comm и S7Comm Plus. Производительность решения достигает 1780 Мбит/с на L4-трафике, 100 Мбит/с на уровне приложений (L7 + IPS), пропускная способность функций NGFW — 40 Мбит/с. Поддерживается обработка до 7700 новых соединений в секунду и до 500 тысяч одновременных сессий.
Межсетевой экран UserGate NGFW X10 (источник изображения: usergate.com) Устройство сертифицировано ФСТЭК России по 4 уровню доверия. Выданный ведомством сертификат подтверждает соответствие NGFW X10 требованиям к межсетевым экранам профилей защиты A, Б, Г и Д 4-го класса, а также статус системы обнаружения вторжений (СОВ) уровня сети 4-го класса. Программное обеспечение брандмауэра внесено в реестр Минцифры России, что позволяет использовать комплекс на значимых объектах критической информационной инфраструктуры (КИИ) и в госзакупках. Дизайн и схемотехнику аппаратной платформы NGFW X10 разрабатывало конструкторское бюро UserGate. Производство устройств осуществляется в Санкт-Петербурге, включая монтаж элементов на материнскую плату и селективную пайку, а также все виды входного и выходного контроля.
01.09.2026 [15:41], Руслан Авдеев
К 2030 году AMD, Cisco и Humain развернут в Саудовской Аравии 1 ГВт суверенной ИИ-инфраструктурыAMD, Cisco и саудовская Humain запустили первую в Саудовской Аравии промышленную ИИ-инфраструктуру на основе ускорителей Instinct в формате GPUaaS. Инфраструктура объединяет ИИ-ускорители AMD Instinct MI355X, CPU AMD EPYC, коммутаторы Cisco Silicon One (N9000) и оптический 800G-интерконнекты. Компании заявляют, что инфраструктура обслуживает клиентов Humain в Саудовской Аравии и на других рынках, поддерживая различные задачи, от обучения ИИ-моделей до инференса. Система — первый этап более масштабного проекта строительства ИИ-инфраструктуы. В 2027 году AMD, Cisco и Humain рассчитывают начать внедрение до 250 МВт мощностей с использованием новейших AMD Instinct MI400 Series во II полугодии 2027 года. К 2030 году планируется развернуть до 1 ГВт. Новая архитектура позиционируется как суверенная ИИ-платформа, с помощью которой Humain рассчитывает обеспечить государственные органы, предприятия, исследовательские организации и разработчиков решением, работающим непосредственно на территории страны. AMD предоставляет вычислительные мощности и открытое ПО (ROCm), а Cisco — совместимую сетевую архитектуру и инструменты для централизованного управления инфраструктурой. ИИ-модели предоставит, в частности, Mistral.
Источник изображения: سيف الظاهر/unsplash.com Для американских компаний наиболее важен переход архитектуры AMD/Cisco к промышленной эксплуатации. Планируемый переход от AMD Instinct MI355X к поколению MI400 демонстрирует, как быстро должна, по мнению создателей, развиваться инфраструктура. Также проект демонстрирует, как политика суверенного ИИ и архитектура гиперскейл-уровня пересекаются всё теснее. Если заявленные планы реализуют, Саудовская Аравия получит в своё распоряжение ИИ-платформу, по мощности энергопотребления сопоставимую с кампусами гиперскейл-уровня.
01.09.2026 [15:27], Руслан Авдеев
Anthropic хотела купить разработчика ИИ-чипов MatX за $7 млрд, но передумалаЖелая ускорить создание собственных полупроводников и оборудования, компания Anthropic обсуждала покупку разработчика ИИ-чипов MatX приблизительно за $7 млрд. Позже диалог о выкупе сменился обсуждением возможного партнёрства, сообщает Reuters. Пока нет данных, почему переговоры о покупке бизнеса прекратились. MatX, основанная бывшими разработчиками TPU Google, ищет возможность привлечь новые средства с сопутствующей оценкой капитализации на уровне $4 млрд. Сами компании слухи не комментируют. Anthropic намерена самостоятельно разрабатывать ИИ-чипы, способные удовлетворить её запросы и снизить зависимость от сторонних ускорителей, в первую очередь NVIDIA. Компания нанимает опытных разработчиков и управленцев для ускорения разработчик собственных чипов, но на это могут уйти годы. При этом компания планирует диверсифицировать закупки ускорителей, работая с различными поставщиками. На разработку и организацию масштабного производства одного чипа может уйти не менее года и сотни миллионов долларов. Покупка стартапа, занимающегося созданием ИИ-чипов тут же обеспечила бы Anthropic необходимые компетенции и помогла бы снизить издержки в долгосрочной перспективе. Особенно чипы MatX могли бы быть полезны при обучении ИИ-моделей, хотя большинство конкурентов Anthropic заинтересованы скорее в ASIC для инференса. Anthropic планирует потратить десятки миллиардов долларов на аренду вычислительных мощностей, а также намерена покупать чипы напрямую. Компания рассчитывает купить ИИ-чипов Google на $36 млрд, а также подписала соглашение об аренде вычислительных мощностей у Nscale на $45 млрд, заключила сделку с Fluidstack на $50 млрд, со SpaceX — на $45 млрд, с Lambda — на $35 млрд. И это не считая всё расширяющегося сотрудничества с Amazon на $100 млрд. В последние недели компания провела ряд встреч с многочисленными стартапами, занимающимися ИИ-чипами, чтобы лучше понять современные подходы к проектированию ускорителей. Недавно она наняла ветерана отрасли из Google — Амира Салека (Amir Salek) в рамках развития проекта, связанного с разработкой вычислительного «железа». В июне она переманила бывшего разработчика из OpenAI, работавшего над ускорителем Jalapeño, который превзошёл решения NVIDIA в инференсе. Создание кастомного чипа может также помочь Anthropic обезопасить свой бизнес на фоне дефицита чипов NVIDIA, которые, по данным последней, будут в дефиците минимум до 2027 года. Собственные TPU выпускает Google, а Amazon создала семейства Trainium и Inferentia. Anthropic стала одной из первых компаний, эксплуатирующих свои модели на решениях нескольких вендоров, включая NVIDIA, Google и Amazon. |
|

