Материалы по тегу:

20.08.2026 [13:20], Владимир Мироненко

Baidu полагается на производство ИИ-чипов Kunlunxin на фоне запретов США

Китайская компания Baidu сообщила в ходе отчёта за II квартал 2026 года, что видит хорошие перспективы для своего бизнеса по производству чипов Kunlunxin, поскольку у местных покупателей не будет альтернатив. Доу Шен (Dou Shen), вице-президент Baidu AI Cloud Group, заявил, что компания работает над вопросом выхода Kunlunxin на биржу и вскоре предоставит конкретную информацию по этому поводу.

«С точки зрения бизнеса, мы по-прежнему очень уверены в долгосрочном росте и коммерческом потенциале Kunlunxin по нескольким причинам», — сказал Доу Шен. Во-первых, спрос на инфренс продолжает расти, и в Baidu считают, что эта тенденция сохранится надолго. Во-вторых, внутренний рынок Китая имеет «значительный потенциал роста», поскольку предложение ИИ-чипов «вероятно, останется ограниченным в течение некоторого времени». «На этом фоне клиенты всё чаще ищут высокопроизводительные, надёжные и экономичные отечественные чипы ИИ», — говорит Шен.

Как отметил The Register, эти заявления примечательны в контексте политики правительства США, разрешившего NVIDIA возобновить продажи своей продукции в Китае, и реакции на это Пекина, который наложил вето на любые закупки местными компаниями. По словам NVIDIA, запрет Вашингтона на поставки в Китай обошёлся ей в $10,5 млрд только за шесть месяцев. В своем последнем квартальном отчёте компания сообщила, что даже после отмены запрета она не будет получать никакой выручки в Китае, и что у неё «нет уверенности в том, что какой-либо импорт будет разрешен в страну». И теперь Baidu сообщает, что китайские покупатели обращаются к местным поставщикам. К тому же Пекин поощряет внедрение местных технологий, стремясь снизить зависимость от американской продукции.

 Источник изображения: Baidu

Источник изображения: Baidu

Выручка Baidu снижается пятый квартал подряд. Рекламный бизнес сокращался быстрее, чем рос бизнес в сфере ИИ, отметил ресурс TNW. Компания сообщила о выручке за II квартал, завершившийся 30 июня 2026 года, в размере ¥31,325 млрд ($4,62 млрд), что на 4 % меньше, чем годом ранее, и на 2 % меньше, чем в предыдущем квартале. Результат также оказался меньше прогнозов аналитиков. По данным Bloomberg, South China Morning Post прогнозировал выручку в размере ¥31,6 млрд. Согласно опросу LSEG, консенсус-прогноз аналитиков составлял ¥31,96 млрд.

Основным драйвером роста был облачный бизнес. Выручка от деятельности, связанной с ИИ, выросла на 25 % до ¥12,5 млрд. Сейчас на этот бизнес приходится половина общего дохода компании. Выручка от облачных сервисов с использованием ИИ выросли на 50 % в годовом исчислении до ¥7,3 млрд, а доход от сегмента GPU Cloud (ранее назывался «доходы от подписки на инфраструктуру ИИ-ускорителей») увеличился на 283 %, ускорившись по сравнению с ростом на 184 % в предыдущем квартале. Компания заявила, что рост в сегменте GPU Cloud отражает растущий спрос на публичные облачные вычисления для ИИ. Доход от ИИ-приложений составил ¥2,5 млрд, что на 3 % больше, чем годом ранее, а выручка от маркетинговых сервисов, разработанных с использованием ИИ, осталась примерно на том же уровне — ¥2,6 млрд.

Всего онлайн-маркетинговые сервисы принесли ¥13,1 млрд, что на 19 % меньше год к году. Аналитики Reuters объяснили эту тенденцию затяжным спадом на рынке недвижимости в Китае и вялым потребительским спросом. «Хотя наш онлайн-маркетинговый бизнес по-прежнему находится под давлением, растущая динамика в нашем основном бизнесе, основанном на ИИ, подтверждает переход Baidu от компании, ориентированной на интернет, к компании, в первую очередь ориентированной на ИИ», — указал в своём заявлении соучредитель и генеральный директор Baidu Робин Ли (Robin Li), пишет ресурс qz.com.

Чистая налогооблагаемая прибыль Baidu составила ¥2,3 млрд, а чистая рентабельность — 7 %. Скорректированная чистая прибыль (Non-GAAP) составила ¥2,6 млрд. Операционный денежный поток равняется ¥3,4 млрд, что является положительным показателем четвертый квартал подряд, сообщила компания. Расходы на R&D составили ¥4,6 млрд ($679 млн), увеличившись на 5 % по сравнению с предыдущим кварталом и снизившись на 10 % год к году.

Постоянный URL: http://servernews.ru/1147129
20.08.2026 [13:08], Сергей Карасёв

Pine64 прекратила выпуск Linux-устройств из-за дефицита чипов памяти

Компания Pine64, разрабатывающая одноплатные компьютеры с поддержкой Linux и другие продукты, сообщила о приостановке выпуска устройств. Причина — дефицит комплектующих, прежде всего чипов оперативной и флеш-памяти. Цены на эти компоненты продолжают расти, что создаёт производственные трудности и снижает рентабельность бизнеса.

В официальном заявлении Pine64 говорится, что из-за сформировавшейся нехватки изделий DRAM и eMMC выпуск новых устройств на Linux в ближайшее время не планируется. Будет ли производство возобновлено в обозримом будущем, зависит от цен на эти компоненты после середины 2027 года. При этом компания намерена продолжить поставки решений на базе микроконтроллеров.

«В целом, ситуация с Linux-устройствами не самая радужная, но в магазине PineStore по-прежнему доступны устройства на базе MCU — ассортимент таких продуктов в дальнейшем будет расширяться», — сказано в заявлении Pine64. Таким образом, купить оборудование Pine64 под управлением Linux будет невозможно после исчерпания оставшихся запасов. При этом компания продолжит реализацию таких товаров, как умные часы PineTime, блок питания PinePower и пр.

 Источник изображения: Pine64

Источник изображения: Pine64

Между тем другие участники рынка на фоне дефицита чипов памяти вынуждены поднимать цены на свои продукты. В частности, значительно увеличилась стоимость популярных одноплатных компьютеров и вычислительных модулей Raspberry Pi: некоторые решения подорожали сразу на $150. Кроме того, NVIDIA подняла цены на модули Jetson — стоимость отдельных устройств подскочила вдвое. Вместе с тем продолжается стремительный рост цен на SSD корпоративного класса.

Постоянный URL: http://servernews.ru/1147132
20.08.2026 [08:50], Руслан Авдеев

ABB предложила энергохранилище на суперконденсаторах для ирландских дата-центров

Производитель электротехнического оборудования ABB представил новый вариант энергохранилища на суперконденсаторах. Оно предназначено для поддержки бесперебойной работы ирландских ЦОД, сообщает DataCenter Dynamics. ABB заявила, что система призвана помочь дата-центрам выполнить новые требования местного оператора энергосетей EirGrid. В частности, требуется активная поддержка энергосистемы во время сбоев.

Требование, известное как MPID345, обязывает крупных потребителей электричества, в т.ч. ЦОД, оставаться подключенными к электросетям во время аварийных ситуаций — вместо отключения от них. После того, как подача электричества будет восстановлена, ЦОД обязаны восстановить 90 % потребления, зарегистрированного до сбоя, за 500 мс.

Предложенное ABB решение комбинирует энергохранилище с силовым преобразователем и модулем цифрового управления в составе компактной, модульной платформы «за счётчиком». Компания объявила, что система готова за миллисекунды отвечать на сбои в энергосети, не требуя перестройки действующей электрической инфраструктуры.

 Источник изображения: Daniel Zbroja/unsplash.com

Источник изображения: Daniel Zbroja/unsplash.com

В отличие от традиционных систем резервного энергообеспечения, в т.ч. ИБП, ДГУ и защитных схем, изолирующих объекты от сетевых сбоев, новая платформа ABB позволяет активно стабилизировать подсистему питания объектов, в то же время сохраняя непрерывную работу оборудования. В компании подчёркивают, что новое решение позволит снизить рост влияния ЦОД на энергосистему Ирландии. Если раньше дата-центры могли отключаться при аварии, то теперь такое право у них отсутствует — они должны, наоборот, помогать стабилизировать общую сеть.

Уже сегодня в стране почти четверть всей электроэнергии потребляют ЦОД. По оценкам ABB, к 2032 году показатель вырастет до 30 %. Если несколько крупных ЦОД отключатся одновременно, между генерацией и потреблением электричества возникнет дисбаланс, в результате которого начнутся колебания частоты во всей энергосистеме. По словам ABB, в результате сбоев в энергосети наблюдаемое падение нагрузки уже увеличилось с 74 МВт в январе 2022 года до 387 МВт в мае 2025-го. И это далеко не рекордные показатели в индустрии. В «Аллее дата-центров» в 2024 году из-за кратковременного сбоя от сети на несколько часов отключились ЦОД мощностью 1,5 ГВт, а в этом году — уже 3,6 ГВт.

Ранее ирландская Комиссия по регулированию коммунальных услуг (Commission for Regulation of Utilities, CRU) отменила мораторий на новые подключения ЦОД, заявив, что любой дата-центр, намеренный подключиться к электросети, должен установить на территории своего кампуса генераторы или аккумуляторные энергохранилища, способные кратковременно полностью удовлетворить свои потребности в электричестве. Также операторы будут обязаны поставлять электроэнергию в национальную электросеть в случае необходимости.

Постоянный URL: http://servernews.ru/1147093
20.08.2026 [00:35], Андрей Крупин

В Якутии развернут дальневосточный ИИ-кластер на базе собственного дата-центра

В Республике Саха (Якутия) разрабатывается проект создания дальневосточного кластера искусственного интеллекта. Об этом ТАСС сообщил директор по технологическому лидерству Корпорации развития региона, которая выступает проектным офисом инициативы.

Проект предполагает строительство собственной высокотехнологичной инфраструктуры — дата-центра. По словам собеседника агентства, кластер будет включать в себя как аппаратную часть, в том числе GPU-сервер, так и программную — облачные сервисы для предоставления вычислительных мощностей и готовых моделей ИИ.

Разработка ИИ-кластера ведётся в соответствии со Стратегией развития искусственного интеллекта Республики Саха, утверждённой в начале 2026 года. Инициатива получила поддержку на федеральном уровне: после рабочей поездки в Якутск премьер-министр РФ поручил профильным ведомствам совместно с республикой проработать создание ЦОД.

 Источник изображения: Министерство инноваций, цифрового развития и инфокоммуникационных технологий Республики Саха (Якутия) / mininnovation.sakha.gov.ru

Источник изображения: Министерство инноваций, цифрового развития и инфокоммуникационных технологий Республики Саха (Якутия) / mininnovation.sakha.gov.ru

Для реализации масштабных планов регион намерен привлечь крупных технологических партнёров. На полях предстоящего Восточного экономического форума планируется подписание соглашений с ПАО «Вымпелком» и производителем модульных дата-центров Art Engineering. Компании выступят экспертами в вопросах строительства ЦОД, телекоммуникаций и IT-интеграции.

Особое внимание уделяется размещению ЦОД рядом с объектами, которые смогут обеспечить его стабильной энергией. Рассматриваются варианты строительства вблизи газоконденсатных месторождений, угольных предприятий и объектов энергетики. Приоритетным направлением являются площадки рядом с газоконденсатными месторождениями — Средневилюйским или Чаяндинским.

Создание собственного кластера ИИ позволит обеспечить технологический суверенитет республики, а также предоставить необходимые ресурсы для внедрения нейросетей в ключевые отрасли экономики Дальнего Востока — от горнодобывающей промышленности до мониторинга вечной мерзлоты.

Постоянный URL: http://servernews.ru/1147119
19.08.2026 [23:41], Владимир Мироненко

Sandisk спроектировала первый кристалл HBF и готовит выпуск образцов в 2027 году

Спустя всего несколько дней после презентации совместно с SK hynix первых спецификаций стандарта High Bandwidth Flash (HBF), компания SanDisk объявила о завершении финального этапа проектирования (стадии tape-out) первого кристалла HBF, продемонстрировав его образец на слайде. Заодно компания сообщила подробности о своей стратегии роста и долговременной экономической модели.

В HBF используется многослойная архитектура NAND вместо DRAM с размещением её рядом с ускорителем, подобно HBM. HBF использует запатентованную технологию, которая помогает уменьшить напряжение и деформацию кристалла и улучшить теплопроводность, позволяя использовать многослойную структуру из 16 кристаллов для достижения целевой ёмкости и пропускной способности.

 Источник изображений: SanDisk

Источник изображений: SanDisk

Как сообщила SanDisk, первое поколение HBF нацелено на 512 Гбайт на один стек — 16 кристаллов по 256 Гбайт с общей пропускной способностью 1,6 Тбайт/с при чтении. SanDisk утверждает, что HBF обеспечивает в 8–16 раз большую ёмкость, чем HBM, при аналогичной стоимости и в упаковке, по размерам, высоте стека и энергопотреблению практически не уступающем HBM4. А поскольку это NAND-память, она энергонезависима.

Ожидается, что второе и третье поколение HBF обеспечат скорость чтения, превышающую 2 и 3,2 Тбайт/с соответственно, а ёмкость многослойной структуры достигнет 1 и 1,5 Тбайт на стек. При этом они будут потреблять соответственно в 0,8 и 0,64 раза меньше энергии, чем память первого поколения. Как сообщает StorageReview.com, в презентации SanDisk были чётко обозначены целевые рабочие нагрузки HBF: LLM с MoE-архитектурой, длинные контекстные окна и большие KV-кеши — всё с учётом предложений крупных клиентов в области облачных вычислений и ИИ.

В представленной презентации также указаны три варианта развёртывания памяти HBF в рамках одного XPU. Она может дополнять HBM, заполняя некоторые позиции в стеке вокруг xPU, или полностью заменять её, занимая аналогичную площадь. Либо же она будет хранить веса декодирования и KV-кеши, тогда как HBM (меньшего объёма) будет работать как кеш. Эта гибкость важнее, чем кажется на первый взгляд, поскольку позволяет использовать HBF, не требуя от производителя ускорителя отказа от HBM.

SanDisk показала результаты внутренних тестов генерации токенов для одного GPU c HBF, четырёх GPU с HBF и восемью GPU с HBM. На основе тестов компания сделала два заявления. Первое — о восьмикратном увеличении эффективности капитальных затрат исходя из минимальной конфигурации, необходимой для запуска модели: один GPU с HBF против восьми GPU с HBM. Второе — о двукратном увеличении эффективности GPU: четыре GPU с HBF выдают тот же объём токенов, что и восемь GPU с HBM.

HBF показывает результат, отличающийся от HBM с высокой пропускной способностью всего на 2,2 % при чтении весов для Llama 3.1 405B. Следует учесть, что речь идёт о предварительных данных самой SanDisk, где, например, не даны точные значения по скорости генерации токенов. Но в целом компания говорит о том, что увеличение объёма набортной памяти ускорителя в 8–16 раз при той же пропускной способности и примерно той же мощности, что у HBM, потребует меньшего количества ускорителей для хранения одной и той же модели, а сами ускорители будут тратить меньше времени на ожидание данных.

Как сообщает TrendForce со ссылкой на Mizuho Securities и Goldman Sachs, компания планирует выпустить первые образцы HBF в 2027 году, а массовое производство, как ожидается, начнётся в 2028 году. В Mizuho Securities полагают, что HBF вряд ли полностью заменит HBM, но позволит создавать дезагрегированные архитектуры для ИИ-инференса — консорциум HBF, куда входят Google, Meta, SK hynix и Tenstorrent, работает над развитием этого подхода.

TrendForce полагает, что в долгосрочной перспективе выиграет гибридная архитектура, где HBM будет использоваться для высокоскоростных вычислений, а HBF — для повышения плотности хранения. Такая иерархия памяти может стать ключевым фактором крупномасштабной коммерциализации ИИ.

Постоянный URL: http://servernews.ru/1147114
19.08.2026 [17:44], Руслан Авдеев

Человеческие нейроны подружились с кремнием: в Сингапуре запустили прототип «биологического» ЦОД

Компания DayOne при участии австралийской Cortical Labs и медицинского факультета (NUS Medicine) Национального университета Сингапура ввела в эксплуатацию первый в стране прототип «биологического» дата-центра, сообщает DataCenter Dynamics. Ранее компании договорились о создании ЦОД в Мельбурне и Сингапуре.

Сингапурская биологическая вычислительная система состоит из 20 блоков CL1 и находится в действующей исследовательской среде NUS Medicine, предоставляемой DayOne. Представленная в 2025 году система CL1 объединяет нейроны, выращенные из человеческих стволовых клеток, с кремниевыми решениями. По данным компании, речь идёт о создании «более передовой и экоустойчивой формы ИИ» — нейросети Synthetic Biological Intelligence (SBI).

 Источник изображения: DayOne

Источник изображения: DayOne

Платформа передаёт нейронам информацию об окружающей виртуальной среде, а те реагируют на поступающую информацию, генерируя импульсы, влияющие на события в симуляции. Интегрированная система поддерживает нейроны живыми до полугода. CL1 — модернизированная версия биокомпьютера Cortical Labs DishBrain, который использовал CMOS-чип с 800 тыс. человеческих и мышиных нейронов. Он самостоятельно научился играть в Pong — компьютерную игру 1972 года, имитировавшую партии настольного тенниса.

 Источник изображения: DayOne

Источник изображения: DayOne

По словам представителя Cortical Labs, создание нового прототипа переводит биологические вычисления в сферу коммерческого применения. Они могут дополнять ИИ в сферах, в которых недостаточно данных обычному искусственному интеллекту, поскольку «биологический» ИИ может обучаться на значительно меньших объёмах информации и адаптироваться по мере изменения условий.

Cortical Labs, основанная в Мельбурне в 2019 году, уже привлекла $11 млн финансирования. Среди инвесторов — Horizons Ventures, Blackbird Ventures, LifeX Ventures, Radar Ventures и связанная с ЦРУ In-Q-Tel. Сингапурский оператор ЦОД DayOne (ранее GDS International) располагает портфолио дата-центров совокупной мощностью более 500 МВт и сейчас готовится к IPO. В июне 2026 года компания привлекла финансирование в размере $4,5 млрд.

Постоянный URL: http://servernews.ru/1147087
19.08.2026 [16:55], Руслан Авдеев

Жители Мэна «потопили» проект подводного ИИ ЦОД DeepGreen

Жители Истпорта (Eastport, шт. Мэн) совместно с представителями местных индейских племён и экоактивистов выступили против строительства компанией DeepGreen Western Passage в заливе Фанди (Bay of Fundy) подводного ИИ ЦОД. Противники проекта опасаются, что тот негативно скажется на местной экосистеме, в частности, нагревая воды залива, сообщает The Maine Monitor.

В феврале DeepGreen подала федеральному регулятору FERC заявку на получение предварительного разрешения сроком на 48 мес. на проведение инженерных и экологических исследований на участке около 160 га в заливе Фанди, где со временем планировалось развернуть автономный подводный дата-центр с модульной архитектурой, позволяющей подключать сторонние источники электричества, в частности, приливные турбины Ocean Renewable Power Co. (ORPC), в обход локальной энергосети.

Ранее ORPC уже реализовала инициативу по использованию приливных турбин для местной микросети. Меморандум о взаимопонимании действовал до 2025 года, ещё в 2021 году проект обеспечил Истпорту федеральное финансирование в рамках программы Energy Transitions Initiative Partnership Project (ETIPP) в числе десятка других городов. Предварительное разрешение ORPC на участок истекло в феврале 2026 года.

 Источник изображения: Chris Henry/unsplash.com

Источник изображения: Chris Henry/unsplash.com

В заявке DeepGreen, поданной в том же месяце, регулятор FERC выявил четыре ключевых изъяна. Так, не были названы все затронутые проектом индейские племена и не были названы точные физические размеры и конфигурация объекта. Более того, компания не пояснила, зачем ей нужна операционная зона площадью в полторы сотни гектар, если сам объект будет занимать гораздо меньше места, а также зачем-то включила в заявку зоны, выходящие за пределы границ реализации проекта.

DeepGreen исправила заявку, разъяснив взаимоотношения с племенами, сократив запрашиваемую площадь со 162 га до 11 га, уменьшив размеры основания объекта и пересмотрев используемые материалы, а также снизив мощность с 51 МВт до всего 15 МВт. На первом этапе предполагалась установка 16 морских турбин, на втором этапе, для которого пришлось бы получать отдельное разрешение — 34. Изначально же предусматривалось использование сразу 170 турбин.

Однако в итоге в дело вмешались жители Истпорта, в результате чего городской совет единогласно ввёл мораторий на реализацию любых проектов ЦОД в течение 180 дней — на суше, под водой, с частичным или полным погружением, а также связанной инфраструктуры. Совет имеет право отменить мораторий раньше или продлить его действие, хотя в последнем случае у него возникнут трудности. Аналогичный проект DeepGreen на Аляске с установкой 330–350 турбин тоже пока не получил одобрение FERC.

Постоянный URL: http://servernews.ru/1147079
19.08.2026 [15:47], Руслан Авдеев

Разработчик инференс-чипов Etched привлёк ещё $700 млн, доведя оценку капитализации до $21 млрд

Вскоре после закрытия раунда финансирования C на $300 млн, поддержанного NVIDIA, компания Etched, занимающаяся разработкой чипов для инференса, привлекла ещё $700 млн, сообщает Silicon Angle. Общая оценка всего за несколько недель выросла с $10,3 млрд до $21 млрд, тогда как в конце 2025 года она составляла около $5 млрд.

Раунд возглавила инвестиционная группа Jane Street, участие в нём приняли Kleiner Perkins, Sequoia, венчурный фонд Andreessen Horowitz, Tiger Global, Bain Capital Ventures и другие инвестиционные структуры. Jane Street также стала первым клиентом Etched. Ранее сообщалось, что уже заключены контракты на поставку чипов для инференса на сумму более $1 млрд.

 Источник изображения: Etched

Источник изображения: Etched

Etched основана в 2021 году для разработки чипов, оптимизированных для моделей-трансформеров, рассчитанных на скалярные операции и умножение матриц, а также способных работать при пониженном напряжении. Первый прототип чипа был выпущен TSMC в этом году, а сейчас компания расширяет собственные ЦОД для тестирования чипов потенциальными клиентами.

Etched ориентируется на поставку стоечных решений с проприетарным межчиповым интерконнектом с низкой задержкой (700 мс против типовых 4 мкс), фирменными водоблоками и кастомным VRM для питания. По словам Etched, для постройки первой серверной стойки «с нуля» компании потребовалось три года. Следующий вариант планируется представить значительно быстрее.

Постоянный URL: http://servernews.ru/1147068
19.08.2026 [15:01], Андрей Крупин

Стоимость развёртывания ведущих мировых ИИ-моделей в России за год выросла в 2,8 раза

Компания MWS Cloud (входит в МТС Web Services) проанализировала требования к вычислительной инфраструктуре для запуска ведущих мировых и российских больших языковых моделей.

Экспертную оценку прошли популярные открытые модели, выпущенные весной и летом соответствующего года. Для 2025 года рассматривались Kimi K2, gpt-oss-120b, Gemma 3 27B, GLM-4.5V, Qwen3 235B и российская Cotype Pro 2. Для 2026 года — Kimi K3, Qwen3.5 397B, DeepSeek-V4-Pro, DeepSeek-V4-Flash, GLM-5.2, Gemma 4 и Cotype Pro 3. Исследование показало, что средняя стоимость минимального набора ускорителей NVIDIA для запуска одной модели увеличилась в 2,8 раза — с 13,7 млн руб. в 2025 году до 38,8 млн руб. в 2026 году.

Новые ИИ-модели становятся более мощными: они лучше справляются со сложными задачами и могут обрабатывать больше информации в одном запросе. Однако для этого им требуется больше памяти и более производительные GPU. При этом растёт и стоимость самих видеокарт, поэтому развёртывание моделей обходится дороже, пояснили в MWS Cloud результаты исследования.

 Источник: MWS Cloud / mws.ru

Источник: MWS Cloud / mws.ru

По словам экспертов MWS Cloud, цены на GPU в России во многом зависят от мирового рынка: глобальная гонка в области ИИ увеличивает спрос на вычислительные мощности и поддерживает рост стоимости ускорителей. Как следствие, развёртывать крупные модели на собственной инфраструктуре становится дороже, однако единого ценового предела, после которого рынок потеряет интерес к ИИ, нет: если покупка оборудования перестаёт окупаться, компании выбирают более компактные модели, оптимизируют вычисления или переходят в облако, где можно платить только за фактически используемые мощности.

Постоянный URL: http://servernews.ru/1147092
19.08.2026 [14:51], Сергей Карасёв

Cerebras представила ИИ-стойки CS-4 с тремя разогнанными царь-ускорителями WSE-3 Turbo

Компания Cerebras Systems анонсировала мощные ИИ-ускорители WSE-3 Turbo и стоечную систему на их основе CS-4. Утверждается, что это решение обеспечивает выигрыш в производительности на задачах инференса до 30 раз по сравнению с платформами на базе современных GPU.

Как и оригинальное изделие WSE-3 (Wafer Scale Engine), ускоритель WSE-3 Turbo содержит 4 трлн транзисторов, 900 тыс. ядер и 44 Гбайт памяти SRAM. При производстве по-прежнему применяется 5-нм техпроцесс TSMC, а площадь кремниевой пластины сохранилась на отметке 46 225 мм2. При этом пропускная способность памяти поднялась с 21,6 до 43,2 Пбайт/с, а подсистемы ввода-вывода — с 1,2 до 2,4 Тбит/с.

 Источник изображений: Cerebras

Источник изображений: Cerebras

Производительность в разреженных FP16-вычислениях выросла вдвое — со 125 до 250 Пфлопс, на обычных FP16-операциях — с 12,5 до 25 Пфлопс. Показатель TDP на уровне пластины оценивается в 33 кВт против 15 кВт у WSE-3, на уровне узла — 46 кВт против 23 кВт, а на уровне всей стойки CS-4 — порядка 120–140 кВт. По-видимому, компания просто подняла рабочие частоты — ориентировочно с 1,4 ГГц до 2,8 ГГц.

ИИ-стойка CS-4 выполнена на модульной архитектуре Nexus. Система разделена на три ключевых блока: это вычислительный узел Wafer-Scale Backpack, подсистема питания и IO-подсистема. Такая архитектура упрощает производство, развёртывание, обслуживание и обновление. Отмечается, что Cerebras полностью переосмыслила концепцию ИИ-сервера. В общей сложности в составе CS-4 задействованы три узла Wafer-Scale Backpack, каждый из которых представляет собой автономную сборку с ускорителем, преобразователем питания, прямым жидкостным охлаждением, компонентами высокоскоростного ввода-вывода и управляющей электроникой.

Питание подводится вплотную к чипам (всего около 0,5 мм против 50 мм в традиционных платах с GPU), что почти полностью исключает потери на уровне платы и позволяет подавать больше мощности, повышая частоту работы и скорость генерации токенов. Специальный IO-модуль позволяет соединять пластины WSE-3 Turbo внутри стойки и между стойками без коммутатора: в результате заявленная задержка передачи данных между пластинами находится на уровне всего 2 мкс. Общее быстродействие достигает 750 Пфлопс в разреженных FP16-вычислениях.

В целом, новинка обеспечивает высочайшую производительность. В качестве примера приводится тест на модели GPT-OSS-120B, где система CS-4 показала результат более 4400 токенов в секунду на одного пользователя. Для сравнения, «наиболее производительный на сегодняшний день сервис ИИ-инференса на базе GPU» демонстрирует показатель в 350 токенов в секунду. Утверждается также, что CS-4 выдаёт свыше 1000 токенов в секунду на моделях с более чем 10 трлн параметров. Поставки системы планируется организовать в текущем квартале.

Постоянный URL: http://servernews.ru/1147059

Входит в перечень общественных объединений и религиозных организаций, в отношении которых судом принято вступившее в законную силу решение о ликвидации или запрете деятельности по основаниям, предусмотренным Федеральным законом от 25.07.2002 № 114-ФЗ «О противодействии экстремистской деятельности»;