Материалы по тегу: ии

22.09.2026 [00:50], Владимир Мироненко

Новая экспериментальная модель «Яндекса» Alice AI Foundation LLM опережает по возможностям зарубежные аналоги

«Яндекс» предоставила открытый доступ к Alice AI Foundation LLM (AliceAI-Foundation-80B-A3B-Base) — новую, созданную с нуля предобученную LLM с архитектурой MoE (Mixture of Experts). Модель носит экспериментальный характер и включает 80 млрд параметров, из которых при обработке токена активны только 3 млрд, что позволяет увеличить скорость и задействовать меньше вычислительных ресурсов. Модель предоставляется под лицензией Apache 2.0, т.е. допускает её использование в коммерческих целях.

В модель заложены способности к рассуждению и работе в агентных сценариях, благодаря чему она показывает высокую эффективность в сложных логических заданиях и программировании. Например, в решении олимпиадных задачах по математике она делит лидерство с Qwen3.5-35B-A3B-Base, а в тестах на написание кода превзошла модель NVIDIA Nemotron-3-Super-120B-Base, хотя у неё в четыре раза меньше активных параметров. В задачах, где нужны широкие фактические знания, Alice AI Foundation опережает более крупные открытые модели — например, DeepSeek-V4-Flash-Base с 284 млрд параметров и 13 млрд активных.

Согласно бенчмаркам для оценки знания фактов, новая модель не уступает предыдущей закрытой модели Яндекса Alice AI LLM, у которой в три раза больше общих параметров и в семь раз больше активных. Для оценки знаний модели, актуальных для русскоязычных пользователей, компанией были разработаны два собственных бенчмарка WikiWebFacts и HardMultiQA, поскольку англоязычные бенчмарки не позволяют оценить объективно её русскоязычные знания.

 Источник изображения: Igor Omilaev/unsplash.com

Источник изображения: Igor Omilaev/unsplash.com

WikiWebFacts нацелен на проверку знания дат, определений, событий и персоналий на основе материалов онлайн-энциклопедий и частотных агрегированных поисковых запросов. HardMultiQA охватывает более редкие области знаний: от медицины и права до IT и искусства, предлагая выбрать несколько верных вариантов из списка, перечислить сразу несколько фактов, подходящих под условие вопроса, или найти фактическую ошибку в тексте.

При обучении модели разработчики улучшили работу оптимизатора, чтобы пересылка данных между GPU шла параллельно с вычислениями. Это позволило ускорить шаги оптимизации примерно в два раза. Также была оптимизирована подготовка качественных обучающих данных. Вместо использования со старта для их отбора ресурсоёмкой модели, документы перед оценкой проходят через каскад классификаторов, и на каждом этапе более сложная и вычислительно затратная модель работает с меньшим количеством документов. Это позволило в десятки раз сократить количество вычислений, сохранив около 95 % полезных документов. Вдобавок разработчики значительно обогатили базу знаний модели в области права, медицины и математики.

Постоянный URL: http://servernews.ru/1148826
21.09.2026 [17:45], Владимир Мироненко

Британский необлачный провайдер Nscale подал заявку на IPO в США с оценкой рыночной стоимости в $35 млрд

Базирующаяся в Лондоне (Великобритания) неооблачная компания Nscale подала заявку в Комиссию по ценным бумагам и биржам США (SEC) на проведение первичного публичного размещения акций (IPO) на Нью-Йоркской фондовой бирже с оценкой рыночной стоимости до $35 млрд, сообщила газета The Financial Times.

В рамках листинга Nscale запустит розничное предложение для британских инвесторов, которое позволит им приобретать акции по той же цене, что и существующие акционеры, через инвестиционную платформу RetailBook, сообщают источники газеты, знакомые с ситуацией. На данный момент Nscale работает с убытками, которые в I половине года составили $1,02 млрд, что почти в три раза больше, чем за аналогичный период прошлого года. Выручка компании за полугодие выросла более чем на 1250 % до $140,6 млн.

В прошлом месяце британская компания заключила соглашение с Anthropic об аренде мощностей флагманского ЦОД в Западной Вирджинии на сумму до $44,6 млрд на шесть лет. Anthropic получит доступ к 460 МВт в первом ЦОД кампуса Monarch, общая мощность которого на момент полного ввода в эксплуатацию составит 1,35 ГВт. По словам Nscale, у компании есть «чёткий план расширения мощностей до более чем 8 ГВт», пишет SiliconANGLE. Попутно разработчик человекоподобных роботов Figure AI заявил о намерении арендовать у Nscale до 100 тыс. GPU. В рамках сделки Nscale приобретает долю в стартапе.

 Источник изображения: Nscale

Источник изображений: Nscale

По оценкам Nscale, строительство дата-центра, который планируется ввести в эксплуатацию в конце следующего года, обойдётся примерно в $70 млрд, включая строительство электростанции на природном газе мощностью 2 ГВт для обеспечения его работы. Компания также работает над 11 другими проектами по созданию ЦОД с ещё 1,3 ГВт мощностей для выполнения контрактов на сумму $101 млрд.

Nscale сообщила, что на конец августа она располагала 7 МВт активных вычислительных мощностей в пяти собственных ЦОД в Ирландии, Норвегии и Португалии, а ещё 48 МВт — в арендованных дата-центрах по контрактам на сумму $2,6 млрд. На данный момент Nscale развернула 25 тыс. GPU в своей сети ЦОД. Кроме того, в её распоряжении имеется «461 000 активных и арендованных GPU», которые помогут удовлетворить будущий спрос со стороны клиентов.

Nscale в марте привлекла $2 млрд при оценке в $14,6 млрд в рамках раунда финансирования серии С, организованного норвежской энергетической группой Aker и 8090 Industries при поддержке NVIDIA, Dell, Nokia и других компаний. По данным Dealroom, перед выходом на IPO компания привлекла в общей сложности $3,7 млрд в виде акционерного капитала и более $5 млрд в виде заёмных средств. Компания не будет полагаться исключительно на IPO для финансирования своих проектов. Согласно проспекту эмиссии, компания недавно выпустила конвертируемые облигации на сумму $3,1 млрд.

В проспекте эмиссии подчёркивается важность её отношений с NVIDIA — поставщиком ускорителей, её клиентом и финансовым покровителем. NVIDIA заключила с Nscale сделку на сумму $1,2 млрд на аренду мощностей и инвестировала в Nscale более $2 млрд, в том числе $1 млрд в конвертируемые облигации. Компания также отдельно дала гарантию на обязательства Nscale по аренде мощностей на сумму $860 млн на объекте в Техасе.

Следует отметить, что призывы лидеров ИИ-отрасли к замедлению темпов развития ИИ из-за рисков для безопасности спровоцировали распродажу акций компаний, занимающихся ИИ-инфраструктурой и производством полупроводников на фоне опасений, что крупные технологические компании сократят капиталовложения в ЦОД. Из-за этого компания Holtec International, занимающаяся ядерной энергетикой, в среду отменила запланированное IPO. Nscale планирует провести IPO, делая ставку на то, что интерес инвесторов к проектам в сфере вычислительной инфраструктуры не угаснет, несмотря на подобные призывы.

Nscale ожидает значительного увеличения прибыли по мере роста мощности и выручки от ЦОД. Это связано с тем, что такие статьи расходов, как проектирование, останутся в основном неизменными. «По мере того как развёрнутые по контрактам системы будут полностью введены в эксплуатацию и достигнут стабильного уровня использования, мы ожидаем, что маржинальность стабилизируется на более высоком уровне», — говорится в проспекте IPO.

Постоянный URL: http://servernews.ru/1148801
21.09.2026 [17:04], Руслан Авдеев

CoreWeave стала клиентом оператора криптомайнинговых ЦОД Blockfusion в Ниагара-Фолс

Предлагающая оптимизированные для криптомайнинга ЦОД компания Blockfusion подписала соглашение с облачной ИИ-компанией CoreWeave. Последняя станет клиентом её ЦОД на территории кампуса North East Data в Ниагара-Фолс (шт. Нью-Йорк), сообщает Datacenter Dynamics. Соответствующие данные обнародовала специальная SPAC-компания Blue Acquisition Corp., присутствующая на NASDAQ — идёт процедура её слияния с Blockfusion.

Договор заключён на 15 лет с возможностью дважды продлить его ещё на 5 лет. В июне было объявлено о подписании необязывающего письма о намерениях. На тот момент Blockfusion заявляла, что в общей сложности клиент получит до 300 МВт мощности, в т.ч. 85 МВт будет гарантировано по принципу take-or-pay. Ранее Blockfusion заявляла, что только 85 «гарантированных» мегаватт могут принести порядка $2,8 млрд выручки за первые 15 лет, если договор продлят дважды, он принесёт до $5 млрд.

По словам Blockfusion, компания превращает бывшую производственную площадку в Ниагара-Фолс в инфраструктуру для вычислений нового поколения, способную стать центром «технологического притяжения» региона в долгосрочной перспективе. Ранее Blockfusion уже переоборудовала прекратившую работу электростанцию в кампус для криптомайнинга, теперь она адаптирует объект для использования высокоплотной ИИ-инфраструктуры с жидкостным охлаждением.

 Источник изображения: Rafik Wahba/unsplash.com

Источник изображения: Rafik Wahba/unsplash.com

CoreWeave строит и собственные площадки для ИИ-вычислений, но в основном компания полагается на сторонних операторов дата-центров. В частности, в Северной Америке она арендует мощности у Core Scientific (едва не купив её), Galaxy Digital, Related Digital, Applied Digital, Chirisa Technology Parks, Lincoln, Flexential, TierPoint, Digital Realty, DataBank, Switch, Digital Crossroads, eStruxture, Bell Canada и др. В числе ключевых клиентов CoreWeave — крупнейшие компании рынка ИИ, включая OpenAI, Microsoft, IBM, NVIDIA и Meta.

Предоставляющая облачные услуги для ИИ компания перешла от сдачи в аренду мощностей криптомайнерам к сдаче ИИ-компаниям, включая бизнесы Core Scientific, Applied Digital и Galaxy. По словам мэрии Ниагара-Фолс, в конечном счёте инвестиции в технологии должны приность реальные выгоды местным жителям.

Постоянный URL: http://servernews.ru/1148787
21.09.2026 [13:53], Сергей Карасёв

Huawei представила архитектуру UnifiedBus для повышения производительности ИИ-кластеров

Huawei объявила о разработке архитектуры интерконнекта нового поколения UnifiedBus (UB). Технология призвана решить проблемы скорости передачи данных в крупномасштабных вычислительных кластерах, ориентированных на ресурсоёмкие задачи ИИ.

В традиционных системах для ЦОД эффективность использования ресурсов снижается по мере масштабирования платформы. Так, в кластере из 100 тыс. NPU фактически задействуется всего около 20 % доступной вычислительной мощности, в то время как оставшиеся ресурсы простаивают в ожидании данных, утверждает Huawei. Обучение модели с триллионами параметров требует передачи колоссальных объёмов промежуточных сведений, а современные ИИ-агенты регулярно генерируют запросы, создавая постоянную нагрузку на коммуникационные линии.

Всё это приводит к необходимости гибкого перераспределения меняющейся нагрузки между CPU и NPU. Кроме того, резко возрастают требования к хранению данных на всех уровнях вычислительных платформ. В результате, недостаточная пропускная способность интерконнекта становится главным узким местом, ограничивающим производительность современных ИИ-кластеров.

 Источник изображения: Huawei

Источник изображения: Huawei

Архитектура UnifiedBus позволяет устранить существующие недостатки, объединив более десяти различных протоколов и увеличив общую пропускную способность интерконнекта с примерно 100 Гбайт/с до уровня в несколько Тбайт/с, тогда как задержка (RTT) уменьшается с 7 до 2 мкс. Новая архитектура также предусматривает единую глобальную адресацию памяти внутри ИИ-узлов SuperPoD. Помимо этого, UnifiedBus напрямую соединяет CPU, NPU, RAM и SSD, обеспечивая децентрализованную одноранговую связь между ними и гибкое распределение имеющихся ресурсов.

В рамках концепции UnifiedBus чипы DDR выступают в качестве альтернативной памяти для NPU, снижая задержки для поисковых, рекомендательных и других сервисов, а также удваивая производительность векторного поиска. При этом сокращаются требования к ёмкости HBM в составе ИИ-ускорителей. В целом, UnifiedBus служит глобальной «магистралью данных» со сверхвысокой пропускной способностью и малой задержкой, обеспечивая гибкое масштабирование вычислительных ресурсов.

Специальный модуль интерконнекта UnifiedBus LinkBlade с бескабельным дизайном обеспечивает высокоскоростную связь внутри стоек вычислительного кластера. Утверждается, что в составе SuperPoD с 4096 NPU применение LinkBlade позволяет сэкономить около 196 км медных соединений. Для обмена данными между отдельными стойками решение UnifiedBus LinkDevice предлагает 176 портов с пропускной способностью 1,6 Тбит/с каждый, обеспечивая полностью оптическое соединение со скоростью 280 Тбит/с. При этом могут формироваться кластеры с миллионами NPU.

Huawei продемонстрировала суперкластер для работы с агентным ИИ на базе UnifiedBus, который состоит из узлов SuperPoD TaiShan 950 и Atlas 960, хранилища данных OceanStor M900 и коммутатора Xinghe UBG. Эта платформа поддерживает многоуровневое объединение ресурсов, обеспечивая эффективную работу с различными нагрузками.

Постоянный URL: http://servernews.ru/1148789
20.09.2026 [20:32], Руслан Авдеев

Крупнейший в мире рынок ЦОД притормаживает развитие

Штат Вирджиния (США) является крупнейшим в мире хабом для дата-центров, но скоро рост ЦОД там может замедлиться. Местный губернатор Эбигейл Спанбергер (Abigail Spanberger) подписала указ, ужесточающий правила строительства и эксплуатации ЦОД в штате, сообщает The Register.

По словам Спанбергер, до её прихода к власти у штата не было чёткого, скоординированного плана по нейтрализации негативного воздействия дата-центров на местных жителей. Теперь ситуация изменилась. Новый указ — лишь часть более масштабной политики, направленной на повышение ответственности операторов ЦОД, предусматривающей большую прозрачность, запрет заключения соглашений о неразглашении (NDA) с местными властями, ограничение на выдачу разрешений для дата-центров и ужесточение экологических требований.

По словам Спанбергер, в действующей политике отсутствовал ряд конкретных требований для возможного привлечения строителей ЦОД к ответственности. Кроме того, проекты ЦОД мощностью более 25 МВт не будут получать разрешения в ускоренном порядке. Также указ призывает государственные органы разработать параметры оценки, позволяющие отличать ответственные ЦОД от «безответственных», способных негативно сказаться на местных жителях и окружающей среде.

 Источник изображения: Jamie Street/unsplash.com

Источник изображения: Jamie Street/unsplash.com

Дополнительно указ ограничит использование требующих много воды градирен в районах с дефицитом водных ресурсов. Также он будет поощрять операторов ЦОД модернизировать резервные генераторы для сокращения вредных выбросов либо переходить на аккумуляторные хранилища, топливные ячейки и прочие источники «зелёной» энергии. Указ подписан всего через несколько дней после того, как власти округа Лаудон (Loudoun) поддержали план приостановки окончательных решений и электроподстанций по некоторым заявкам на строительство ЦОД на 12 мес. Именно в этом округе концентрация ЦОД максимальна.

Сопротивление строительству дата-центров нарастает на всей территории Соединённых Штатов. Это происходит на фоне роста опасений относительно их влияния на качество воздуха, шумовое загрязнение, потребление водных ресурсов, а также влияния на рост счетов за электричество. Например, кампус ЦОД Colossus 2 Илона Маска (Elon Musk) в Теннесси питается от газовых турбин, расположенных по ту сторону границы штата в Миссисипи, теперь из-за этого подан иск НКО NAACP о нарушении Закона о чистом воздухе (Clean Air Act).

Тем временем в июле Нью-Йорк стал первым штатом, приостановившим строительство ЦОД мощнее 50 МВт. Месяцем позже в Пенсильвании губернатор Джош Шапиро (Josh Shapiro) издал указ, блокирующий заявки на строительство ЦОД, если подающие их не берут на себя юридические обязательства по соблюдению требований губернаторской программы Responsible Infrastructure Development (GRID). Ограничения ввели и в Техасе.

Постоянный URL: http://servernews.ru/1148768
20.09.2026 [02:14], Владимир Мироненко

Anthropic и OpenAI переключились на аренду небольших ИИ ЦОД

Anthropic и OpenAI прорабатывают варианты заключения сделок по аренде мощностей в небольших дата-центрах с целью расширения ИИ-инфраструктуры на фоне усиления дефицита, сообщил ресурс CNBC со ссылкой на источники. По словам инсайдеров, обе компании заключили за последний год крупные соглашения об использовании дата-центров мощностью в сотни мегаватт и даже гигаватты, но теперь они также проявляют интерес к сделкам на 20–30 МВт.

В частности, Anthropic изучала возможность заключения соглашений такого масштаба в Великобритании и странах Северной Европы, а OpenAI также рассматривала варианты развёртывания мощностей меньшего объёма в странах Северной Европы. Один из источников сообщил о переговорах с участием Anthropic и OpenAI по поводу развёртывания вычислительных мощностей аналогичного масштаба в США. Такие сделки позволяют компаниям быстрее запускать рабочие нагрузки в условиях бума ИИ-технологий.

«Мы формируем диверсифицированный портфель вычислительных мощностей, чтобы удовлетворить растущий спрос на ИИ во всём мире», — заявил представитель OpenAI ресурсу CNBC. Он пояснил, что разные рабочие нагрузки требуют использование разной инфраструктуры, поэтому компания ведёт переговоры с широким кругом партнёров и оценивает возможности, исходя из своих требований, а также показателей производительности, надёжности, сроков реализации и стоимости.

 Источник изображения: Crusoe

Источник изображения: Crusoe

Обе компании обычно арендуют вычислительные мощности у операторов дата-центров и неооблаков, отдавая предпочтение масштабным долгосрочным соглашениям. В августе стало известно о сделке Anthropic с Nscale по поводу аренды мощностей в строящемся ЦОД в Западной Вирджинии на 460 МВт. OpenAI заявила, что ещё в апреле превысила первоначальный план по выделению 10 ГВт мощности для своего инфраструктурного проекта Stargate, и уже после этого взяла на себя обязательства по обеспечению дополнительных 3 ГВт мощностей в Джорджии и 8 ГВт в Огайо.

Масштабные проекты по строительству ЦОД в США и других странах всё чаще сталкиваются с противодействием со стороны местных жителей. Также во многих регионах Европы наблюдается дефицит свободных земельных участков и энергетических мощностей для развёртывания ЦОД.

По словам Structure Research, привлекательность сделок относительно меньших вычислительных мощностей заключается в том, что они позволяют быстрее получить доступ к готовой инфраструктуре: «Получить доступ к нескольким мегаваттам на уже подключенном к энергосети объекте может быть практичнее, чем ждать выделения гораздо большего блока мощностей в одной локации. Для рабочих нагрузок, способных функционировать на разрозненных площадках, совокупность небольших объектов может в итоге обеспечить значительный объём мощностей».

 Источник изображения: Crusoe

Источник изображения: Crusoe

Обучение моделей ИИ требует огромных вычислительных ресурсов для обработки колоссальных массивов данных, но инференс может осуществляться с использованием более компактных кластеров чипов. По словам Тана, многие задачи инференса позволяют обрабатывать отдельные запросы на разрозненных небольших кластерах. При этом всё большая часть вычислительных ресурсов ИИ перенаправляется от обучения ИИ-моделей к их непосредственной эксплуатации.

По оценкам JLL, к 2027 году доля мощностей ЦОД, используемых для инференса, должна превысить долю мощностей, выделяемых для обучения моделей. В 2025 году на инференс приходилось 9 % от общего объёма рабочих нагрузок в глобальных ЦОД, тогда как на обучение — 14 %. К 2030 году, как ожидается, на инференс будет приходиться 37 % этих мощностей, а на обучение моделей — лишь 13 %.

В феврале сообщалось о планах NVIDIA начать сотрудничать с рядом участников рынка ЦОД для изучения возможностей создания небольших объектов, предназначенных для распределённого инференса. Напомним, что Crusoe, построившая крупный комплекс дата-центров Stargate в Абилине (Abilene, Техас), используемый OpenAI, теперь инвестирует в создание более компактных ЦОД, на развёртывание которых уходит меньше времени, и этот процесс обходится гораздо дешевле запуска крупных комплексов, строительство которых сейчас сталкивается с задержками на всей территории США.

Постоянный URL: http://servernews.ru/1148758
19.09.2026 [16:07], Сергей Карасёв

До 64 Пбайт для KV-кеша: Huawei представила платформу хранения OceanStor M900 для ИИ ЦОД

Huawei представила платформу OceanStor M900, спроектированную для работы с KV-кешем в крупномасштабных дата-центрах. Новинка позволяет решить проблему нехватки DRAM, которая создает «бутылочное горлышко» в современных ИИ-кластерах.

Отмечается, что в настоящее время в сфере ИИ наблюдается переход от технологических экспериментов к широкомасштабному внедрению. Приложения ИИ эволюционировали от чат-ботов до агентов, способных автономно выполнять сложные задачи. Большие языковые модели (LLM) нового поколения могут насчитывать до 10 трлн параметров. Современные системы с огромными контекстными окнами (более 1 млн токенов) и многошаговые ИИ-агенты генерируют колоссальные объёмы KV-кеша, для обработки которого ресурсов HBM и DRAM недостаточно. Платформа OceanStor M900 помогает преодолеть эти ограничения путём использования высокоскоростных SSD.

По заявлениям Huawei, в OceanStor M900 впервые в отрасли применена передовая архитектура, объединяющая CPU, сетевой контроллер и контроллер NAND. Она обеспечивает собственную KV-семантику для одношагового соединения ИИ-ускорителей в составе узлов SuperPoD с твердотельными накопителями. Это устраняет необходимость применения различных протоколов, благодаря чему задержка доступа сокращается на 90 % по сравнению с традиционными подходами — с нескольких миллисекунд до 60 мкс. Один кластер обеспечивает суммарную пропускную способность до 40 Тбайт/с, что в 1,5 раза выше, чем у существующих решений. При этом объём памяти, доступной для каждого нейропроцессора (NPU), увеличивается с гигабайт до терабайт.

 Источник изображения: Huawei

Источник изображения: Huawei

Платформа OceanStor M900 использует высокоскоростной интерконнект UnifiedBus. Общая вместимость может достигать 64 Пбайт. В системе реализована технология адаптивного хранения (KV-Aware Adaptive Storage), которая прогнозирует жизненный цикл KV-кеша и перераспределяет нагрузку между SSD для достижения максимальной эффективности и надёжности. В результате, показатель DWPD (полных перезаписей в сутки) для установленных SSD поднимается до 24, что в 16 раз превосходит обычные значения. Благодаря этому значительно снижаются расходы на эксплуатацию, поскольку сокращается необходимость в замене дорогостоящих накопителей.

В целом, OceanStor M900 позволяет раскрыть вычислительную мощность SuperPoD-устройств, ресурсы которых в противном случае могут простаивать из-за нехватки памяти для работы с KV-кешем.

Постоянный URL: http://servernews.ru/1148740
18.09.2026 [22:36], Владимир Мироненко

IT-индустрия изменила отношение к мейнфреймам в связи с ростом инвестиций в ИИ

На фоне роста инвестиций в ИИ компании стали более избирательно подходить к замене устаревшего оборудования (например, мейнфреймов), стремясь максимально продлить срок службы устаревших ИТ-систем, пишет The Register со ссылкой на исследование State of IT Modernization 2026 компании Ensono. В рамках исследования был проведён опрос 500 руководителей ИТ-подразделений и бизнес-лидеров в США и Великобритании.

78 % респондентов–руководителей, принимающих решения в сфере ИТ, сегодня считают устаревшие системы более важными, чем два года назад, поскольку они рассматриваются как ключевой элемент для успешного внедрения ИИ в организации. Исследователи пришли к выводу, что ИИ меняет приоритеты модернизации, однако корпорации по-прежнему сталкиваются с рядом традиционных проблем, усложняющих этот процесс: превышением бюджета, задержками в реализации инициатив и нехваткой квалифицированных кадров.

По данным Ensono, 45 % компаний активно масштабируют внедрение ИИ по всем подразделениям, а 44 % инвестируют в точечные проекты, способные принести значительный эффект. Поддержка ИИ, автоматизации и передовых инициатив по работе с данными стали главными движущими силами модернизации; при этом более половины компаний отмечают, что ИИ способствует модернизации, обеспечивая более высокий уровень автоматизации и повышая эффективность работы.

 Источник изображения: IBM

Источник изображения: IBM

В числе главных препятствий для реализаций целей в области ИИ респонденты назвали трудности интеграции технологий в существующие рабочие процессы (33 %) и ограничения инфраструктуры (28 %). В связи с этим устаревшие системы приобретают новую стратегическую ценность. Почти половина организаций рассматривает их (например, мейнфреймы) как критически важную основу для ИИ и ценный источник данных, а 47 % используют такие системы выборочно для конкретных приложений на базе ИИ.

Более половины организаций Великобритании (57 % респондентов; в США меньше — 48 %) предпочитает оптимизировать и расширять возможности устаревших систем, модернизируя приложения непосредственно на существующей платформе, вместо того чтобы полностью их заменять. «Компании начинают понимать, что унаследованные системы — такие как мейнфреймы — представляют собой невероятно мощные, надёжные и эффективные вычислительные ресурсы, которые теперь, благодаря ИИ, можно дополнить новыми возможностями и сделать более гибкими», — пишет Ensono.

Отмечается, что в этих системах сосредоточены данные и бизнес-логика, накопленные за десятилетия и обеспечивающие работу многих компаний. Преимущество получат те организации, которые достаточно хорошо разбираются в своей ИТ-среде, чтобы отличить элементы, подлежащие замене, от тех, которые стоит лишь дополнить, а также готовы внедрять новые методы модернизации, недоступные ещё полтора года назад, подчеркнули аналитики.

 Источник изображения: IBM

Источник изображения: IBM

Ещё два года назад компания Kyndryl заявила, что мейнфреймы могут служить фундаментом для развёртывания ИИ-систем. Исследования показали, что мощные мейнфреймы становятся отличной платформой для выполнения задач ИИ, и их всё чаще интегрируют с современной инфраструктурой. При этом часть рабочих нагрузок с мейнфреймов может переноситься на другие системы при одновременной модернизации оставшихся задач непосредственно на платформе, чтобы продолжать пользоваться преимуществами её безопасности и надёжности. Ранее в этом году в Gartner отметили, что для пользователей VMware перенос рабочих нагрузок на мейнфрейм — более рациональное решение, чем переход на новые условия лицензирования от Broadcom.

По словам управляющего директора HPE в Великобритании, на Ближнем Востоке и в Африке, корпоративные клиенты предпочитают дольше эксплуатировать имеющиеся ИТ-ресурсы, в частности, продлевая циклы обновления оборудования с пяти до семи лет: «Полагаю, мы наблюдаем тенденцию к более раннему планированию критически важных проектов. Многие клиенты заглядывают гораздо дальше в свои планы расходов и оценивают предстоящие задачи — например, в связи с прекращением поддержки определённых технологий или истечением срока аренды площадей в дата-центре. Таким образом, перед ними встаёт выбор: приостановить процесс и продлить срок службы оборудования или же двигаться вперёд, так как это необходимо. Думаю, это заставляет клиентов кардинально пересматривать свои подходы».

Постоянный URL: http://servernews.ru/1148712
18.09.2026 [17:42], Сергей Карасёв

ИИ-ускорители Huawei Ascend 960DT с 288 Гбайт памяти выйдут в начале 2027 года

Huawei поделилась планами по выпуску новых ИИ-ускорителей Ascend. Сообщается, что в I квартале следующего года дебютирует изделие Ascend 960DT, которое придёт на смену Ascend 950. В состав 960DT (аббревиатура расшифровывается как Decode/Training — декодирование/обучение) войдут 288 Гбайт памяти с пропускной способностью 9,6 Тбайт/с — в 2,4 раза больше по сравнению с Ascend 950. При этом сетевые источники указывают на использование памяти HiZQ — собственного решения Huawei, позиционирующегося в качестве альтернативы НВМ. Пропускная способность интерконнекта Ascend 960DT составит 2,2 Тбайт/с.

Для нового ускорителя заявлена поддержка форматов FP32, HF32, FP16, BF16, FP8, MXFP8, HiF8, MXFP4 и HiF4. ИИ-производительность в режиме FP8 будет достигать 2 Пфлопс, в режиме FP4 — 4 Пфлопс. В один кластер могут объединяться тысячи таких изделий для масштабирования быстродействия. В частности, посредством NPO могут быть связаны до 4096 эксземпляров Ascend 960DT, что обеспечит суммарную FP4-производительность на уровне 16 Эфлопс.

 Источник изображения: wccftech.com

Источник изображения: wccftech.com

На III четверть 2027 года намечен анонс карты Ascend 960PR (Prefill/Recommenders — заполнение/рекомендации). Она будет нести на борту 192 Гбайт памяти с пропускной способностью 2,4 Тбайт/с (скорость интерконнекта сохранится на уровне 2,2 Тбайт/с). Это решение обеспечит быстродействие до 2 Пфлопс на операциях FP8 и до 8 Пфлопс в режиме FP4.

В 2028 году, как ожидается, появится ускоритель Ascend 970 с 288 Гбайт памяти с пропускной способностью 14,4 Тбайт. У данной модели пропускная способность интерконнекта поднимется до 4,4 Тбайт/с. Производительность FP8 и FP4 — до 3,6 и 14 Пфлопс соответственно. Наконец, на 2029-й запланирован выпуск изделия Ascend 980 с 384 Гбайт памяти (38,4 Тбайт/с) и интерконнектом на 8 Тбайт/с. Карта сможет выдавать 7,2 Пфлопс на операциях FP8 и 28 Пфлопс в режиме FP4.

Постоянный URL: http://servernews.ru/1148714
18.09.2026 [17:40], Владимир Мироненко

Вглубь и вширь: Cornelis анонсировала архитектуру Active Compute Fabric

Cornelis представила Active Compute Fabric — открытую архитектуру, охватывающую сетевые системы класса scale-up (вертикальное масштабирование) и scale-out (горизонтальное масштабирование) и включающую встроенные средства программируемых вычислений.

В настоящее время ИИ-кластеры выросли до многих тысяч GPU. Количество параметров в моделях увеличилось с миллиардов до триллионов. Однако фундаментальное поведение большинства сетей ЦОД не эволюционировало так быстро — они в основном перемещают данные из точки А в точку Б, обеспечивая максимально надёжную передачу.

Современные рабочие ИИ-нагрузки не всегда ведут себя как традиционные HPC и другие распределённые приложения. В них доминируют синхронизация, коллективные операции и зависимости, а также значительный трафик между серверами (east-west). Когда сеть не справляется с огромными требованиями к пропускной способности таких рабочих нагрузок, ускорители часто простаивают, иногда в течение длительного времени.

Проблему простоя поставщики пытаются решить преимущественно за счёт увеличения пропускной способности, а не изменения принципов работы самой сетевой инфраструктуры. «ИИ-инфраструктура достигла того этапа, когда одного лишь повышения быстродействия конечных узлов уже недостаточно. Сетевая фабрика должна стать активным компонентом вычислительной системы», — заявила Лиза Спелман (Lisa Spelman), генеральный директор Cornelis.

 Источник изображений: Cornelis Networks

Источник изображений: Cornelis Networks

Архитектура Active Compute Fabric переносит программируемые вычислительные функции непосредственно на уровень сети. Сетевая фабрика может производить манипуляции над данными прямо во время передачи: собирать данные KV-кеша для дезагрегированного инференса, координировать распределение экспертов для моделей MoE, ускорять коллективные операции, такие как AllReduce, и сжимать градиенты при передаче, разгружая вычислительные узлы, уменьшая накладные расходы на синхронизацию и отвечая за целостность передачи данных. При этом она может брать на себя новые функции по мере развития алгоритмов ИИ и ПО. Нечто похожее, например, NVIDIA начала предлагать в InfiniBand несколько поколений назад (SHARP), но, по слухам, данная функциональность особой популярностью не пользуется.

Cornelis опирается на открытые Ethernet-стандарты UALink для вертикального масштабирования и Ultra Ethernet — для горизонтального, что даёт поддержку широкого спектра ускорителей. Это важный фактор, поскольку компании всё больше диверсифицируют оборудование и технологии, используемые в своих ЦОД. Клиенты, использующие решения для ИИ, всё чаще обращаются к решениям стоечного масштаба, сталкиваясь при этом с проблемой привязки к конкретному поставщику, а Cornelis позиционирует себя как нейтральная, открытая альтернатива. Это явный кивок в сторону NVIDIA, хотя тот же UALink пока трудно назвать действительно зрелой технологией.

Видение Cornelis по поводу открытых и эффективных сетей, масштабируемых по принципу «масштабирование и расширение», разделяет Qualcomm, которая присоединилась к Cornelis на конференции AI Infra Summit. Cornelis отметила, что обе компании разделяют общее видение проблем, стоящих перед ИИ-инфраструктурой: использование пассивных сетевых архитектур, обеспечивающих лишь передачу данных, приводит к недогрузке вычислительных ускорителей, что напрямую сказывается на экономической эффективности процессов инференса. По мере перехода к созданию ИИ-систем стоечного масштаба, обе компании рассматривают сеть как ключевой элемент проектирования, а не как второстепенный компонент.

Лиза Спелман отдельно отметила в интервью CRN схожесть подходов с Qualcomm: «Мы видим много общего в отношении проблем инфраструктуры ИИ, проблем, с которыми сталкиваются клиенты, и множество возможностей и потенциала для объединения наших технологий и решения этих проблем для клиентов <…> Мы считаем, что сейчас идеальное время для выхода на этот рынок. Ещё многое предстоит решить», — сказала Спелман.

Как отметил CRN, проблема для Cornelis заключается в том, что NVIDIA более года продвигает свою собственную технологию интерконнекта NVLink Fusion как де-факто интерконнект для вертикального масштабирования. К альянсу уже присоединились Qualcomm, Arm, Marvell, Amazon, Fujitsu, Ayar, SiFive, Intel, d-Matrix и MediaTek. Это позволяет NVIDIA оставаться важнейшим поставщиком для рынка ИИ-инфраструктуры и открывает новый источник дохода.

Cornelis также объявила о привлечении финансирования в размере $205 млн. Средства будут направлены на масштабирование производства, укрепление партнёрских отношений с клиентами и ускорение реализации планов по выводу продукции на рынок. Ресурс Forbes считает, что для компании в сегменте HPC-сетей такой уровень инвестиций значителен и свидетельствует о том, что рынок считает проблему узкого места в сетевых технологиях реальной, и что Cornelis продемонстрировала достаточный прогресс благодаря текущим внедрениям в ЦОД для ИИ и HPC, чтобы оправдать дальнейшее расширение.

«Потенциал рынка сетевых решений на базе открытых стандартов для масштабирования ИИ (как вертикального, так и горизонтального) к 2030 году превысит $55 млрд. Мы убеждены, что именно сетевая инфраструктура будет определять, какая часть инвестиций в развёртывание систем ИИ принесёт реальную отдачу», — заявили в IAG Capital Partners.

Постоянный URL: http://servernews.ru/1148561

Входит в перечень общественных объединений и религиозных организаций, в отношении которых судом принято вступившее в законную силу решение о ликвидации или запрете деятельности по основаниям, предусмотренным Федеральным законом от 25.07.2002 № 114-ФЗ «О противодействии экстремистской деятельности»;