Материалы по тегу: ии
|
31.08.2026 [15:52], Андрей Крупин
В российской серверной ОС SelectOS прописалася ИИ-агент AishПровайдер Selectel объявил о запуске Aish — специализированного агента искусственного интеллекта, интегрированного непосредственно в серверную операционную систему SelectOS. Решение доступно бесплатно всем пользователям платформы. На рынке системного администрирования сегодня доминируют облачные нейросети, которые требуют передачи контекста сессии внешним провайдерам, что создаёт риски утечки данных и лишает организации возможности аудита действий ИИ-модели, говорит Selectel. В отличие от них, Aish развёрнут локально на серверах Selectel или собственном оборудовании клиента. Модель физически находится внутри защищённого периметра, а каждое действие агента подтверждается оператором перед исполнением.
Источник изображения: selectel.ru ИИ-агент Aish понимает команды на естественном языке, интерпретирует их и переводит в исполняемый формат. Он способен выполнять цепочки действий, собирать диагностические данные, находить причины сбоев и предлагать исправления с учётом конкретного состояния сервера. Решение может использоваться для анализа состояния сервисов, логов и конфигурационных файлов, разбора инцидентов, поиска причин отказа сервисов и выполнение рутинных операций без обращения к документации. Агент формирует командные инструкции, объясняет их действие, но финальный запуск выполняет только оператор.
31.08.2026 [09:38], Сергей Карасёв
Primemas представила модули расширения CXL с поддержкой 4 Тбайт DRAMКомпания Primemas анонсировала CXL-решения, предназначенные для расширения памяти в ИИ-системах. Кроме того, объявлено о партнёрстве с Micron в рамках проекта Abaco. В частности, дебютировали модули CXL, выполненные в виде карт расширения с интерфейсом PCIe. Изделия PMA14 и PMA16 оснащены соответственно 14 и 16 слотами RDIMM, что позволяет использовать до 3,5 и 4 Тбайт памяти DRAM (при установке изделий на 256 Гбайт). Применяется фирменная архитектура Primemas Hublet, которая даёт возможность формировать пулы памяти CXL огромной ёмкости.
Источник изображения: Primemas Новые CXL-модули станут частью платформы Abaco — стоечной вычислительной системы с более чем 100 Тбайт памяти. Этот комплекс создаётся для Тихоокеанской северо-западной национальной лаборатории (PNNL) Министерства энергетики США (DoE). Предполагается, что Abaco будет использоваться для решения сложных задач в области ИИ и НРС, а также для обработки огромных массивов информации. Проект финансируется управлением научных исследований DoE в рамках программы перспективных научных вычислений (ASCR). Отмечается, что Abaco поможет решить проблему нехватки памяти в современных ИИ-инфраструктурах, когда GPU-ускорители вынуждены простаивать в ожидании данных для обработки. Ещё одним решением Primemas является SLiM (Switchless Pooled Memory) — новая архитектура памяти, оптимизированная для рабочих нагрузок ИИ с интенсивным использованием KV-кеша. Эта система типоразмера 1U позволяет нескольким серверам получать доступ к десяткам терабайт общей DRAM со сверхнизкой задержкой, без необходимости внешних коммутаторов CXL.
30.08.2026 [18:02], Руслан Авдеев
Сингапур нашёл 200 МВт новых мощностей для ЦОД, но это только начало более крупного ИИ-проектаАгентство экономического развития Сингапура (Economic Development Board, EDB) объявило о выделении порядка 200 МВт новых мощностей для ЦОД Digital Realty, Equinix, Keppel Data Centres и STT GDC на острове Джуронг (Jurong), сообщает eWeek. По предварительным данным, каждой компании выделено по 50 МВт в рамках программы Data Centre – Call for Application (DC-CFA2). Благодаря этому решению Сингапур сможет нарастить инфраструктуру для облачных и HPC-нагрузок — важную роль в гонке ИИ всё чаще играют не только ИИ-модели и чипы, но и доступ к электричеству, охлаждению, сетевой инфраструктуре и земле. По мнению экспертов, новые 200 МВт — лишь часть более масштабной инфраструктурной стратегии страны. У неё уже есть более 70 ЦОД совокупной мощностью около 1,4 ГВт. При этом потенциал для роста есть. На Джуронге около 20 га зарезервировано под «низкоуглеродный» кампус ЦОД мощностью до 700 МВт. STT GDC испытывает в Наньянском технологическом университете (Nanyang Technological University) в ЦОД FutureGrid Accelerator LVDC-систему для сверхплотных стойек мощностью более 1 МВт, такие системы очень востребованы в условиях дефицита свободных участков. Другими словами, Сингапур не просто наращивает серверные мощности, но и пытается создать оптимизированную для ИИ инфраструктурную основу, сохраняя жёсткий контроль над энергопотреблением и экоустойчивостью. Новая инициатива способствует реализации более широкой стратегии превращения Сингапура в региональный хаб для внедрения ИИ-технологий. Ранее в текущем году OpenAI обязалась инвестировать в стране более S$300 млн для учреждения своей первой лаборатории прикладных ИИ-исследований за пределами США. Это должно помочь бизнесам и правительственным организациям внедрять уже готовые ИИ-системы. Впрочем, успех всех начинаний зависит от наличия базовой инфраструктуры.
Источник изображения: K8/unsplash.com При этом Сингапур не намерен просто наращивать мощности ЦОД бесконтрольно. После ослабления моратория на новые ЦОД, введённого в 2022 году, страна придерживается избирательного подхода к строительству новых дата-центров, пытаясь как удовлетворить спрос на вычисления, так и учитывать дефицит земли, энергии и требования к экоустойчивости. Программа Green Data Centre Roadmap намерена обеспечить не менее 300 МВт дополнительных мощностей в краткосрочной перспективе, ещё 200+ МВт будут высвобождены благодаря «зелёным» энергетическим инициативам. Также в рамках программы предусмотрено повышение энергоэффективности аппаратного обеспечения и ПО ЦОД и более активное использование возобновляемой энергии. В рамках DC-CFA2 оценивались возможности компаний укрепить позиции Сингапура как надёжного хаба для инвестиций в ИИ и дата-центры, помогать инновациям и развитию кадрового потенциала, а также ускорять внедрение экобезопасной энергетики. Отобранная четвёрка участников обязалась использовать экологически чистую энергию и создавать энергоэффективную инфраструктуру в процессе реализации DC-CFA2. Для компаний, делающих ставку на развитие ИИ в Азии, решающую роль играет вопрос, какую часть потенциальных мощностей Сингапур введёт в эксплуатацию на самом деле и сможет ли попытка страны совместить массовое внедрение ИИ-мощностей с ужесточениями в области экологии. Ранее сообщалось, что Сингапур потратит свыше S$1 млрд ($786 млн) на финансирование Национального плана исследований и разработок в области ИИ (NAIRD) для укрепления государственного потенциала в соответствующей сфере. Попутно релизуется совместный проект с Малайзией, но и здесь операторы ЦОД стремительно забирают всю доступную энергию.
30.08.2026 [15:22], Руслан Авдеев
«Энергетический» стартап Emerald AI привлёк $150 млн при оценке $1,05 млрдРазрабатывающий технологии управления энергоснабжением целых ЦОД стартап Emerald AI сообщил о привлечении $150 млн. Инвесторы подали больше заявок, чем планировала привлечь компания, после завершения раунда её оценка достигла $1,05 млрд, сообщает Silicon Angle. Ранее инвесторы уже вложили в компанию более $220 млн. Нынешний раунд финансирования совместно возглавили Energize Capital и DCVC. В числе инвесторов — NVIDIA, Samsung Ventures, Siemens AG, GE Vernova, RWE AG, Aramco Ventures, Salesforce Ventures, JERA Ventures, In-Q-Tel, Radical Ventures, Energy Impact Partners, Lowercarbon Capital, Emerson Collective, Earthshot Ventures и фонд General Catalyst. 12 инвесторов Emerald входят в рейтинг Fortune Global 500, их представители входят в стратегический консультативный совет, взаимодействующий с Emerald по вопросам интеграции её продуктов. Полученные средства будут направлены на коммерческое внедрение технологии умного управления энергоснабжением по всему миру. Основной продукт компании — ПО, распределяющее нагрузки с учётом доступных АКБ и генерирующих мощностей на конкретном объекте. Когда энергосистема находится под повышенной нагрузкой, энергопотребление ЦОД снижается, но критические задачи обучения ИИ и инференса по-прежнему. На получение разрешения и строительство новых ЛЭП требуется до десяти лет, операторы ИИ ЦОД не могут ждать так долго. В Emerald полагают, что гибкое управление энергопотреблением способно высвободить более 100 ГВт в уже действующей энергосистеме Соединённых Штатов на годы раньше, чем такие объёмы энергии получили бы за счёт строительства новых электростанций. В прошлом году Emerald AI провела пять демонстраций на реальных коммерческих объектах в Аризоне, Иллинойсе, Вирджинии, Орегоне и Лондоне. Среди партнёров — NVIDIA, Oracle и National Grid, а также региональные коммунальные компании и операторы энергосетей.
Источник изображения: Emerald AI За этим последовало коммерческое внедрение технологии в Калифорнии, где один из ЦОД менял нагрузку в периоды пикового спроса на электричество. Сейчас среди клиентов Emerald — коммунальные и ИИ-компании, а также операторы ЦОД. До конца года планируется запустить ещё несколько крупных проектов. Муниципальная коммунальная компания Silicon Valley Power и Emerald создали Flexible Load Interconnection Program, в рамках которой дата-центры, готовые обеспечить подтверждённую и управляемую гибкость потребления энергии, могут подключаться к энергосетям быстрее и получать доступ к большим мощностям. Крупное испытание готовится в Манассасе (Manassas, шт. Вирджиния), где Emerald, Digital Realty Trust и NVIDIA работают над проектом Vera Rubin AI Research Factory мощностью порядка 100 МВт. Ввод в эксплуатацию запланирован до конца текущего года. В испытаниях участвуют и Dominion Energy, PJM Interconnection и Electric Power Research Institute. Впрочем, есть и альтернативные подходы — Tesla предложила запитать ЦОД от домашних аккумуляторов и электромобилей — в США насчитали 16 ГВт таких мощностей.
28.08.2026 [16:39], Руслан Авдеев
Armada представила 10-МВт модульный ЦОД OrionArmada представила свой самый мощный модульный ЦОД — 10-МВт Orion из семейства Galleon с возможностью масштабирования до 200 МВт на одном объекте. Orion впятеро мощнее Leviathan (1,77 МВт), который сам по себе был на порядок мощнее своего предшественника. Orion предназначен для включения в уже существующую инфраструктуру, с его помощью можно масштабировать распределённые проекты до сотен мегаватт на разных площадках. Продукт можно размещать совместно с распределёнными источникам энергии, включая пока не используемые или энергетические решения «за счётчиком». Каждый модуль оснащён вычислительными ресурсами, сетевым оборудованием, системами электропитания и охлаждения. Ядро из шести модулей поддерживает до 2880 ускорителей в 40 стойках. Система совместима с NVIDIA Blackwell и готова к переходу на Vera Rubin. Время готовности модулей составляет несколько месяцев вместо обычных нескольких лет. На днях Armada объявила о заключении контракта с оператором ЦОД Fossefall, действующим на территории северных стран, о внедрении модулей Leviathan совокупной мощностью более 9 МВт, поставки ожидаются к I кварталу 2027 года. Сделка оценивается в «сотни миллионов норвежских крон» и обеспечит поддержку проектов в Норвегии, Швеции и Финляндии. Fossefall заявила, что инфраструктура ИИ-ускорителей будет принадлежать ей, она же будет заниматься управлением оборудованием в модулях Leviathan. Компания заявила, что выбрала Armada по многим причинам, в том числе благодаря возможности партнёра выпускать модульные ЦОД в Европе, что обеспечит надёжные поставки и снизит зависимость от глобальные перебоев. Предполагается преобразование «чистой» энергии в высокотехнологичные ИИ-мощности с сохранением национального контроля за критически важными технологиями. Это поможет создать статью экспорта в миллиарды норвежских крон и обеспечит значительные преимущества для местной экономики.
28.08.2026 [15:11], Руслан Авдеев
SK Telecom сформировала SK Horizon для развития инфраструктуры ИИ ЦОДЮжнокорейская SK Telecom основала новую компанию SK Horizon, специализирующуюся на инфраструктуре ИИ ЦОД. Первоначальные инвестиции в её бизнес составят ₩3,08 трлн ($2,2 млрд), которые выделят KKR и IMM Investment-Stonebridge, сообщает Datacenter Dynamics. Ранее SK Telecom запустила подразделение SK Hyper, специализирующееся на строительстве дата-центров гигаваттного класса, и выделила ему $508 млн. SK Horizon будет выделена из подразделения SK Telecom — SK Broadband, юридическое лицо которого при этом сохранится как отдельный бизнес. SK Horizon будет уделять первоочередное внимание сектору ИИ ЦОД, а также расширению своей инфраструктуры до 318 МВт. В результате раздела новая компания получит восемь дата-центров, уже действующих в нескольких регионах Южной Кореи: Сочхо (Seocho), Пундан (Bundang), Касан (Gasan), Сентум (Centum), Янчжу (Yangju), Пангё (Pangyo), Ильсан (Ilsan). Компания объявила, что уже строятся новые дата-центры, также предполагается поэтапно расширять собственную подводную кабельную инфраструктуру. По словам SK Telecom, реструктуризация позволит компании контролировать весь бизнес группы в сфере ИИ ЦОД, а новая упрощённая структура принятия решений позволит более эффективно привлекать инвестиции для ключевых направлений деятельности. KKR и южнокорейская IMM обеспечит SK Horizon $2,2 млрд в обмен на доли в капитале нового бизнеса, 29 % и 20 % соответственно. У SK Telecom останется контрольный пакет 51 %. Остаток SK Broadband будет уделять основное внимание услугам фиксированной связи, медиа и корпоративному бизнесу. По имеющимся данным, как SK Broadband, так и SK Horizon будет возглавлять Ким Сон-су (Kim Seong-soo), хотя официально назначение ещё не утверждено. По словам топ-менеджера, реструктуризация усилит компетенции бизнеса и ускорит реализацию проектов в сфере ИИ ЦОД, поскольку компания намерена стать ведущим оператором дата-центров в Корее. В конце июля SK Group и NVIDIA объявили о совместных инициативах в Южной Корее на $500 млрд. В июне сообщалось, что Южная Корея анонсировала масштабный инвестиционный план с целью ускорения технологического развития страны, включающий три крупнейших проекта, которые направлены на укрепление цепочек поставок полупроводников, создание инфраструктуры ИИ и развитие индустрии физического ИИ. Общий объём инвестиций должен составить более ₩3,755 квадрлн (приблизительно $2,74 трлн) в течение следующих десятилетий.
28.08.2026 [13:55], Руслан Авдеев
Mistral и Humain объединились для внедрения суверенного ИИ в Саудовской Аравии и других странах Ближнего ВостокаФранцузская Mistral и саудовская Humain достигли соглашения о внедрении суверенных ИИ-вычислений в Саудовской Аравии и на Ближнем Востоке в целом. В рамках партнёрства Mistral «изучит использование инфраструктуры ЦОД партнёра в регионе», сообщает Datacenter Dynamics. Дополнительно сообщается, что компании будут совместно работать над разработкой и внедрением ИИ-моделей, с особым вниманием к решениям в сфере кибербезопасности и голосовых технологий. Соглашение оценивается в «сотни миллионов евро». Также Humain и Mistral работают над стратегией выхода на рынок в Саудовской Аравии для предложения ИИ-решений регулируемым отраслям. Эти решения должны отвечать местным требованиям к обеспечению суверенитета данных. Humain представляет поддерживаемую Саудовской Аравией ИИ-структуру. Компания строит крупные ЦОД в Эр-Рияде (Riyadh) и провинции Даммам (Dammam). Площадки получать первоначальную мощность на уровне 100 МВт каждая, но Humain намерена обеспечить мощность ЦОД на уровне 6 ГВт в следующем десятилетии. Компания также объявляла, что владеет 211 участками земли в Саудовской Аравии для дальнейшего расширения парка ЦОД. В июле европейская Mistral подписала соглашение с Microsoft о расширении ИИ-инфраструктуре в Европе. Партнёрство предусматривает многомиллиардные инвестиции Microsoft в ИИ-инфраструктуру по всему региону, которой техногигант «поделится» с Mistral. Ранее компания намеревалась получить под контроль 200 МВт вычислительных мощностей в Европе к концу 2027 года. Позже появилась информация, что она рассчитывает на 1 ГВт в Европе к 2030 году. Также в марте 2026 года компания привлекла $830 млн долгового финансирования для покупки ИИ-ускорителей в запланированный в окрестностях Парижа ЦОД и подписала соглашение с Digital Realty об аренде мощностей во французской столице. В сентябре 2025 года она уже привлекла на развитие €1,7 млрд при участии ASML в ходе раунда финансирования серии C. Летом того же года сообщалось, что Mistral ведёт переговоры с базирующимся в Абу-Даби (ОАЭ) фондом MGX и другими структурами о привлечении до $1 млрд акционерного капитала для обеспечения конкуренции с OpenAI.
27.08.2026 [18:30], Владимир Мироненко
NVIDIA более чем удвоила выручку, но акции выросли всего на 13 % на фоне опасений ИИ-пузыряNVIDIA объявила финансовые результаты за II квартал 2027 финансового года, закончившийся 26 июля 2026 года. Как отметило агентство Reuters, результаты NVIDIA свидетельствуют о том, что бум ИИ еще не закончился. Выручка компании увеличилась более чем вдвое год к году до $96,22 млрд (+106 %), также превысив консенсус-прогноз аналитиков, опрошенных LSEG, в размере $92,17 млрд (по данным CNBC). Скорректированная чистая прибыль на разводнённую акцию (Non-GAAP) составила $2,22, что на 120 % больше, чем годом ранее, а также больше консенсус-прогноза аналитиков Уолл-стрит в размере $2,10. Чистая прибыль (GAAP) достигла $59,69 млрд (рост год к году на 126 %) или $2,46 на разводнённую акцию. Прогноз выручки за III квартал составляет $108 млрд ± 2 %, против прогнозируемых Уолл-стрит $104,19 млрд. NVIDIA не учитывает в своём прогнозе выручку от поставок ускорителей для ЦОД в Китае. Финансовый директор NVIDIA Колетт Кресс (Colette Kress) заявила, что компания ставит перед собой цель достичь темпов роста выручки в 70 % в 2028 финансовом году, то время как аналитики в преддверии публикации результатов сообщили об ожидаемом росте на 44 %. Это редкое заявление для компании, которая обычно не публикует подобные прогнозы. Кресс сообщила, что «прогнозы клиентов указывают на удвоение нашего роста в следующем году», добавив, что этот прогноз также отражает «ограничения поставок», с которыми приходится сталкиваться NVIDIA и другим производителям чипов. «Мы никогда не делали прогнозов и не давали оценок на год вперед», — сказал основатель и гендиректор NVIDIA Дженсен Хуанг (Jensen Huang). «ИИ достиг переломного момента. Он выполняет полезную работу. Его ресурсы продуктивны и прибыльны. Теперь вычислительные мощности приносят доход», — отметил он. «Что делает (прогноз) ещё более убедительным, так это то, что спрос расширяется за пределы первоначальных крупных поставщиков услуг, и теперь облачные сервисы для ИИ, предприятия, государственные покупатели и промышленные клиенты растут значительно быстрее», — сказал Шей Болур (Shay Boloor), главный рыночный стратег Futurum Equities. Кресс также отметила, что стремительный рост цен на память и увеличение стоимости компонентов будут продолжать оказывать давление на рентабельность компании, добавив, что рентабельность достигнет минимума в IV финансовом квартале на уровне примерно 71-72 %, по сравнению с примерно 74 % в III финансовом квартале. Аналитики ожидают 74,77 % в III квартале. Выручка подразделения ЦОД выросла более чем вдвое (на 117 %), достигнув $89,0 млрд, превысив прогноз аналитиков LSEG в $85,08 млрд. В настоящее время на подразделение ЦОД приходится 92% от общей выручки компании. Сегмент гиперскейлеров (Hyperscale) принёс $48,7 млрд (рост — 102 %), сегмент AI Clouds, Industrial, & Enterprise (ACIE), который включает облачные решения для ИИ, промышленного и корпоративного рынков, — $40,3 млрд (рост — 138 %). NVIDIA ожидает, что спрос со стороны ИИ-лабораторий составит примерно четверть её общего бизнеса в следующем году, что указывает на диверсифицированную клиентскую базу. Компания добавила, что неооблачные платформы, включая Nebius и CoreWeave должны запустить в этом году чем 8 ГВт мощностей ускорителей NVIDIA, что значительно больше, чем 3 ГВт в конце прошлого года. Выручка сегмента Edge Computing составила $7,2 млрд, что на 27 % больше год к году. Рост продаж был обусловлен высокими объёмами продаж рабочих станций на платформе Blackwell, частично компенсированными снижением продаж потребительских ПК, которое, в свою очередь, было смягчено повышением цен на память и системы, сообщила компания. Несмотря на сегодняшний рост после закрытия торгов, очевидно, что многие инвесторы в этом году охладели к акциям NVIDIA, отметил ресурс SiliconANGLE. На момент закрытия рынка акции выросли всего на 13 % с начала года, немного опередив более широкий индекс Nasdaq. Некоторые инвесторы высказывают опасения в существовании пузыря в ИИ-индустрии, который может лопнуть, если NVIDIA не сможет угнаться за текущими темпами роста. Также утверждается, что NVIDIA смогла добиться таких результатов только благодаря инвестициям в другие компании в сфере ИИ, предоставляя им капитал, необходимый для продолжения инвестиций в её собственные чипы. В ходе отчёта Дженсен Хуанг постарался развеять эти опасения, заявив аналитикам, что он хотел бы быть ещё более агрессивным в своих инвестициях в OpenAI и её конкурента Anthropic PBC перед их IPO. «Инвестиции в эти компании — это возможность, которая выпадает раз в поколение, — сказал Хуанг. — Единственное, о чём я жалею, это то, что не инвестировал больше и раньше».
27.08.2026 [18:22], Руслан Авдеев
Anthropic заплатит Nscale $45 млрд за аренду облачных ИИ-мощностейАмериканская Anthropic PBC согласилась заплатить $45 млрд за аренду неооблачных ИИ-мощностей компании Nscale. Речь идёт об объекте в Западной Вирджинии, на который ранее претендовала Microsoft, сообщает Bloomberg. Компания стремится запастись вычислительными мощностями перед планируемым выходом на IPO. Оценка компании в мае составляла $965 млрд. Nscale предоставит Anthropic ускорители NVIDIA Vera Rubin. Соглашение будет действовать в течение шести лет и касается приблизительно 460 МВт мощностей в первом ЦОД кампуса Monarch, общая мощность которого на момент полного ввода в эксплуатацию составит 1,35 ГВт. Строительство кампуса целиком и электростанции при нём обойдётся приблизительно в $71 млрд, из этих средств $47 млрд будут потрачены на ИИ-чипы. В остальных ЦОД серверы будут обеспечены электроэнергией в 2028 году. Соглашение имеет важное значение для лондонской Nscale, поскольку та готовится к IPO уже в следующем месяце. В апреле сообщалось, что британские власти попытаются «заманить» к себе многомиллиардный бизнес Anthropic после конфликта последнего с Пентагоном, но после этого компания неоднократно заключала крупные сделки на территории США. Anthropic в последние месяцы заключила целый ряд соглашений и с другими компаниями. Так, с Fluidstack заключена сделка на $50 млрд, с Volta Infra Holdings — на $10 млрд, а со SpaceX — на $45 млрд. Сингапурский фонд благосостояния GIC и Macquarie основали Theseus Infrastructure для создания оператора ЦОД, обслуживающего нужды Anthropic в США.
27.08.2026 [08:59], Владимир Мироненко
OpenAI: Jalapeño опередил в тестах чипы NVIDIAOpenAI сообщила новые подробности об ИИ-ускорителе Jalapeño, разработанном в сотрудничестве с Broadcom, пишет The Register. Как утверждает OpenAI, Jalapeño, предназначенный для инференса, показал в тестах лучше результаты, чем текущая линейка ускорителей NVIDIA — GB200 и GB300. Тестирование в бенчмарк-пакете SemiAnalysis InferenceX показало, что системы OpenAI на базе Jalapeño обеспечивают в 1,5–1,9 раза больший объём «работы ИИ» при пиковой пропускной способности и в 1,7–3,6 раза меньшую сквозную задержку, чем у конкурентов, на GPT-OSS-120B, DeepSeek R1 670B и Kimi K2.5 1T. Во время внутренних тестов Jalapeño также хорошо показал себя при работе с некоторыми крупными, продвинутыми моделями OpenAI, которые ещё не выпущены. Это говорит о том, что конструкция чипа «становится более ценной по мере роста рабочих нагрузок и повышения их сложности», сообщила компания в блоге. На системном уровне стойка со 128 ускорителями Jalapeño обеспечивает 1,7 Эфлопс 4-бит вычислений, имеет 27,5 Тбайт HBM4 с агрегированной пропускной способностью чуть менее 2 Пбайт/с. Чип сочетает вычислительный кристалл с шестью стеками HBM4 общим объёмом 216 ГиБ (15,4 Тбайт/с), обеспечивая производительность 13,4 Пфлопс в операциях MXFP4, и масштабируется до 27 Эфлопс и 432 ТиБ памяти в системе из 2048 ASIC. Поскольку чип демонстрирует высокие результаты при низком энергопотреблении — 700 Вт — Jalapeno позволит OpenAI экономить средства при эксплуатации своих ЦОД, где электроэнергия является ключевой статьей расходов, заявил агентству Bloomberg вице-президент по аппаратному обеспечению OpenAI Ричард Хо (Richard Ho). Новейшие стоечные системы AMD и NVIDIA работают быстрее, обеспечивая в 1,46–2 раза больше вычислительных ресурсов и до 12 % больше памяти (Helios), но имеют всего лишь 85 % пропускной способности памяти стойки OpenAI. Ричард Хо сообщил, что чип был разработан для минимизации перемещения данных и хранения промежуточных операций. «Мы разработали Jalapeño таким образом, чтобы минимизировать перемещение данных и задержки связи. Это означает, что состояние модели, включая KV-кеш, используемый при генерации ответа, может быть явно размещено и храниться локально, пока система активирует правильную комбинацию вычислительных ресурсов, памяти и сети для каждой фазы инференса», — сообщила компания в своем блоге. В отличие от стоек NVIDIA Groq LPX, Jalapeño не является узкоспециализированным решением. В компании сообщили ресурсу The Register, что он оптимизирован как для ресурсоёмких операций предварительного заполнения, где обрабатываются промты, так и для фазы декодирования, требующей большой пропускной способности памяти, где генерируются выходные токены. Также следует отметить, что благодаря использованию ИИ для проектирования архитектуры и оптимизации чипа для инференса, OpenAI потратила на его разработку от начала до готовности первого пробного чипа всего девять месяцев. Процесс включал использование собственных моделей для оптимизации механизмов обработки инференса и для написания пользовательских ядер по мере внедрения новых моделей. Преимущество Jalapeño в скорости настолько велико, что OpenAI может получать результаты, ранее достижимые только с помощью чипов, использующих другой тип памяти и конструкцию. Например, в настоящее время OpenAI использует чипы Cerebras для некоторых своих LLM, которые, по словам Хо, лучше всего подходят для небольших моделей. Jalapeño, напротив, может обрабатывать более крупные модели, отметил он. Тем не менее, компания не собирается отказываться от сотрудничества с другими поставщиками, включая NVIDIA. «У нас огромная потребность в вычислительных мощностях, поэтому мы привлекли так много разных поставщиков, — сказал он. — Это будет продолжаться ещё некоторое время». Ожидается, что Jalapeño будет выпущен в ограниченных объёмах в конце этого года с дальнейшим увеличение производства в следующем году. Вторая версия Jalapeño находится на продвинутой стадии разработки, готовность к производству ожидается в «ближайшие месяцы», сказал Хо. Также уже разрабатывается концепция чипа третьего поколения. The Register призвал относиться с осторожностью к заявлениям OpenAI. Новый чип тестировался в сравнении с системами NVIDIA GB200 NVL72 и GB300 NVL72, выпущенными в 2024 и 2025 годах соответственно, но не сравнивался с Vera Rubin, поставки которого только начались. |
|



