Материалы по тегу: llm
|
01.09.2026 [16:30], Владимир Мироненко
Selectel усиливает ИИ-платформу новой функциональностью в кaталоге ИИ-моделейSelectel, крупнейший независимый провайдер ИT-инфраструктуры в России, обновил каталог ИИ-моделей (Foundation Models Catalog) для работы с большими языковыми моделями. Обновления усиливают возможности платформы для корпоративных заказчиков: компания обеспечила приватный доступ к моделям, пополнила каталог продвинутыми генеративными моделями, а также расширила возможности для построения геораспределённых систем за счёт добавления нового региона ru-6. Эти изменения позволят бизнесу быстрее запускать ИИ-решения, снижать операционные расходы и соблюдать стандарты информационной безопасности при работе с чувствительными данными. Каталог ИИ-моделей входит в состав ИИ-платформы Selectel — экосистемы сервисов для обучения и запуска генеративных моделей, которая помогает компаниям ускорить интеграцию ИИ-решений. Это даёт бизнесу возможность использовать большие языковые модели, инструменты агентской разработки и другие ИИ-технологии без необходимости самостоятельной настройки ИТ-инфраструктуры, существенно снижая технические барьеры на пути к внедрению инноваций. Теперь сервис стал доступен в новом отказоустойчивом регионе на базе трёх независимых зон доступности. Клиенты могут развернуть два одинаковых инференс-сервиса в разных зонах доступности и строить мультирегиональные схемы, снижая риски простоя за счёт геораспределённости инфраструктуры. При создании инференс-сервиса теперь можно выбрать тип доступа: публичный (через интернет) или приватный (доступ только внутри приватной сети пользователя, без выхода трафика в интернет). Компании смогут построить приватный канал между собственной инфраструктурой и дата-центрами Selectel через услугу Direct Connect и направлять запросы к каталогу ИИ-моделей через него. Это позволит бизнесу с повышенными требованиями к безопасности работать с моделями в изолированном контуре, что особенно актуально для финансовых, медицинских и государственных организаций, обрабатывающих чувствительные данные. Каталог пополнился новыми моделями в квантизации NVFP4, которая повышает производительность при незначительном снижении точности. Технология оптимизирована под GPU поколения Blackwell, что позволяет запускать ресурсоёмкие модели на компактных конфигурациях. Стали доступны модели семейства Queen с максимальным размером контекста — 262 000 токенов, что позволяет работать с большими документами и долгими агентскими сценариями с сохранением высокой точности. В ближайшее время появятся и другие популярные модели в квантизациях FP8 и NVFP4, оптимизированные под GPU, которые доступны в новом регионе ru-6.
24.08.2026 [20:30], Владимир Мироненко
NVIDIA выплатит Poolside за лицензию $6 млрд и получит более ста его специалистов, но поглощением эту сделку называть отказываетсяNVIDIA заключила сделку со стартапом Poolside о лицензировании его ПО Model Factory для создания ИИ-моделей, стоимость сделки — $6 млрд, о чём сообщили ресурсы Newcomer и The Wall Street Journal. По данным WSJ, компания Poolside, основанная в 2023 году разработчиком ПО Эйсо Кантом (Eiso Kant) и бывшим техническим директором GitHub Джейсоном Уорнером (Jason Warner), разослала акционерам письмо, в котором объявила о масштабной реструктуризации своего бизнеса. В рамках сделки 109 сотрудникам предложено перейти на работу в NVIDIA, которая также инвестирует $1 млрд в стартап с его оценкой в размере $12 млрд. Сделка «не является покупой [компании] и не является приобретением персонала», отмечено в письме. До этого NVIDIA уже дважды использовала аналогичную схему сделки, чтобы обойти препятствия регуляторов, получить технологии компании и переманить квалифицированные кадры — с Groq и Enfabrica. Poolside намерена распределить $6 млрд между инвесторами к концу следующего года. Лицензия не является эксклюзивной, что позволяет Poolside поставлять ПО другим заказчикам. Руководство Poolside, включая Канта, Уорнера и операционного директора Маргариду Гарсию (Margarida Garcia), продолжит работу в стартапе над неуказанными исследовательскими проектами. По словам источников, перешедшие в NVIDIA сотрудники стартапа присоединятся к работе над проектом Nemotron по разработке LLM с открытыми весами, который NVIDIA представила в 2023 году. Они помогут улучшить более крупные и сложные модели Nemotron, находящиеся в разработке, которые помогут NVIDIA конкурировать с такими китайскими гигантами, как DeepSeek и Kimi. NVIDIA делает ставку на то, что в следующем году выпустит версию Nemotron, которая будет конкурировать с лучшими передовыми ИИ-моделями. Крупное лицензионное соглашение с Poolside также станет прямым вызовом для передовых американских компаний в области ИИ, включая OpenAI и Anthropic, поскольку open source модели, как правило, гораздо дешевле в эксплуатации и проще в тюнинге. NVIDIA выступает в роли конкурента своих клиентов, использующих её чипы, в том числе поддерживаемых и самой NVIDIA. Впрочем, эксперты отмечают, что всё больше крупных ИИ-компаний разрабатывает собственные чипы для своих моделей, и поэтому теперь находятся в прямой конкуренции с NVIDIA. При этом дела у Pooside до недавнего времени складывались не лучшим образом. В 2024 года стартап привлёк $500 млн при оценке капитализации на уровне $3 млрд. в 2025 году компания намеревалась при участии CoreWeave создать 2-ГВт кампус ИИ ЦОД Project Horizon. Стартап намеревалась поддержать NVIDIA путём вливания $0,5–$1 млрд. До этого компания в основном пользовалась мощностями Fluidstack и Iren, а также надеялась заключить сделку с Google. Однако в конце прошлого года компания не смогла за шесть отведённых недель привлечь $2 млрд, в результате чего не получила кластер из 40 тыс. GB300. В итоге от Poolside практически одновременно отвернулись NVIDIA, CoreWeave и Google.
20.08.2026 [18:18], Андрей Крупин
Без NVIDIA: Rubytech показала возможность создания корпоративной ИИ-инфраструктуры на китайских GPU с российскими LLMГруппа компаний Rubytech завершила испытания российских больших языковых моделей (LLM) на ускорителях китайского производства. Тестирование подтвердило стабильную работу отечественных нейросетей в составе программно-аппаратного комплекса «Машина искусственного интеллекта Скала^р», что открывает путь к построению независимой от западных поставщиков ИИ-инфраструктуры. Для проведения испытаний инженерами была использована модификация ПАК «Машина искусственного интеллекта Скала^р» с восемью китайскими GPU и языковой моделью третьего поколения Cotype 3 от MWS AI. Результаты показали производительность, сопоставимую с решениями на основе NVIDIA H100: среднее время ожидания первого токена (mean TTFT) составило около 8000 мс при обработке контекста в 27 тыс. токенов, а межтокенная задержка (TPOT) — от 111 мс. Эти показатели полностью соответствуют требованиям корпоративных сценариев применения ИИ-системы.
Архитектура и компоненты ПАК «Машина искусственного интеллекта Скала^р» (источник изображения: skala-r.ru) Возможность работать с разными аппаратными платформами снижает зависимость от одного поставщика и даёт больше свободы при проектировании ИИ-систем, говорит компания. Помимо технологического суверенитета, альтернативная аппаратная база решает проблему высокой стоимости вычислений. В ряде сценариев связка из китайских GPU, российской платформы и отечественной модели позволяет снизить совокупную стоимость владения (TCO) при масштабировании сервисов. Это делает решение экономически оправданным для крупного бизнеса и государственных структур. В настоящий момент спрос на локальную инфраструктуру формируют госсектор, компании с госучастием и операторы критической информационной инфраструктуры (КИИ). Для них принципиально важно разворачивать модели внутри собственного контура безопасности. Продуктовая линейка« Скала^р» от Rubytech включена в реестры Минпромторга и Минцифры РФ и соответствует критериям доверенности для объектов КИИ. Технологическими партнёрами группы выступают ведущие российские банки (Газпромбанк, ВТБ), ФНС России и ЦБ РФ.
19.08.2026 [15:01], Андрей Крупин
Стоимость развёртывания ведущих мировых ИИ-моделей в России за год выросла в 2,8 разаКомпания MWS Cloud (входит в МТС Web Services) проанализировала требования к вычислительной инфраструктуре для запуска ведущих мировых и российских больших языковых моделей. Экспертную оценку прошли популярные открытые модели, выпущенные весной и летом соответствующего года. Для 2025 года рассматривались Kimi K2, gpt-oss-120b, Gemma 3 27B, GLM-4.5V, Qwen3 235B и российская Cotype Pro 2. Для 2026 года — Kimi K3, Qwen3.5 397B, DeepSeek-V4-Pro, DeepSeek-V4-Flash, GLM-5.2, Gemma 4 и Cotype Pro 3. Исследование показало, что средняя стоимость минимального набора ускорителей NVIDIA для запуска одной модели увеличилась в 2,8 раза — с 13,7 млн руб. в 2025 году до 38,8 млн руб. в 2026 году. Новые ИИ-модели становятся более мощными: они лучше справляются со сложными задачами и могут обрабатывать больше информации в одном запросе. Однако для этого им требуется больше памяти и более производительные GPU. При этом растёт и стоимость самих видеокарт, поэтому развёртывание моделей обходится дороже, пояснили в MWS Cloud результаты исследования.
Источник: MWS Cloud / mws.ru По словам экспертов MWS Cloud, цены на GPU в России во многом зависят от мирового рынка: глобальная гонка в области ИИ увеличивает спрос на вычислительные мощности и поддерживает рост стоимости ускорителей. Как следствие, развёртывать крупные модели на собственной инфраструктуре становится дороже, однако единого ценового предела, после которого рынок потеряет интерес к ИИ, нет: если покупка оборудования перестаёт окупаться, компании выбирают более компактные модели, оптимизируют вычисления или переходят в облако, где можно платить только за фактически используемые мощности.
15.08.2026 [02:12], Владимир Мироненко
Tencent мгновенно озолотится, сдав в аренду свои GPU, но уверена, что на собственных ИИ-решениях она заработает большеTencent Holdings сообщила о росте выручки во II квартале на 11 %, чему способствовали высокие доходы от рекламы и игр, хотя компания наращивает расходы на ИИ, пишет Reuters. Компания объявила о неаудированных консолидированных результатах за квартал, закончившийся 30 июня. Выручка составила ¥204,8 млрд ($30,3 млрд), что выше консенсус-прогноза аналитиков, опрошенных LSEG, равного ¥202,2 млрд. Однако чистая прибыль по МСФО, причитающаяся акционерам компании, выросла всего на 0,7 % год к году, составив ¥56 млрд ($8,3 млрд), что ниже ожиданий аналитиков в ¥61,8 млрд. Чистая прибыль (не по МСФО), причитающаяся акционерам компании, составила ¥68,4 млрд ($10,1 млрд, рост — 9 %). Капитальные затраты во II квартале составили ¥52,8 млрд ($7,8 млрд), что на 176 % больше, чем годом ранее, и на 66 % больше по сравнению с I кварталом. Капитальные затраты в 2025 году составили около ¥79 млрд, в 2024 году — ¥77 млрд, и компания дала понять, что инвестиции в ИИ ещё больше увеличатся во второй половине этого года. «Мы уверены в возможности значительных инвестиций в ИИ, потому что существует не только существенный потенциал роста, но и чёткая защита от негативных последствий», — заявил президент Tencent Мартин Лау (Martin Lau) в ходе телефонной конференции с аналитиками, о чём пишет The Register. Он сказал, что если Tencent будет действовать как неооблачная компания, сдав свои вычислительные мощности в аренду, она «получит достойную прибыль в кратчайшие сроки», поскольку получает предложения по своим вычислительным мощностям «с прибылью более 30 % по сравнению с ценой, которую мы заплатили всего несколько месяцев назад». Директор по стратегии Джеймс Митчелл (James Mitchell) заявил, что спрос на вычислительные ресурсы настолько высок, что Tencent сможет окупить свои капзатраты «почти сразу». Лау отметил, что что Tencent «реализует более масштабную стратегию, выделяя значительную часть новых вычислительных ресурсов на создание собственных моделей, соответствующих самым современным стандартам, а также на развёртывание, популяризацию и вывод наших собственных приложений ИИ на лидирующие позиции на китайском рынке». Если компания сможет обеспечить «превосходный интеллект, которого мы можем достичь с помощью передовых моделей, с помощью ведущих на рынке приложений ИИ… то мы сможем получить превосходную экономическую отдачу в долгосрочной перспективе», отметил глава Tencent. Прибыль будет получена от продажи токенов для таких сервисов, как WorkBuddy — офисного помощника, который, по словам Tencent, представляет собой рой агентов, способных «планировать, выполнять и запускать задачи параллельно, возвращая полные результаты от начала до конца в одном потоке». Tencent также предлагает инструмент генерации кода CodeBuddy, который, по словам Митчелла, ускоряет проекты миграции в облако и, следовательно, создаёт больше возможностей для облачных сервисов Tencent. Выручка Tencent от дополнительных услуг, включая игровой бизнес, выросла на 8 % до ¥98,4 млрд ($14,6 млрд). Доходы от маркетинговых услуг выросли на 22 % до ¥43,6 млрд ($6,5 млрд), поскольку ИИ стимулировал рекламу и смену ценообразования в экосистеме Weixin, объединяющей обмен сообщениями, платежи и социальные сети, а также другие услуги. Доходы от финансовых технологий и бизнес-услуг выросли на 9 % до ¥60,3 млрд ($8,9 млрд), при этом спрос на облачные сервисы, связанные с ИИ, остаётся ключевым фактором роста.
06.07.2026 [18:07], Владимир Мироненко
Selectel и ИТМО создали СП для разработки платформы по созданию ИИ-агентов для бизнесаSelectel и Национальный исследовательский университет ИТМО объявили о запуске совместного предприятия с целью разработки решений в сфере ИИ, в частности — платформы для создания, внедрения и промышленной эксплуатации мультиагентных систем на базе больших языковых моделей (LLM). Новая платформа позволит быстро создавать ИИ-решения под конкретные бизнес-процессы заказчиков, подключать их к корпоративным данным и системам, измерять качество работы и безопасно их развивать по мере изменения задач бизнеса. Коммерческая модель будет учитывать фактическое потребление вычислительных ресурсов и токенов. Оплата заказчиком использования ИИ-агентов будет производиться в зависимости от объёма, сложности и места выполнения работы: на инфраструктуре Selectel, в выделенном контуре или непосредственно у заказчика. Сообщается, что в штат СП войдёт проектная группа ИТМО и опытные эксперты индустрии. ИТМО выступит ключевым центром компетенций с готовыми наработками, а Selectel обеспечит финансирование проекта на сумму более 1 млрд руб., а также предоставит необходимую IT-инфраструктуру. Ранее сообщалось, что Selectel создал новую компанию для реализации ИИ-проектов — «Эмерджентные мультиагентные системы» (ООО «ЭМС»). По словам Олега Любимова, гендиректора Selectel, объединив экспертизу Selectel в построении специализированной инфраструктуры для ИИ с профильными компетенциями команды ИТМО, и действуя при этом как самостоятельный игрок, новое предприятие будет способствовать ускорению развития прикладных решений, необходимых крупному бизнесу на фоне перехода к агентной экономике ИИ-систем.
Источник изображения: ИТМО Любимов уточнил в интервью ресурсу Forbes, что у Selectel доля в уставном капитале СП составляет ⅔, у ИТМО — ⅓. Руководитель ИТМО Александр Бухановский рассказал Forbes, что специалисты ИТМО разработали технологию, которая автоматизирует конструирование прикладных агентов ИИ и мультиагентных систем на их основе под комплексные бизнес-задачи. «Мы реализовали ИИ, который умеет делать ИИ», — отметил он. С 2020 года Selectel инвестировал в развитие ИИ-решений более 3,5 млрд руб. В ближайшие пять лет провайдер планирует увеличить финансирование проектов в сфере ИИ, выделив на эти цели 10 млрд руб. С конца прошлого года 25 % АО «Селектел» принадлежит компании «Каталитик Пипл», созданной МКПАО «Т-Технологии» и ХК «Интеррос».
01.07.2026 [18:17], Руслан Авдеев
Австрия призвала Евросоюз привлечь Anthropic на свою территорию после введённых США ограничений на передовые ИИ-моделиАвстрия предлагает властям Евросоюза расширить присутствие Anthropic на территории блока. Предложение было сделано после того, как США ввели ограничения на доступ некоторых иностранных пользователей к передовым ИИ-моделям компании. Это вновь ставит вопрос зависимости Европы от американских ИИ-технологий, сообщает eWeek. США ограничили доступ иностранным пользователям к новейшим ИИ-моделям Anthropic в июне. Фактически возможности Европы по получению доступа к критически важным зарубежным технологиям оказались под вопросом. Австрийские власти призвали государства — члены ЕС рассмотреть вариант «стратегического размещения Anthropic на территории Евросоюза». Утверждается, что ЕС может предложить компании правовую определённость, доступ к рынку, капитал и ценности, соответствующие философии самой компании. Признаётся, что инициативу неизбежно встретят скептически, тем более что механизмов конкретной реализации плана не предоставлено. Тем не менее подчёркивается, что речь идёт о стратегическом технологическом будущем Европы, вопрос не в том, легко ли это осуществить, а в том, готовы ли европейцы сами стать «архитекторами своего технологического будущего» или так и будут полагаться на решения, принятые в других странах. Предложение стало отражением обеспокоенности европейских элит зависимостью от зарубежных ИИ-продуктов, доступность которых может измениться из-за принятых вне блока решений. Ограничения могут повлиять не только коммерческие аспекты, но и на вопросы национальной безопасности и экспортной политики. Европейские власти уже обсуждают возникшую проблему с представителями США, в то же время продвигая развитие собственных облачных технологий, ИИ и полупроводниковой индустрии. По некоторым данным, размещение Anthropic в ЕС рассматривается Австрией как возможность привлечь в Европу высококвалифицированных специалистов, сохранить инвестиции и помочь формированию стандартов в сфере ИИ, не вытесняя собственно европейские ИИ-бизнесы. Неопределённость может подтолкнуть бизнес к диверсифицировать поставщиков ИИ-решений, будет способствовать росту инвестиций в местную ИИ-инфраструктуру и усилит внимание к европейским проектам, связанным с искусственным интеллектом. Предложение расширяет концепцию европейского цифрового суверенитета. Вместо того, чтобы полагаться только на «выращивание» собственных лидеров ИИ-индустрии, Австрия призывает привлекать извне к работе в Европе уже состоявшиеся бизнесы. Впрочем, даже если Anthropic расширит своё присутствие в Европе, остаётся ряд нерешённых вопросов в юридической и регуляторной плоскостях. В том числе непонятно, будут ли в этом случае по-прежнему действовать нормы экспортного контроля США. В любом случае сам факт дискуссии на государственном уровне показывает, что доступность ИИ становится вопросом не только и не столько технологическим, сколько геополитическим. В своё время агентство Gartner сообщало, что суверенное облако могут позволить себе только США и Китай, но не Европа. Ещё в апреле, до введения США ограничений, британское правительство пригласит Anthropic расширить присутствие в Соединённом Королевстве, желая извлечь выгоду из имевшего места конфликта многомиллиардного стартапа с американским военным ведомством.
22.06.2026 [19:14], Владимир Мироненко
Законопроект о регулировании ИИ в России кардинально сократили и упростили22 июня в комиссии правительства по законопроектной деятельности пройдёт рассмотрение законопроект «О поддержке развития технологий ИИ в РФ», который, по словам источника «Коммерсанта», должны внести в Госдуму до конца недели. Сообщается, что документ претерпел значительные изменения по сравнению с первоначальным вариантом. Его сократили до 13 страниц и 13 статей, при этом действие законопроекта распространяется только на большие фундаментальные модели (LLM) с более 1 млрд параметров. Модели с меньшим количеством параметров, в том числе open source, были исключены из первоначального варианта законопроекта также, как и формулировка «доверенные» модели, после чего в нём теперь указаны только «суверенные» и «национальные». Отмечается, что от добавления в документ «доверенных» моделей для КИИ отказались, так как требования к софту, куда относится и ИИ, уже прописаны ФСТЭК и ФСБ. На объектах КИИ можно будет использовать только с «суверенные» и «национальные» модели, разработка которых может рассчитывать на господдержку. В документе указано, что «суверенная» модель ИИ может быть разработана на всех этапах только российским юрлицом и использоваться только на инфраструктуре в РФ. «Национальная» модель должна быть существенно разработана российским юрлицом, хотя её компоненты могут быть open source. Основные положения законопроекта вступают в силу с 1 сентября 2026 года, положения о полномочиях правительства (применение моделей, их определение, обязанности разработчиков и т. д.) — с 1 марта 2027 года. Если же до 1 марта 2027 года уже внедрены ИИ-модели, не подпадающие под критерии документа, переходный период для них продлён до 1 сентября 2032 года в случае, если данные обрабатываются в РФ. «Коммерсантъ» отметил, что в итоговой версии отказались от требования обеспечить маркировку синтезированного ИИ контента и усилить ответственность владельцев ИИ-сервисов за правонарушения при использовании технологии. Также из первоначальной версии были исключены вопросы, касающиеся регулирования ИИ ЦОД и практически полностью — вопросы, касающиеся авторского права.
18.06.2026 [01:45], Владимир Мироненко
NVIDIA стала лидером во всех тестах MLPerf Training 6.0Консорциум MLCommons опубликовал результаты тестирования различных аппаратных решений в бенчмарке MLPerf Training 6.0. В нём появилось два новых теста — DeepSeek V3 и GPT-OSS 20B, что подчёркивает общеотраслевой переход к разреженным вычислениям, примером которого является архитектура MoE (Mixture-of-Experts). DeepSeek V3 — крупномасштабная MoE-модель c 671 млрд параметров, из которых 37 млрд активируются для генерации отдельного токена. Она предоставляет стандартизированную платформу для оценки эффективности обучения ведущей модели MoE с открытыми весами. GPT-OSS 20B — MoE-модель c 21 млрд параметров, из которых 3,6 млрд активируются для генерации одного токена. Она позволяет организациям оценивать сложную логику маршрутизации и шаблоны разреженных вычислений, характерные для архитектуры MoE, на аппаратных конфигурациях размером всего в один узел с восемью ускорителями. Версия MLPerf Training 6.0 установила новые рекорды по разнообразию представленных систем. Участники выложили результаты 95 уникальных систем, использующих тринадцать различных аппаратных ускорителей, 19 различных хост-процессоров и несколько различных программных фреймворков. 60 % систем были многоузловыми. При этом количество представленных облачных систем более чем вдвое больше, чем в раунде 5.1. В раунде MLPerf Training v6.0 представлены заявки от 24 организаций: AMD, ASUSTeK, Azure, Cisco, CoreWeave, Dell, Fujitsu, GigaComputing, Google, HPE, Inventec, Krai, Lambda, MITAC, Nebius, Netweb Technologies India, NVIDIA, Oracle, Quanta Cloud Technologies, SCITIX, Supermicro, tinycorp, TTA и Vultr. «Мы особенно рады приветствовать участников, впервые представляющих свои результаты в MLPerf Training: Inventec, Netweb Technologies India, TTA и Vultr», — сообщил Дэвид Кантер (David Kanter), руководитель MLPerf в MLCommons. NVIDIA вновь стала лидером в новом раунде MLPerf Training, причём во всех тестах, в очередной раз став единственной платформой, которая предоставила результаты по всем тестам. Также NVIDIA была единственной платформой, представившей результаты по новым тестам, при этом система NVIDIA GB300 NVL72 «установила планку производительности благодаря оптимизированным программным стекам NVIDIA и конструкции, объединяющей 72 GPU Blackwell Ultra и 36 CPU Grace с использованием NVLink и NVLink Switch». В нескольких случаях партнёры NVIDIA масштабировали систему до 8192 ускорителей Blackwell, работающих согласованно в различных ЦОД. Эти результаты подтвердили реальную надёжность платформы Blackwell в масштабируемых кластерных средах, говорит NVIDIA. Для достижения максимальной производительности таких моделей, как DeepSeek-V3, NVIDIA в этом раунде MLPerf Training применила несколько программных оптимизаций, включая использование итерационных графов CUDA для MoE без удаления токенов, применение CuTe DSL для продвинутых операций слияния ядер, алгоритм внимания MXFP8 для повышения производительности без ущерба для качества модели, оптимизацию маршрутизатора и оптимизацию схемы коммуникации 1F1B all-to-all overlap. Также NVIDIA оптимизировала компоновку и баланс параллельных этапов конвейера, минимизируя структурное простаивание. Для обработки DeepSeek-V3 671B компания NVIDIA использовала до 8192 GPU в системах GB200 NVL72, что стало самым масштабным результатом на основе Blackwell в MLPerf Training на сегодняшний день. NVIDIA также представила результаты на 5120 GPU с системами NVIDIA GB200 NVL72 в Llama 3.1 405B, одной из самых крупных LLM плотной архитектуры в этом бенчмарке. Результаты этого раунда также отражают тесное сотрудничество NVIDIA с компаниями-партнёрами в области системной архитектуры, сетей и ПО. Например, Microsoft Azure масштабировала обучение Llama 3.1 405B до 8192 GPU, используя системы GB200 NVL72, и достигла целевого эталонного значения за 7,07 мин., что является самым быстрым временем обучения для этого бенчмарка. А CoreWeave показала самое быстрое время обучения для DeepSeek-V3 671B, достигнув целевого качества за 2,02 мин. на 8192 GPU в составе GB300 NVL72, объединённых Spectrum-X Ethernet.
09.06.2026 [22:37], Андрей Крупин
Orion soft представил платформу StarGuard AI для безопасной работы с ИИРоссийский разработчик Orion soft выпустил шлюз безопасности StarGuard AI, предназначенный для централизованной и контролируемой работы с большими языковыми моделями (LLM) в корпоративной среде. Решение может быть актуально для крупного бизнеса, финансового сектора, промышленности, государственных организаций и компаний, внедряющих корпоративных ИИ-ассистентов, агентские системы и внутренние платформы на базе искусственного интеллекта. StarGuard AI функционирует как обратный прокси-сервер (Reverse Proxy) между пользователями и LLM-провайдерами. Каждый запрос и ответ проходят через набор детекторов до выхода за пределы защищённого контура. Шлюз помогает блокировать чувствительные данные, jailbreak- и prompt-инъекции, токсичный, запрещённый или нецелевой контент в ИИ-чатах, ассистентах, сервисах поддержки и корпоративных помощниках. Благодаря этому программный комплекс снижает репутационные риски во внутренних и клиентских ИИ-сервисах, закрывает риски утечки данных, контролирует разрешённые сценарии использования, централизует доступ к нескольким моделям и даёт прозрачный аудит всех событий.
Источник изображения: Steve Johnson / unsplash.com Решение позволяет подключать облачные и локальные LLM, включая ChatGPT, Claude, DeepSeek, GigaChat, YandexGPT, а также любые локальные модели. Поддерживается интеграция с OpenWebUI, IDE, AI-агентами и корпоративными платформами. «Корпоративные ИИ-сервисы постепенно становятся частью критической IT-инфраструктуры, а значит требуют сопоставимого уровня контроля и защиты. StarGuard AI создаёт единый контур безопасной работы с LLM и позволяет организациям внедрять ИИ-инструменты без потери контроля над данными с политиками безопасности и нормативными требованиями», — поясняют разработчики продукта. |
|

