Загрузка 0
ПОДЕЛИТЬСЯ

Мой блог

Листай вниз

Обновления Selectel: ИИ-агент aish, GPU NVIDIA H200 и расширение каталога моделей

Обновления Selectel: ИИ-агент aish, GPU NVIDIA H200 и расширение каталога моделей

Главные технические обновления Selectel: обзор ключевых новшеств

Инфраструктура для задач искусственного интеллекта и машинного обучения продолжает развиваться быстрыми темпами. В свежем дайджесте обновлений сервисов Selectel появился целый ряд функций и hardware-конфигураций, на которые стоит обратить внимание как разработчикам нейросетевых решений, так и системным администраторам. Я подробно изучил весь список нововведений — от консольных утилит автоматизации до серверного железа с топовыми графическими ускорителями — и подготовил их подробный разбор.

AI-агент aish опубликован в открытом репозитории

Для всех пользователей операционной среды SELECTOS стал доступен консольный умный помощник aish. Инструмент предназначен для запуска прямо в терминале и помогает решать множество повседневных задач администрирования, особенно в ситуациях, когда причина сбоя не очевидна с первого взгляда.

Инфраструктурные сервисы и каталог моделей ИИ
Обновления каталога ИИ-моделей и системы защиты данных в облачной платформе.

Типичный сценарий использования aish — оперативная диагностика системных проблем. Например, если сервис отказывается подниматься после обновления пакетной базы или системные утилиты рапортуют о нехватке свободного места на диске при полупустом разделе. Администратору достаточно сформулировать задачу обычным естественным языком. Инструмент самостоятельно проанализирует текущий контекст окружения, предложит алгоритм исправления и сгенерирует набор необходимых консольных команд. Выполнение команд происходит строго после прямого подтверждения со стороны пользователя, что полностью исключает неконтролируемые изменения в системе.

Реклама

Офсайт-хранение бэкапов на физических ленточных носителях

Организация надежного катастрофоустойчивого хранения данных требует соблюдения правила изоляции резервных копий от основной инфраструктуры. Чтобы защитить информацию от системных сбоев, аварий на площадках ЦОД, кибератак и операторских ошибок, была реализована услуга физического выноса ленточных накопителей за пределы дата-центра.

Схема работы включает запись бэкапов с последующим извлечением ленточных картриджей из библиотек СХД. Далее носители могут отправляться либо на изолированные защищенные склады провайдера, либо передаваться непосредственно в собственное хранилище компании-клиента.

Ускорители NVIDIA H200 NVLink в составе облачной конфигурации

Для высоконагруженных задач deep learning и развертывания крупных языковых моделей в облаке стала доступна новая конфигурация, состоящая из двух ускорителей NVIDIA H200 с объемом видеопамяти 141 ГБ на каждую карту и подключением к сети на скорости 10 Гбит/с.

Реклама

Графические процессоры объединены аппаратным интерконнектом 2-way NVLink, обеспечивающим двунаправленную пропускную способность до 900 ГБ/с. Скорость обмена данными между картами примерно в 7 раз превышает показатели традиционной шины PCIe. Это позволяет разворачивать и масштабировать одну массивную нейросетевую модель сразу на обеих картах без потерь производительности на межчиповые задержки.

Расширение системных образов и подготовка инфраструктуры под ML

Провайдер обновил каталог готовых операционных систем и виртуальных машин. В облачной среде появились официальные сборки отечественной платформы РЕД ОС версии 8 в конфигурациях «Стандартная» и «Сертифицированная».

Кроме того, был расширен список предустановленных виртуальных окружений для быстрого старта ML-проектов. В каталог добавили:

  • LiteLLM VM — удобный прокси-сервер для единого управления вызовами к разным провайдерам LLM;
  • QwenPaw VM — специализированную среду для развертывания и тестирования моделей семейства Qwen;
  • Dify VM — платформу для визуальной разработки AI-приложений и работы с RAG-архитектурами.

Гибкий выбор локации для разовых бэкапов

При создании внеплановых и разовых резервных копий появилась возможность явно задавать целевую локацию их размещения. Пользователь может сохранять копию либо внутри текущего кластера хранения, либо направлять ее в изолированный пул облака.

Такой подход повышает устойчивость системы к локальным авариям, гарантируя сохранность и доступность критически важных данных даже при полном отказе базового пула ресурсов.

Графические ускорители NVIDIA H200 NVLink в дата-центре
Конфигурация с ускорителем NVIDIA H200 NVLink для работы с масштабными нейросетями.

Рекурсивный приватный DNS с поддержкой публичных имен

Обновленный приватный DNS-резолвер в панели управления научился обрабатывать запросы не только к внутренней инфраструктуре, но и к внешним публичным доменным именам. Все запросы на резолвинг публичных адресов интегрированы в базовую стоимость сервиса без дополнительной тарификации.

Скорость обработки кэшированных публичных записей находится на одном уровне с внутренними ресурсами: система выдерживает нагрузки более 5000 RPS, а задержка ответа не превышает 1 миллисекунды.

Переход сервиса Managed PostgreSQL на мажорную версию 18

СУБД PostgreSQL в облачном исполнении обновилась до 18-й версии. Главным технологическим новшеством обновленного движка стала поддержка параллельного выполнения нескольких операций чтения с диска, что пришло на смену последовательной обработке запросов.

Параллельный ввод-вывод существенным образом повышает пропускную способность дисковой подсистемы и снижает задержки при исполнении сложных аналитических выборок и транзакций.

Унифицированные StorageClass для Managed Kubernetes

В управляемом сервисе Kubernetes изменился подход к назначению типов дисковых хранилищ. Ранее каждый сегмент пула требовал создания отдельного класса StorageClass, привязанного к конкретной зоне доступности.

Теперь при развертывании кластера автоматически формируется AZ-независимый StorageClass. Компонент cinder самостоятельно достраивает имя целевого сегмента по шаблону (к примеру, выражение fast.ru-1 автоматически превращается в fast.ru-1a для зоны ru-1a). Это позволяет закрыть потребности всех сегментов пула одним классом: планировщик Kubernetes разворачивает поды и связывает их с Persistent Volume Claim точно в тех зонах, куда назначена нагрузка. Для существующих кластеров добавление универсальных StorageClass доступно через обновление манифестов из официального репозитория.

Новые преднастроенные LLM в каталоге ИИ-моделей

Провайдер значительно пополнил библиотеку готовых к развертыванию нейросетевых моделей. Пользователям стали доступны новые архитектуры различного масштаба и квантования:

  • nvidia/Qwen3-VL-235B-A22B-Instruct-NVFP4 — мощная мультимодальная модель с квантованием NVFP4 для обработки текста и изображений;
  • ibm-granite/granite-4.1-30b, granite-4.1-8b и granite-4.1-3b — линейка производительных языковых моделей от IBM для широкого спектра корпоративных задач;
  • t-tech/T-lite-it-2.1-FP8 и t-tech/T-pro-it-2.1-FP8 — оптимизированные инструкционные модели в формате FP8;
  • unsloth/Qwen3.8-27B-NVFP4 — высокоэффективная модификация модели Qwen с ускоренным выводом.

Автоматическое маскирование персональных данных в ИИ-роутере

Сервис ИИ-роутер получил функцию автоматического фильтра и маскирования конфиденциальной информации. Перед отправкой пользовательского промпта во внешний нейросетевой провайдер система сканирует текст на наличие персональных данных и секретов.

При обнаружении чувствительных данных роутер подменяет их обезличенными маркерами или блокирует запрос целиком. Функция работает поверх имеющихся методов API и не требует модификации логики клиентских приложений или смены эндпоинтов.

Новые конфигурации выделенных физических серверов

Аппаратная линейка выделенных серверов пополнилась двумя специализированными конфигурациями под корпоративные и специфические вычислительные задачи:

  • DL-41 Intel Xeon Gold: процессор 18 ядер с частотой 3.1 ГГц, 64 ГБ оперативной памяти DDR4 ECC Reg и два NVMe-накопителя по 960 ГБ. Данная сборка оптимально подходит под базы данных, веб-сервисы средних масштабов и промышленный софт.
  • MAC-M4-2 Apple M4 Pro: 12-ядерный чип с частотой до 4.5 ГГц, 24 ГБ объединенной памяти DDR5 и NVMe SSD объемом 1 ТБ. Сервер предназначен для сборки, тестирования и рендеринга приложений под экосистему Apple, а также задач, чувствительных к скорости межпроцессорного обмена информацией.

Источник: habr.com

01.