Версия 6.7.3 (6.7.3-11949)#
Дата выхода: 4 августа 2026 г.
Обзор#
В этом выпуске Кибер Инфраструктуры представлен ряд исправлений, улучшающих стабильность работы хранилища объектов, служб высокой доступности и вычислений, службы блочного хранения и панели управления.
Что нового#
Распределённый дисковый массив
[CPS05-8584] Реализовано мультимонтирование хранилища для увеличения пропускной способности узлов кластера.
[CPS05-10203] Добавлен ежедневный сбор отчетов основного хранилища в локальной папке для быстрой диагностики в случае возможных будущих инцидентов.
[CPS05-10841] Реализованы параметры для тонкой настройки RDMA для сетей RoCE.
[CPS05-10845] Добавлена группировка статистики по точкам монтирования узла в выводе команды мониторинга vstorage top.
[CPS05-9466] Добавлены параметры для тонкой настройки сборщика мусора.
[CPS05-10475] Добавлена утилита vstorage-gc-rate для мониторинга работы сборщика мусора.
[CPS05-10813] Увеличено максимальное значение параметра основного хранилища mds.wd.offline_tout_mnt до 30 суток.
[CPS05-10835] Увеличено максимальное значение параметра основного хранилища mds.wd.offline_tout до 30 суток.
Панель управления
[CPS05-10010] Добавлена возможность уменьшения порога срабатывания проверок стабильности сетевого соединения.
[CPS05-10040] Добавлены SNMP-метрики вычислительного кластера.
Хранилище объектов
[CPS05-11223] Добавлен параметр для отключения функций службы ACC.
[CPS05-8247] Реализована возможность изменения уровня журналирования без перезапуска служб.
[CPS05-8460] Добавлен параметр S3GW.eventual_consistency=1 для возврата кода 200 вместо 409 для запросов CompleteMultipartUpload.
[CPS05-9290] Реализован код ответа 503 (Slow down) для случая переполнения очередей служб OS и других внутренних перегрузок.
[CPS05-10035] Добавлен параметр для изменения chunk_size при создании тома.
[CPS05-10036] Добавлен параметр NS.gc_max_pending для регулировки агрессивности сборщика мусора.
[CPS05-10247] Реализованы метрики работы конфигурации жизненного цикла объектов.
[CPS05-10184] Добавлена возможность создания 4096 служб NS.
[CPS05-10318] Реализовано сжатие конфигурации кластера при передаче между службами. Добавлена возможность создания до 10 000 служб в кластере.
[CPS05-10475] Добавлена утилита ostor-gc-rate для мониторинга работы сборщика мусора.
Служба высокой доступности
[CPS05-8409] Добавлен параметр SELF_HEALING_REBOOT_ENABLED.
Исправленные проблемы#
Хранилище объектов
[CPS05-10195] Игнорируется значение параметра "максимальное количество сервисов управления" при создании кластера.
[CPS05-10190] Перед удалением кластера не удаляется том перед удалением служб, что приводит к лишней миграции служб между узлами и долгому удалению.
[CPS05-11154] Удаление кластера S3 может завершаться ошибкой.
[CPS05-11258] В некоторых случаях освобождение узла с главной службой CFGD завершается с ошибкой.
[CPS05-11353] Удаление кластера в некоторых случаях завершается с ошибкой "Object storage Cluster not found".
[CPS05-7061] Сбой службы S3GW с ошибкой "BUG at pcs_ostor_api_io.c:550/put_buffer_filled()" при использовании метода загрузки объектов chunked upload без заголовка aws-chunked.
[CPS05-8126] Зависание операции удаления корзины, у которой есть незавершённая операция загрузки по частям и которой назначены теги, конфигурация жизненного цикла объекта или политика корзины.
[CPS05-11138] Некорректная работа фильтров конфигурации жизненного цикла объекта (по размеру и тегам) на объектах с несколькими версиями.
[CPS05-9802] Лишнее включение георепликации пользователя после команды reload-gr-config.
[CPS05-7268] Реализован запрет на включение георепликации системного пользователя.
[CPS05-10954] Некорректная обработка заголовка if-unmodified-since.
[CPS05-11318] Переполнение очереди службы OS при случайном сбое разделения служб под нагрузкой.
[CPS05-11270] Нельзя настроить репликацию пользователей S3 до настройки георепликации S3.
[CPS05-11546] Служба ACC произвольно переходит в состояние Inactive из-за взаимной блокировки.
[CPS05-11605] Оптимизированы настройки nginx в файле конфигурации, генерируемом ostor-configure-nginx.
[CPS05-7866] Неисправный сбор статистики службы ACC (большое колическтво обращений к службе NS).
[CPS05-9230] Нет возможности настраивать кэш блоков служб OS и NS.
[CPS05-8779] Не задано ограничение повторов запросов в защите от переполнения запросами службы S3GW.
[CPS05-7881] Не балансируются os.data по разным точкам монтирования из-за абсолютной ссылки.
[CPS05-8217] Сбой ostor-s3-admin во время получения статистики по классу хранения.
[CPS05-3710] Попытка удаления владельца существующей корзины S3 обрабатывается некорректно.
[CPS05-9385] Возникает ошибка 502 службы S3GW, если отправить пустое значение тега в массиве.
[CPS05-8872] Сбой службы S3GW при недоступности службы NS.
[CPS05-7249] Сбой ostor-s3-cmd.
[CPS05-9196] Некорректная работа предоставления прав доступа через политику корзины для метода PutBucketVersioning.
[CPS05-9192] Не срабатывает политика доступа s3:FullAccess при записи объекта с помощью PutObject.
[CPS05-8952] Гонка за ресурсы в agentd.
[CPS05-9479] Ошибочные предупреждения "Transport endpoint is not connected" в журналах служб.
[CPS05-9497] Неверная обработка одиночного тега ExpiredObjectDeleteMarker.
[CPS05-8456] Конфигурация жизненного цикла объектов удаляет объекты несмотря на ObjectLock.
[CPS05-9603] Не работает скрипт для резервного копирования корзин s3_backup.
[CPS05-9644] Случайная проблема удаления записанных объектов.
[CPS05-9682] Случайная проблема при выполнении PutTagging.
[CPS05-9396] Георепликация между тремя зонами останавливается в случае ошибки репликации в одной из зон.
[CPS05-9775] Out-of-bounds Write при работе с метаданными объектов.
[CPS05-6836] Сбой agentd при большом количестве служб S3GW.
[CPS05-10155] Службы S3GW прекращают работу с ошибкой 502 при высокой нагрузке.
[CPS05-10204] Медленно работают системные утилиты ostor-ctl и ostor-s3-admin при большом количестве служб.
[CPS05-10181] Падение производительности, когда общее количество служб превышает 744.
[CPS05-10247] Конфигурация жизненного цикла объекта не обрабатывает часть объектов в корзине или делает это долго.
[CPS05-10317] Блокировка операций PUT в случае удаления целого subrange в корзине после разделения соответствующей службы NS. Ограничение: теперь нельзя удалять корзину под нагрузкой, иначе можно получить ложное подтверждение операции PUT.
[CPS05-10422] Потеря настроек службы ostor-agentd после операции unfence на узле в shaman.
[CPS05-10148] Массовые утечки памяти в службе S3GW при георепликации.
[CPS05-10247] Массовые утечки памяти в службе ACC.
[CPS05-10148] Второй разрешенный пользователь корзины (согласно политки корзины) не может удалять версии объектов.
[CPS05-6455] Заглавные буквы в имени домена S3 останавливают работу георепликации.
[CPS05-7406] Не работает метод PutBucketLogging.
[CPS05-10596] Ошибка при работе политки корзины и обращении к единой точке доступа в сценарии катастрофоустойчивого кластера.
[CPS05-10849] Сбой в работе службы shaman при использовании нескольких точек монтирования на узле.
[CPS05-10681] Сбой службы ACC во время разделения службы NS.
[CPS05-10914] Некорректное вычисление Etag при использовании метода загрузки объектов chunked upload.
Распределённый дисковый массив
[CPS05-9456] Некорректно отображаются большие значения CLID в выводе команды vstorage top.
[CPS05-10842] Основная точка монтирования на узле может загрузиться не первой.
[CPS05-10890] Уменьшено на единицу значение толерантности по умолчанию при использовании схем избыточности с пониженной зоной отказа.
Служба высокой доступности
[CPS05-8742] После перехода кластера в состояние soft_lockout_state по причине отключения от сети Storage и подключения к ней обратно shaman не перезагружает узел, который привел кластер в это состояние.
[CPS05-8803] Задается статус suspend до достижения NODE_CRASH_PER_HOUR_THRESHOLD.
[CPS05-8635] Не эвакуируются ресурсы после достижения NODE_CRASH_PER_HOUR_THRESHOLD.
[CPS05-10444] Кластер не выходит автоматически из состояний soft и hard lockout.
Служба вычислений
[CPS05-10105] Некорректные настройки высокой доступности брокера сообщений RabbitMQ при наличии пяти и более узлов в кластере.
[CPS05-10260] Поломка ВМ, находящейся в состоянии эвакуации, после попытки ее переноса DRS-балансировщиком.
[CPS05-9468] Случайная поломка переноса и запуска ВМ после развертывания или переконфигурации вычислительного кластера.
[CPS05-10380] Некорректный статус ВМ в случае, когда узел кластера был нештатно выключен и отключена эвакуация ВМ.
[CPS05-10762] Добавлены параметры для отключения аварийного дампа памяти системы в ВМ.
[CPS05-10982] Не эвакуируются ВМ с достаточной избыточностью хранения после потери в кластере зоны отказа с локальными ВМ без необходимой для миграции избыточности.
Служба блочного хранения
[CPS05-10125] Нестабильность переключения пути на инициаторе при потере активного пути.
Панель управления
[CPS05-11221] Не включается по умолчанию проверка контрольных сумм для SSD-диска при присоединении узла.
[CPS05-10891] Уменьшена толерантность к отказам для кластеров с пониженной зоной отказа с N до N-1.
Получение версии
Кибер Инфраструктуру версии 6.7.1 можно обновить до версии 6.7.3 в разделе Настройки → Обновить. Если вы используете или собираетесь использовать объектное хранилище, то новая функция "мультимонтирование хранилища" будет работать только после первой перезагрузки.
Обновить облачные установки можно из репозитория или скачав и развернув соответствующий образ (по мере их появления).