Влияние стратегий аннотации и масштаба входных данных на эффективность семантической сегментации океанических вихрей; Известия Томского политехнического университета [Известия ТПУ]. Промышленная кибернетика; Т. 4, № 2
| Parent link: | Известия Томского политехнического университета [Известия ТПУ]. Промышленная кибернетика: рецензируемый научный журнал/ Национальный исследовательский Томский политехнический университет.— .— Томск: ТПУ, 2023-.— 2949-5407 Т. 4, № 2.— 2026.— С. 35-47 |
|---|---|
| Other Authors: | , , , , |
| Summary: | Проведен аналитический обзор публикаций по семантической сегментации океанических вихрей. Показано, что архитектуры глубокого обучения, основанные на трансформерах, благодаря механизму самовнимания наилучший вариант определения типа и общего контура вихря. Для оценки влияния стратегий аннотации и масштаба входных данных на качество сегментации с использованием модели SegFormer-B4 были сформированы наборы данных с масштабами 256×256, 512×512 и 1024×1024 пикселей. В экспериментах сравнивались два принципиально разных подхода к разметке изображений – детальная ручная аннотация (с филаментами) и упрощенная эллиптическая маска (без филаментов). Установлено, что модель, обученная на данных с включением спиральных филаментов, демонстрирует существенно более высокое качество сегментации по таким ключевым метрикам, как коэффициент Дайса (Dice Score) и индекс Жаккара (IoU). Выявлен оптимальный пространственный масштаб входных данных. Наилучшие показатели были достигнуты при использовании изображений размером 512×512 пикселей, что соответствовало исходному разрешению использованной предобученной модели SegFormer-B4. Сформулированы рекомендации по выбору стратегии аннотирования в зависимости от цели анализа – обнаружение наличия вихрей или точное восстановление их морфометрических характеристик An analytical review of publications on the semantic segmentation of ocean eddies has been conducted. It was shown that transformer-based deep learning architectures, thanks to the self-attention mechanism, are the best option for determining the type and general contour of a eddies. To assess the impact of annotation strategies and input data scale on segmentation quality using the SegFormer-B4 model, the datasets with dimensions of 256×256, 512×512, and 1024×1024 pixels were created. The experiments compared two fundamentally different approaches to image annotation – detailed manual annotation (including filaments) and a simplified elliptical mask (excluding filaments). It was found that the model trained on data including spiral filaments demonstrated significantly higher segmentation quality according to key metrics such as the Dice score and the Intersection over Union (IoU). The authors identified the optimal spatial scale of the input data. The best results were achieved using images measuring 512×512 pixels, which corresponded to the native resolution of the pre-trained SegFormer-B4 model used. The authors formulated the recommendations regarding the choice of annotation strategy depending on the objective of the analysis – detecting the presence of vortices or accurately reconstructing their morphometric characteristics Текстовый файл |
| Language: | Russian |
| Published: |
2026
|
| Subjects: | |
| Online Access: | b_TPU_IndCyb-2026-v4-i2-05.pdf https://doi.org/10.18799/29495407/2026/2/126 |
| Format: | Electronic Book Chapter |
| KOHA link: | https://koha.lib.tpu.ru/cgi-bin/koha/opac-detail.pl?biblionumber=688008 |