Текущий выпуск Номер 4, 2026 Том 18

Все выпуски

Результаты поиска по 'model identification':
Найдено статей: 45
  1. Шахин Л., Рашид Б., Mazzara M.
    Новый подход к самообучению для обнаружения видов деревьев с использованием гиперспектральных и лидарных данных
    Компьютерные исследования и моделирование, 2024, т. 16, № 7, с. 1747-1763

    Точное определение деревьев имеет решающее значение для экологического мониторинга, оценки биоразнообразия и управления лесными ресурсами. Традиционные методы ручного обследования трудоемки и неэффективны на больших территориях. Достижения в области дистанционного зондирования, включая лидар и гиперспектральную съемку, способствуют автоматизированному и точному обнаружению в различных областях.

    Тем не менее, эти технологии обычно требуют больших объемов размеченных данных и ручной инженерии признаков, что ограничивает их масштабируемость. Данное исследование предлагает новый метод самообучения (Self-Supervised Learning, SSL) с использованием архитектуры SimCLR для улучшения классификации видов деревьев на основе неразмеченных данных. Модель SSL автоматически обнаруживает сильные признаки, объединяя спектральные данные гиперспектральной съемки со структурными данными лидара, исключая необходимость ручного вмешательства.

    Мы оцениваем производительность модели SSL по сравнению с традиционными классификаторами, такими как Random Forest (RF), Support Vector Machines (SVM), а также методами обучения с учителем, используя набор данных конкурса ECODSE, который включает как размеченные, так и неразмеченные образцы видов деревьев на биологической станции Ordway-Swisher во Флориде. Метод SSL показал значительно более высокую эффективность по сравнению с традиционными методами, продемонстрировав точность 97,5% по сравнению с 95,56% для Semi-SSL и 95,03% для CNN при обучении с учителем.

    Эксперименты по выборке показали, что техника SSL остается эффективной при меньшем количестве размеченных данных, и модель достигает хорошей точности даже при наличии всего 20% размеченных образцов. Этот вывод демонстрирует практическое применение SSL в условиях недостаточного объема размеченных данных, таких как мониторинг лесов в больших масштабах.

    Shaheen L., Rasheed B., Mazzara M.
    Tree species detection using hyperspectral and Lidar data: A novel self-supervised learning approach
    Computer Research and Modeling, 2024, v. 16, no. 7, pp. 1747-1763

    Accurate tree identification is essential for ecological monitoring, biodiversity assessment, and forest management. Traditional manual survey methods are labor-intensive and ineffective over large areas. Advances in remote sensing technologies including lidar and hyperspectral imaging improve automated, exact detection in many fields.

    Nevertheless, these technologies typically require extensive labeled data and manual feature engineering, which restrict scalability. This research proposes a new method of Self-Supervised Learning (SSL) with the SimCLR framework to enhance the classification of tree species using unlabelled data. SSL model automatically discovers strong features by merging the spectral data from hyperspectral data with the structural data from LiDAR, eliminating the need for manual intervention.

    We evaluate the performance of the SSL model against traditional classifiers, including Random Forest (RF), Support Vector Machines (SVM), and Supervised Learning methods, using a dataset from the ECODSE competition, which comprises both labeled and unlabeled samples of tree species in Florida’s Ordway-Swisher Biological Station. The SSL method has been demonstrated to be significantly more effective than traditional methods, with a validation accuracy of 97.5% compared to 95.56% for Semi-SSL and 95.03% for CNN in Supervised Learning.

    Subsampling experiments showed that the SSL technique is still effective with less labeled data, with the model achieving good accuracy even with only 20% labeled data points. This conclusion demonstrates SSL’s practical applications in circumstances with insufficient labeled data, such as large-scale forest monitoring.

  2. В настоящей работе представлена методика оценки функционирования сложных систем с учетом типа распределения показателей, характеризующих функционирование структурных элементов такой системы, действующей в условиях неопределенности. В отличие от ранее проведенных исследований, в работе осуществлена интеграция идентификации типа распределения индикаторов с их байесовской оценкой с учетом нормативов, характеризующих требуемые результаты функционирования структурных элементов системы. Тип распределения и его характеристики дают более полную информацию о свойствах объекта, и их учет влияет на результаты оценки функционирования элементов сложных систем, особенно в случаях наличия «тяжелых» хвостов, характерных для ряда социально-экономических процессов и систем. Показано, что идентификацию типа распределения целесообразно осуществлять по модифицированным за счет исключения наилучшего по статистическим характеристикам тренда данным. Определение наилучшего типа распределения осуществляется по критерию согласия Колмогорова–Смирнова, показавшему лучшие (по имеющееся выборке), по сравнению с другими критериями или их смесью, статистические оценки. Полученный тип распределения используется при вероятностной оценке результатов функционирования элементов подсистемы на основе байесовских интеллектуальных технологий, успешно работающих в условиях неопределенности и которые дают возможность представить такие результаты на числовой и лингвистической шкалах в общей иерархической информационной модели. Методика была апробирована на примере объектной подсистемы (пространственно-временная классификация Г.Б. Клейнера) экономической подсистемы Тульской области. В качестве показателей оценки были использованы объемы валового регионального продукта по шести разделам общероссийского классификатора видов экономической деятельности (разделы A, B, C, D, E). В некоторых случаях удается снизить уровень неопределенности в оценках показателей; получить более строгие по отношению к нормативу оценки, что в итоге позволяет сделать вывод, что использование типа распределения при формировании вероятностных оценок показателей структурных элементов сложных систем дает возможность обосновать их корректное применение в рамках концепции доказательного моделирования.

    Zhukov R.A., Prachev A.D., Lamzina E.A.
    Identification of the type of distribution and its application in assessing the functioning of complex systems based on Bayesian intelligent technologies
    Computer Research and Modeling, 2026, v. 18, no. 4, pp. 1021-1034

    This study presents a methodology for assessing the functioning of complex systems, taking into account the type of distribution of indicators characterizing the functioning of structural elements of such a system operating under conditions of uncertainty. Unlike previous studies, the work integrates the identification of the type of indicator distribution with their Bayesian assessment, taking into account the norms characterizing the required results of the functioning of the structural elements of the system. The type of distribution and its characteristics provide more complete information about the properties of an object and their consideration affects the results of evaluating the functioning of elements of complex systems, especially in cases of the presence of “heavy” tails characteristic of a number of socio-economic processes and systems. It is shown that it is advisable to identify the type of distribution based on modified data due to the exclusion of the best trend in statistical characteristics. The determination of the best type of distribution is carried out according to the Kolmogorov – Smirnov agreement criterion, which showed the best (according to the available sample) statistical estimates compared to other criteria or a mixture of them. The obtained type of distribution is used in the probabilistic assessment of the results of the functioning of subsystem elements based on Bayesian intelligent technologies that successfully operate in conditions of uncertainty, and which make it possible to present such results on numerical and linguistic scales in a general hierarchical information model. The methodology was tested using the example of the object subsystem (G.B.Kleiner’s spatio-temporal classification) of the economic subsystem of the Tula region, considered as a complex system — a socio-ecological-economic system. The volume of gross domestic product by region in six sections of the all-Russian classifier of economic activities (sections A, B, C, D, E) was used as assessment indicators. In some cases, it is possible to reduce the level of uncertainty in the estimates of indicators.; to obtain estimates that are more stringent than the norm, which ultimately leads to the conclusion that the use of the distribution type in the formation of probabilistic estimates of indicators of structural elements of complex systems makes it possible to justify their correct application within the framework of the concept of evidence-based modeling.

  3. Печников А.А.
    Применение индекса дружбы и фильтра диспаритета для анализа библиометрических журнальных сетей
    Компьютерные исследования и моделирование, 2026, т. 18, № 2, с. 519-535

    Традиционный подход к исследованию коммуникаций между журналами заключается в исследовании журнальных графов цитирования. В работе предложен подход к анализу сети журналов с использованием библиометрического графа нового типа — графа журнальных пересечений, основанного на бинарной операции пересечения множеств, — с применением методов, основанныхна индексе дружбы и функции диспаритета. Подход демонстрируется на относительно небольшом примере реальной сети журналов, данные о которых содержатся в информационной системе Общероссийского портала Math-Net.Ru: 63 журнала за 2008–2021 годы, удовлетворяющие определенным требованиям и содержащие почти 69 тысяч статей, принадлежащих 54 тысячам авторов. Математическая модель этой реальной сети представляется графом пересечений с использованием коэффициента Жаккара, обладающим специфическими свойствами: малая размерность, высокая плотность графа, распределение весов ребер не аппроксимируется степенной функцией. К полученным результатам относится сетевая структура связей множества исследуемых журналов, учитывающая степень их взаимодействия, и выявление значимых вершин с использованием индекса дружбы, улавливающее его структурные свойства и имеющее очевидную содержательную интерпретацию, позволяющее ранжировать журналы по данному показателю. Тем самым реализуется инструмент для различения вершин-лидеров по индексу дружбы и «сетевых интеграторов» (closeness/betweenness) и демонстрируется качественное изменение структурных свойств при снижении плотности и сохранении связности графа, достигаемого применением функцией диспаритета. Последовательное применение функции диспаритета при уменьшении порога значимости позволяет выявить ядро графа, содержащее наиболее сильно связанные вершины, что в свою очередь позволяет определить множество вершин (и, соответственно, журналов), одновременно входящих в ядро и имеющих наивысшую значимость по индексу дружбы. Анализ уровней полученного множества журналов в «Белом списке» подтверждает высокий рейтинг этих журналов. Полученные результаты дают более глубокое понимание структуры отношений в сетях научных журналов и определяют новые подходы к их исследованию.

    Pechnikov A.A.
    Application of the friendship index and disparity filter for the analysis of bibliometric journal networks
    Computer Research and Modeling, 2026, v. 18, no. 2, pp. 519-535

    The traditional approach to studying inter-journal communication involves analyzing journal citation graphs. This paper proposes a method for analyzing journal networks using a new type of bibliometric graph — a journal intersection graph based on the binary operation of set intersection — employing techniques grounded in the friendship index and the disparity function. The approach is demonstrated using a relatively small example of a real journal network, with data sourced from the All-Russian portal Math-Net.Ru information system: 63 journals from 2008–2021 meeting specific criteria, containing almost 69 thousand articles authored by 54 thousand individuals. The mathematical model of this real-world network is represented as an intersection graph using the Jaccard coefficient, which exhibits specific properties: low dimensionality, high graph density, and an edge weight distribution that is not approximated by a power law function. The obtained results include the network structure of connections within the studied set of journals, accounting for their degree of interaction, and the identification of significant vertices using the friendship index. This captures the graph’s structural properties, offers an obvious substantive interpretation, and allows for ranking journals by this metric. Thus, the method implements a tool for distinguishing between vertices that are leaders in terms of the friendship index and “network integrators” (based on closeness/betweenness centrality). It also demonstrates a qualitative change in structural properties when reducing graph density while maintaining connectivity, achieved by applying the disparity function. The sequential application of the disparity function while lowering the significance threshold allows for the identification of the graph’s core, containing the most strongly connected vertices. This, in turn, enables the determination of a set of vertices (and corresponding journals) that are simultaneously part of the core and have the highest significance according to the friendship index. An analysis of the levels of this resulting journal set within the “Belyi Spisok” (“White List”) shows these journals have a high rating. The findings provide a deeper understanding of the relationship structure within scientific journal networks and define new approaches for their study.

  4. Стрыгин Н.А., Кудасов Н.Д.
    Графовая сверточная нейронная сеть для быстрого и точного дизассемблирования инструкций x86
    Компьютерные исследования и моделирование, 2024, т. 16, № 7, с. 1779-1792

    Дизассемблирование двоичных файлов x86 — важная, но нетривиальная задача. Дизассемблирование трудно выполнить корректно без отладочной информации, особенно на архитектуре x86, в которой инструкции переменного размера чередуются с данными. Более того, наличие непрямых переходов в двоичном коде добавляет еще один уровень сложности. Непрямые переходы препятствуют возможности рекурсивного обхода, распространенного метода дизассемблирования, успешно идентифицировать все инструкции в коде. Следовательно, дизассемблирование такого кода становится еще более сложным и требовательным, что еще больше подчеркивает проблемы, с которыми приходится сталкиваться в этой области. Многие инструменты, включая коммерческие, такие как IDA Pro, с трудом справляются с точным дизассемблированием x86. В связи с этим был проявлен определенный интерес к разработке более совершенного решения с использованием методов машинного обучения, которое потенциально может охватывать базовые, независимые от компилятора паттерны, присущие машинному коду, сгенерированному компилятором. Методы машинного обучения могут превосходитьпо точности классические инструменты. Их разработка также может занимать меньше времени по сравнению с эвристическими методами, реализуемыми вручную, что позволяет переложитьо сновную нагрузку на сбор большого представительного набора данных исполняемых файлов с отладочной информацией. Мы усовершенствовали существующую архитектуру на основе рекуррентных графовых сверточных нейронных сетей, которая строит граф управления и потоков для дизассемблирования надмножеств инструкций. Мы расширили граф информацией о потоках данных: при кодировании входной программы, мы добавляем ребра потока управления и зависимостей от регистров, вдохновленные вероятностным дизассемблированием. Мы создали открытый набор данных для идентификации инструкций x86, основанный на комбинации набора данных ByteWeight и нескольких пакетов Debian с открытым исходным кодом. По сравнению с IDA Pro, современным коммерческим инструментом, наш подход обеспечивает более высокую точность при сохранении высокой производительности в наших тестах. Он также хорошо себя показывает по сравнению с существующими подходами машинного обучения, такими как DeepDi.

    Strygin N.A., Kudasov N.D.
    Fast and accurate x86 disassembly using a graph convolutional network model
    Computer Research and Modeling, 2024, v. 16, no. 7, pp. 1779-1792

    Disassembly of stripped x86 binaries is an important yet non-trivial task. Disassembly is difficult to perform correctly without debug information, especially on x86 architecture, which has variablesized instructions interleaved with data. Moreover, the presence of indirect jumps in binary code adds another layer of complexity. Indirect jumps impede the ability of recursive traversal, a common disassembly technique, to successfully identify all instructions within the code. Consequently, disassembling such code becomes even more intricate and demanding, further highlighting the challenges faced in this field. Many tools, including commercial ones such as IDA Pro, struggle with accurate x86 disassembly. As such, there has been some interest in developing a better solution using machine learning (ML) techniques. ML can potentially capture underlying compiler-independent patterns inherent for the compiler-generated assembly. Researchers in this area have shown that it is possible for ML approaches to outperform the classical tools. They also can be less timeconsuming to develop compared to manual heuristics, shifting most of the burden onto collecting a big representative dataset of executables with debug information. Following this line of work, we propose an improvement of an existing RGCN-based architecture, which builds control and flow graph on superset disassembly. The enhancement comes from augmenting the graph with data flow information. In particular, in the embedding we add Jump Control Flow and Register Dependency edges, inspired by Probabilistic Disassembly. We also create an open-source x86 instruction identification dataset, based on a combination of ByteWeight dataset and a selection open-source Debian packages. Compared to IDA Pro, a state of the art commercial tool, our approach yields better accuracy, while maintaining great performance on our benchmarks. It also fares well against existing machine learning approaches such as DeepDi.

  5. Каменев Г.К., Каменев И.Г.
    Многокритериальный метрический анализ данных при моделировании человеческого капитала
    Компьютерные исследования и моделирование, 2020, т. 12, № 5, с. 1223-1245

    В статье описываетсявы числимаям одель человека в информационной экономике и демонстрируется многокритериальный оптимизационный подход к метрическому анализу модельных данных. Традиционный подход к идентификации и исследованию модели предполагает идентификацию модели по временным рядам и прогнозирование дальнейшей динамики ряда. Однако этот подход неприменим к моделям, некоторые важнейшие переменные которых не наблюдаютсяя вно, и известны только некоторые типичные границы или особенности генеральной совокупности. Такая ситуация часто встречается в социальных науках, что делает модели сугубо теоретическими. Чтобы избежать этого, для (неявной) идентификации и изучения таких моделей предлагается использовать метод метрического анализа данных (MMDA), основанный на построении и анализе метрических сетей Колмогорова – Шеннона, аппроксимирующих генеральную совокупность данных модельной генерации в многомерном пространстве социальных характеристик. С помощью этого метода идентифицированы коэффициенты модели и изучены особенности ее фазовых траекторий. Представленнаяв статье модель рассматривает человека как субъекта, обрабатывающего информацию, включая его информированность и когнитивные способности. Составлены пожизненные индексы человеческого капитала: креативного индивида (обобщающего когнитивные способности) и продуктивного (обобщает объем освоенной человеком информации). Поставлена задача их многокритериальной (двухкритериальной) оптимизации с учетом ожидаемой продолжительности жизни. Такой подход позволяет выявить и экономически обосновать требования к системе образования и социализации (информационному окружению) человека до достиженияим взрослого возраста. Показано, что в поставленной оптимизационной задаче возникает Парето-граница, причем ее тип зависит от уровня смертности: при высокой продолжительности жизни доминирует одно решение, в то время как для более низкой продолжительности жизни существуют различные типы Парето-границы. В частности, в случае России применим принцип Парето: значительное увеличение креативного человеческого капитала индивида возможно за счет небольшого сниженияпр одуктивного человеческого капитала (обобщение объема освоенной человеком информации). Показано, что рост продолжительности жизни делает оптимальным компетентностный подход, ориентированный на развитие когнитивных способностей, в то время как при низкой продолжительности жизни предпочтительнее знаниевый подход.

    Kamenev G.K., Kamenev I.G.
    Multicriterial metric data analysis in human capital modelling
    Computer Research and Modeling, 2020, v. 12, no. 5, pp. 1223-1245

    The article describes a model of a human in the informational economy and demonstrates the multicriteria optimizational approach to the metric analysis of model-generated data. The traditional approach using the identification and study involves the model’s identification by time series and its further prediction. However, this is not possible when some variables are not explicitly observed and only some typical borders or population features are known, which is often the case in the social sciences, making some models pure theoretical. To avoid this problem, we propose a method of metric data analysis (MMDA) for identification and study of such models, based on the construction and analysis of the Kolmogorov – Shannon metric nets of the general population in a multidimensional space of social characteristics. Using this method, the coefficients of the model are identified and the features of its phase trajectories are studied. In this paper, we are describing human according to his role in information processing, considering his awareness and cognitive abilities. We construct two lifetime indices of human capital: creative individual (generalizing cognitive abilities) and productive (generalizing the amount of information mastered by a person) and formulate the problem of their multi-criteria (two-criteria) optimization taking into account life expectancy. This approach allows us to identify and economically justify the new requirements for the education system and the information environment of human existence. It is shown that the Pareto-frontier exists in the optimization problem, and its type depends on the mortality rates: at high life expectancy there is one dominant solution, while for lower life expectancy there are different types of Paretofrontier. In particular, the Pareto-principle applies to Russia: a significant increase in the creative human capital of an individual (summarizing his cognitive abilities) is possible due to a small decrease in the creative human capital (summarizing awareness). It is shown that the increase in life expectancy makes competence approach (focused on the development of cognitive abilities) being optimal, while for low life expectancy the knowledge approach is preferable.

Страницы: « первая предыдущая

Журнал индексируется в Scopus

Полнотекстовая версия журнала доступна также на сайте научной электронной библиотеки eLIBRARY.RU

Журнал включен в базу данных Russian Science Citation Index (RSCI) на платформе Web of Science

Международная Междисциплинарная Конференция "Математика. Компьютер. Образование"

Международная Междисциплинарная Конференция МАТЕМАТИКА. КОМПЬЮТЕР. ОБРАЗОВАНИЕ.