All issues
- 2026 Vol. 18
- 2025 Vol. 17
- 2024 Vol. 16
- 2023 Vol. 15
- 2022 Vol. 14
- 2021 Vol. 13
- 2020 Vol. 12
- 2019 Vol. 11
- 2018 Vol. 10
- 2017 Vol. 9
- 2016 Vol. 8
- 2015 Vol. 7
- 2014 Vol. 6
- 2013 Vol. 5
- 2012 Vol. 4
- 2011 Vol. 3
- 2010 Vol. 2
- 2009 Vol. 1
-
Аддитивная регуляризация тематических моделей с быстрой векторизацией текста
Компьютерные исследования и моделирование, 2020, т. 12, № 6, с. 1515-1528Задача вероятностного тематического моделирования заключается в том, чтобы по заданной коллекции текстовых документов найти две матрицы: матрицу условных вероятностей тем в документах и матрицу условных вероятностей слов в темах. Каждый документ представляется в виде мультимножества слов, то есть предполагается, что для выявления тематики документа не важен порядок слов в нем, а важна только их частота. При таком предположении задача сводится к вычислению низкорангового неотрицательного матричного разложения, наилучшего по критерию максимума правдоподобия. Данная задача имеет в общем случае бесконечное множество решений, то есть является некорректно поставленной. Для регуляризации ее решения к логарифму правдоподобия добавляется взвешенная сумма оптимизационных критериев, с помощью которых формализуются дополнительные требования к модели. При моделировании больших текстовых коллекций хранение первой матрицы представляется нецелесообразным, поскольку ее размер пропорционален числу документов в коллекции. В то же время тематические векторные представления документов необходимы для решения многих задач текстовой аналитики — информационного поиска, кластеризации, классификации, суммаризации текстов. На практике тематический вектор вычисляется для каждого документа по необходимости, что может потребовать десятков итераций по всем словам документа. В данной работе предлагается способ быстрого вычисления тематического вектора для произвольного текста, требующий лишь одной итерации, то есть однократного прохода по всем словам документа. Для этого в модель вводится дополнительное ограничение в виде уравнения, позволяющего вычислять первую матрицу через вторую за линейное время. Хотя формально данное ограничение не является оптимизационным критерием, фактически оно выполняет роль регуляризатора и может применяться в сочетании с другими критериями в рамках теории аддитивной регуляризации тематических моделей ARTM. Эксперименты на трех свободно доступных текстовых коллекциях показали, что предложенный метод улучшает качество модели по пяти оценкам качества, характеризующим разреженность, различность, информативность и когерентность тем. Для проведения экспериментов использовались библиотеки с открытымк одомB igARTM и TopicNet.
Ключевые слова: автоматическая обработка текстов, обучение без учителя, тематическое моделирование, аддитивная регуляризация тематических моделей, EM-алгоритм, PLSA, LDA, ARTM, BigARTM, TopicNet.
Additive regularizarion of topic models with fast text vectorizartion
Computer Research and Modeling, 2020, v. 12, no. 6, pp. 1515-1528The probabilistic topic model of a text document collection finds two matrices: a matrix of conditional probabilities of topics in documents and a matrix of conditional probabilities of words in topics. Each document is represented by a multiset of words also called the “bag of words”, thus assuming that the order of words is not important for revealing the latent topics of the document. Under this assumption, the problem is reduced to a low-rank non-negative matrix factorization governed by likelihood maximization. In general, this problem is ill-posed having an infinite set of solutions. In order to regularize the solution, a weighted sum of optimization criteria is added to the log-likelihood. When modeling large text collections, storing the first matrix seems to be impractical, since its size is proportional to the number of documents in the collection. At the same time, the topical vector representation (embedding) of documents is necessary for solving many text analysis tasks, such as information retrieval, clustering, classification, and summarization of texts. In practice, the topical embedding is calculated for a document “on-the-fly”, which may require dozens of iterations over all the words of the document. In this paper, we propose a way to calculate a topical embedding quickly, by one pass over document words. For this, an additional constraint is introduced into the model in the form of an equation, which calculates the first matrix from the second one in linear time. Although formally this constraint is not an optimization criterion, in fact it plays the role of a regularizer and can be used in combination with other regularizers within the additive regularization framework ARTM. Experiments on three text collections have shown that the proposed method improves the model in terms of sparseness, difference, logLift and coherence measures of topic quality. The open source libraries BigARTM and TopicNet were used for the experiments.
-
Модель диффузии технологии, основанная на уравнениях «потребитель – ресурс»
Компьютерные исследования и моделирование, 2026, т. 18, № 4, с. 1035-1052В статье решается актуальная научно-практическая задача математического моделирования и прогнозирования процессов диффузии инноваций и технологических замещений на рынках с ограниченной емкостью. Целью работы является преодоление структурных ограничений классических феноменологических подходов, таких как модели Басса, Гомперца и Мэнсфилда, связанных с жестко фиксированной асимметрией S-образных кривых и отсутствием явного микроэкономического обоснования динамики систем. В основу исследования положен междисциплинарный подход, основанный на переносе экологической концепции рационирования ограниченных ресурсов (модель Ардити–Гинзбурга–Контуа) в теорию операционного менеджмента посредством использования клиринговой функции Кармаркара и производственной функции Леонтьева–Либиха. Автором аналитически выведен альтернативный закон диффузии технологических инноваций, представленный в виде неявной зависимости времени от кумулятивного объема продаж или общего числа потребителей. Для идентификации неизвестных параметров модели по эмпирическим данным применен численный метод инвертирования неявной функции на основе нелинейной оптимизации наименьших квадратов, обеспечивающий высокую вычислительную стабильность алгоритма. Проведена сравнительная эмпирическая верификация предложенного закона в сопоставлении с классическими мировыми аналогами на двух контрастных макроэкономических кейсах: динамике кумулятивных продаж потребительской электроники Apple iPod (сорок девять квартальных точек) и развитии рынка подписок на мобильный интернет в Германии (восемнадцать годовых точек). Оценка качества аппроксимации осуществлялась по критерию остаточной суммы квадратов и коэффициенту детерминации. Показано математическое преимущество авторской модели, продемонстрировавшей наименьшую ошибку невязки на макроэкономических данных высокотехнологичных рынков за счет гибкого параметра асимметрии, адаптирующегося под стартовый лаг-период рынка. Научная новизна работы заключается в фундаментальном обосновании макроэкономической S-кривой через баланс уравнений системы «потребитель–ресурс». Разработанный математический аппарат может быть непосредственно использован аналитическими агентствами, регуляторами сектора информационно-коммуникационных технологий и менеджментом компаний для среднесрочного планирования емкости рынков и прогнозирования точек перегиба, соответствующих пикам темпов технологического замещения.
Ключевые слова: диффузия инноваций, S-кривая, модель Басса, модель Гомперца, клиринговая функция Кармаркара, рационирование ресурсов, нелинейный метод наименьших квадратов, хемостат.
A model for technology diffusion based on the “consumer – resource” equations
Computer Research and Modeling, 2026, v. 18, no. 4, pp. 1035-1052The author presents a new macroeconomic model designed to analyze and forecast technology diffusion processes in markets characterized by bounded capacity. The study addresses the major limitations of classical phenomenological models, such as the Bass and Gompertz frameworks, which suffer from a rigidly fixed trajectory asymmetry and lack explicit microeconomic foundations. To overcome these constraints, we employ an interdisciplinary approach that transfers the ecological concept of limited resource rationing from the Arditi–Ginzburg–Contois model into operations management theory. This framework integrates the Karmarkar clearing function with the Leontief–Liebig production function to establish a rigorous dynamic balance. By applying this integration, the author analytically derives an alternative technological innovation diffusion law that expresses time as an explicit function of the cumulative market volume. To identify parameters from empirical data, the study develops a robust numerical grid inversion algorithm that utilizes vector linear interpolation within the MATLAB computing environment. This approach avoids iterative root-finding errors and ensures high computational stability for the non-linear least squares optimization procedure. We test the empirical validity of the developed diffusion law using two distinct historical macroeconomic cases: the quarterly cumulative sales of the Apple iPod and the annual subscription data for the mobile broadband market in Germany. The resulting statistical metrics demonstrate that the proposed model provides superior approximation quality and mathematical advantages on high-tech market data due to its highly flexible asymmetry parameter. The fundamental scientific novelty of this research lies in the theoretical justification of the macroeconomic S-curve through the internal balance equations of an open chemostat-type system operating under a competitive vacuum. The proposed mathematical apparatus offers a practical tool for corporate management and regulatory agencies to plan market capacity and accurately forecast peak technological substitution rates.
-
Применение статистических методов для выявления аномалий в результатах экзаменов на уровне образовательной организации
Компьютерные исследования и моделирование, 2026, т. 18, № 2, с. 537-552В работе рассматривается задача составления методики выявления аномалий с помощью методов математической статистики в результатах экзаменов на примере Основного государственного экзамена (ОГЭ) по математике 2023–2024 учебного года. Актуальность исследования обусловлена отсутствием обязательного видеоконтроля на ОГЭ в рассматриваемый период, что создает предпосылки для потенциальных процедурных нарушений как со стороны отдельных учащихся, так и в масштабах целых образовательных организаций. На основе анализа распределений первичных баллов были выявлены характерные особенности учебных заведений, свидетельствующие о возможной нечестности при проведении экзамена, в частности резкие скачки функции распределения в области перехода между неудовлетворительной и удовлетворительной оценками. С целью определения наиболее подозрительных результатов были построены два критерия аномальности. Первый критерий основан на сравнении величины скачка эмпирической функции распределения результатов школы с общерегиональным уровнем и позволяет выделить 47 организаций с аномально высокими значениями. Для построения второго (общего) критерия проведено сравнение баллов, полученных учениками школы на ОГЭ и диагностической работе по математике, проведенной в 8 классе с использованием видеоконтроля. Проведение такой аналогии является корректным, так как контингент обучающихся, принимавших участие в каждой из работ, практически совпадает. Данный подход позволяет сузить число выявленных аномалий, отделив те, которые более похожи на нарушения протоколов, от вызванных особенностями конкретного набора обучающихся и их подготовки к экзаменам в определенном учебном заведении. В результате применения одноклассового метода опорных векторов выявлены 12 образовательных организаций с нехарактерными аномальными результатами. Предложенная методика позволяет обнаруживать потенциальные случаи нечестного поведения при проведении экзамена и может быть использована для предотвращения нарушений протоколов с помощью проведения адресной профилактической работы с учебными заведениями.
Ключевые слова: выявление аномалий, статистический анализ, эмпирическая функция распределения, одноклассовый метод опорных векторов, ОГЭ, выявление нарушений.
Statistical methods for detecting anomalies in examination results at the institutional level
Computer Research and Modeling, 2026, v. 18, no. 2, pp. 537-552This study proposes a methodology for anomaly detection in educational assessment data, demonstrated on the case of the 2023–2024 Basic State Exam (BSE) in mathematics in Russia. The relevance of the study is related to the absence of mandatory video surveillance during the examination period, which creates a risk of potential rule violations both by individual students and by entire educational institutions. By analyzing the distribution of primary scores, we identify a big spike in the area between grades 2 and 3 as a specific pattern in results that may indicate cases of cheating during the exam. To determine the most suspicious results, two anomaly criteria were constructed. The first criterion relies on comparing the magnitude of the spike in empirical distribution function in school’s results with the corresponding regional average level. This criterion made it possible to identify 47 educational institutions with abnormally high values of the spike. The second (general) criterion was derived from comparing students’ scores on the examination with their performance on a diagnostic mathematics test conducted in grade 8 under video surveillance. This comparison is appropriate because almost the same group of students took part in both assessments. This approach helps reduce the number of detected anomalies by distinguishing those more likely to reflect actual protocol violations from those arising due to the specific characteristics of a particular student population and their exam preparation within a given educational institution. The application of the oneclass support vector machine method enabled the identification of 12 schools with atypical anomalous results. The proposed methodology could be useful for the detection of potential cases of cheating during exams and the development of methods for preventing such behavior. In particular, it can be used to support targeted preventive work with specific schools in order to reduce the risk of exam rule violations.
-
Оптимальное управление вложением средств банка как фактор экономической стабильности
Компьютерные исследования и моделирование, 2012, т. 4, № 4, с. 959-967В работе представлена модель пополнения банковской ликвидности собственными средствами банков. Дано методологическое обоснование необходимости создания банковских стабилизационных фондов для покрытия убытков в период кризиса в экономике. Приводится эконометрический вывод уравнений описывающих поведение банка в финансовой и операционной деятельности. В соответствии с поставленной целью создания стабилизационного фонда вводится критерий оптимальности осуществляемого управления. На основе полученных уравнений поведения банка, методом динамического программирования выводится вектор оптимальных управлений.
Ключевые слова: банковская ликвидность, стабилизационный фонд, нелинейная регрес- сия, доход функция, критерий, оптимальное управление, динамическое программирование.
Optimal control of bank investment as a factorof economic stability
Computer Research and Modeling, 2012, v. 4, no. 4, pp. 959-967Views (last year): 5.This paper presents a model of replenishment of bank liquidity by additional income of banks. Given the methodological basis for the necessity for bank stabilization funds to cover losses during the economy crisis. An econometric derivation of the equations describing the behavior of the bank financial and operating activity performed. In accordance with the purpose of creating a stabilization fund introduces an optimality criterion used controls. Based on the equations of the behavior of the bank by the method of dynamic programming is derived a vector of optimal controls.
Indexed in Scopus
Full-text version of the journal is also available on the web site of the scientific electronic library eLIBRARY.RU
The journal is included in the Russian Science Citation Index
The journal is included in the RSCI
International Interdisciplinary Conference "Mathematics. Computing. Education"




