П.Н. Афонин. «Информационные таможенные технологии»
Фасетная система характеризуется следующими особенностями построения:
• имеется некоторое множество классифицируемых объектов (М0). Это множество можно рассматривать в нескольких аспектах, каждый из которых может характеризоваться одним или несколькими признаками, образующими фасет Фг;
• устанавливается некоторый порядок следования фасетов с помощью фасетной формулы (при этом последовательность фасетов определяется по частоте обращения к этим фасетам на некотором множестве заданных задач):
F = (Ф1, Ф2, ..., Фк,Фг);
• определяется количество подмножеств классификационных группировок, число которых определяется числом задач, обращающихся при своем решении к тем или иным фасетам (рис. 17).
Рис. 17. Схема построения фасетной системы классификации
Внутри фасета значения признаков могут просто перечисляться по некоторому порядку или образовывать сложную иерархическую структуру, если существует соподчиненность выделенных признаков.
К преимуществам данной системы следует отнести большую емкость системы и высокую степень гибкости, поскольку при необходимости можно вводить дополнительные фасеты и изменять их место в формуле. К недостаткам, характерным для данной системы, можно отнести сложность структуры и низкую степень заполненности системы.
Рассмотренные выше системы классификации хорошо приспособлены для организации поиска с целью последующей логической и арифметической обработки информации на ЭВМ и лишь частично решают проблему содержательного поиска экономической информации при принятии управленческих решений. Это объясняется далеко не полным охватом этими системами всех понятий и терминов, используемых для выражения смысла экономических показателей и документов. Помимо этого в этих системах не решается проблема обеспечения однозначности используемой терминологии, идентификации роли отдельных терминов в их общей последовательности при формировании наименований экономических показателей. К недостаткам этих систем классификации можно отнести также и то, что в них не отражаются все отношения между терминами, необходимые для формализации содержания показателей и документов и установления взаимосвязей между показателями и документами, которые используются на этапе принятия управленческих решений.
Для поиска показателей и документов по набору содержательных признаков используется информационный язык дескрипторного типа, который характеризуется совокупностью терминов, дескрипторов или лексикой и набором отношений между терминами.
Типичным примером дескрипторных языков являются классификационные языки, основанные на использовании иерархической и многоаспектной систем классификации, преимущества и недостатки которых были рассмотрены выше.
К языкам классификационного типа можно отнести существующий Общесистемный классификатор технико-экономических показателей (ОКТЭП). Он содержит способ упорядоченного представления системы показателей и средства их взаимной увязки на основе многоаспектной классификации этих показателей, которая должна отражать наиболее существенные с точки зрения народного хозяйства методологические особенности их расчета, взаимосвязи показателей, наиболее важные признаки группировки показателей и их поиска в экономических информационных системах.
Общим недостатком информационных языков классификационного типа являются их слабая приспособленность к новым, заранее не предусмотренным условиям функционирования систем, возможность составления запросов на этих языках регламентированного содержания. Эти недостатки отсутствуют у дескрипторных языков, основанных на применении метода координатного, или ассоциативного, индексирования.
Согласно идее координатного индексирования предполагается, что содержание документов или показателей можно достаточно полно и точно отразить с помощью списка ключевых слов — дескрипторов.
Дескриптор — это термин естественного языка (слово или словосочетание), используемый при описании документов или показателей, который имеет самостоятельный смысл и неделим без изменения своего значения. Например, показатель «Количество товаров, прошедших таможенную очистку за месяц», записанный на естественном языке, при использовании метода координатного индексирования будет иметь вид: «количество, товар, проходить, таможенная, очистка, месяц».
1.5.2. Понятия и основные системы кодирования информации
Для полной формализации таможенной информации недостаточно простой классификации, поэтому проводят следующую процедуру — кодирование. Кодирование — это процесс присвоения условных обозначений объектам и классификационным группам по соответствующей системе кодирования. Система кодирования — это совокупность правил обозначения объектов и группировок с использованием кодов. Код — это условное обозначение объектов или группировок в виде знака или группы знаков в соответствии с принятой системой. Код базируется на определенном алфавите (некоторое множество знаков). Число знаков этого множества называется основанием кода. Различают следующие типы алфавитов: цифровой, буквенный и смешанный.
Код характеризуется следующими параметрами:
• длиной (L);
• основанием кодирования (КA);
• структурой кода, под которой понимают распределение знаков по признакам и объектам классификации;
• степенью информативности (I), рассчитываемой как частное от деления общего количества признаков (R) на длину кода (L):
I = R / L;
• коэффициентом избыточности (Kизб), который определяется как отношение максимального количества объектов (Qmax) к фактическому количеству объектов (Qфакт):
Kизб = Qmax / Qфакт.
Все системы кодирования можно сгруппировать в два подмножества (рис. 18): регистрационные и классификационные системы кодирования.
Особенностью регистрационных систем кодирования является их независимость от применяемых систем классификации. Регистрационные коды используются для идентификации объектов и передачи информации об объектах на расстояние, поэтому они должны удовлетворять следующим требованиям: минимальности длины кода, однозначности соответствия наименования объекта и его кода в течение длительного периода времени и защищенности кода от помех и ошибок.
Рис. 18. Схема классификации систем кодирования
Регистрационные коды состоят из двух частей: информационной и контрольной, предназначенной для защиты передаваемой информации от ошибок. Контрольная часть может рассчитываться по различным алгоритмам, в частности, наиболее употребляемыми являются следующие формулы их расчета:
K = M - [∑Xi / M];
K = M - [∑xi×B / M],
где M— модуль (простое число, делящееся на единицу и на само себя); X — информационные разряды; i — номер разряда; Bi — вес информационного разряда.
К регистрационным системам относятся порядковая и серийная системы кодирования.
Порядковая система — это наиболее простая по своему построению система кодирования, суть использования которой заключается в последовательном присвоении каждому объекту кодируемого множества M0 номера его порядка, т. е. в присвоении цифр натурального ряда в порядке расположения объектов. Этот порядок может быть случайным или определяться после предварительной группировки объектов, например по алфавиту.
Как правило, порядковую систему применяют для кодирования малозначных, устоявшихся и простых множеств объектов, не требующих предварительной классификации.
Серийная (серийно-порядковая) система кодирования отличается от порядковой тем, что номенклатура кодируемых объектов M0 предварительно должна быть разбита на группировки по одному признаку, и каждой группировке должна быть отведена серия кодовых обозначений, в пределах которой элементу присваивается свой код по порядку. Серия обозначений для каждой группировки определяется таким образом, чтобы после присваивания кодов элементам этой группы в ней оставались бы еще свободные номера на случай появления новых объектов.
Классификационные коды используют для отражения классификационных взаимосвязей объектов и группировок и применяют в основном для сложной логической обработки экономической информации на ЭВМ, отсюда вытекают требования: однозначности отображения классификационных взаимосвязей объектов и их группировок и обеспечения максимальной простоты программирования. Группу классификационных систем кодирования можно разделить на две подгруппы в зависимости от того, какую систему классификации используют для упорядочения объектов.
Последовательные системы кодирования характеризуются тем, что они базируются на предварительной классификации по иерархической системе классификации, в результате использования которой коды нижестоящих группировок образуются путем добавления кодов к кодам вышестоящих группировок.
Параллельные системы кодирования характеризуются тем, что они строятся на основе использования фасетной системы классификации и коды группировок по фасетам формируются независимо друг от друга.
<< [1] ... [5] [6] [7] [8] [9] [10] [11] [12] [13] [14] [15] [16] ... [66] >>
|