Чем отличается информация от данных. Различия между сообщением, данными и информацией

Информация - сведения об объектах и явлениях окружающей среды, их параметрах, свойствах и состоянии, которые уменьшают имеющуюся о них степень неопределенности, неполноты знаний.

Источник (поставщик) и потребитель (получатель) информации .

Термин информация происходит от латинского informatio, что означает разъяснение, осведомление, изложение. В широком смысле информация определяется как сведения (сообщения) о той или иной стороне материального мира и процессах. Сообщение - это форма представления информации в виде речи, текста, изображения, цифровых данных, графиков, таблиц и т.п.

Информация - это общенаучное понятие, включающее в себя обмен сведениями между людьми, обмен сигналами между живой и неживой природой, людьми и устройствами.

Следует помнить, что: информация существует вне ее создателя ; информация становится сообщением, как только выражена на определенном языке.

Наряду c понятием «информация» часто употребляется понятие данные . Данные могут рассматриваться как признаки или записанные наблюдения, которые по каким-то причинам не используются, а только хранятся. В том

случае, если появляется возможность использовать эти данные для уменьшения неопределенности о чем-либо, данные превращаются в информацию. Поэтому можно утверждать, что информацией являются используемые данные .

Информация - структурированные данные.

Информация (в биологии) = Биология изучает живую природу и понятие «информация» связывается с целесообразным поведением живых организмов. В живых организмах информация передается и храниться с помощью объектов различной физической природы (состояние ДНК), которые рассматриваются как знаки биологических алфавитов. Генетическая информация передается по наследству и хранится во всех клетках живых организмов.

Информация (в философии) = это взаимодействие, отражение, познание.

Информация (в кибернетике) = это характеристики управляющего сигнала, передаваемого по линии связи.

Можно выделить следующие подходы к определению информации:

- традиционный (обыденный) используется в информатике: Информация – это сведения, знания, сообщения о положении дел, которые человек воспринимает из окружающего мира с помощью органов чувств (зрения, слуха, вкуса, обоняния, осязания).

- вероятностный - используется в теории об информации: Информация – это сведения об объектах и явлениях окружающей среды, их параметрах, свойствах и состоянии, которые уменьшают имеющуюся о них степень неопределённости и неполноты знаний.

Информация хранится, передается и обрабатывается в символьной (знаковой) форме . Одна и та же информация может быть представлена в различной форме:

1) Знаковой письменной, состоящей из различных знаков среди которых выделяют символьную в виде текста, чисел, спец. символов; графическую; табличную и т.д.

2) В виде жестов или сигналов.

3) В устной словесной форме (разговор).

Представление информации осуществляется с помощью языков, как знаковых систем, которые строятся на основе определенного алфавита и имеют правила для выполнения операций над знаками.

Язык – определенная знаковая система представления информации.

Естественные языки – разговорные языки в устной и письменной форме. В некоторых случаях разговорную речь могут заменить язык мимики и жестов, язык специальных знаков (например, дорожных);

Формальные языки – специальные языки для различных областей человеческой деятельности, которые характеризуются жестко зафиксированным алфавитом, более строгими правилами грамматики и синтаксиса. Это язык музыки (ноты), язык математики (цифры, математические знаки), системы счисления, языки программирования и т.д.

В основе любого языка лежит алфавит – набор символов/знаков.

Полное число символов алфавита принято называть мощностью алфавита .

Носители информации – среда или физическое тело для передачи, хранения и воспроизведения информации. Это электрические, световые, тепловые, звуковые, радио сигналы, магнитные и лазерные диски, печатные издания, фотографии и т.д.

ОСНОВНЫЕ ПОЛОЖЕНИЯ

1. В быту люди часто используют термин «информация», вкладывая в него простой смысл - «сообщение». Когда говорят: «Нам не хватает информации», «Даю информацию!», «Это- научная информация», то интуитивно под термином «информация» подразумевают достаточно широкий круг значений: «совокупность знаний», «данные», «понятия», «представления», «новости», «сведения».

Общепринятой научной формулировки термина «информация» пока еще нет. Предлагаемые варианты страдают неполнотой, часто расплывчатостью и неточностью. В таком случае в науке принято строить определение, перечисляя, описывая свойства объекта или явления.

Рассмотрим основные свойства информации. В качестве исходного, рабочего определения возьмем самое распространенное: информация - это какие-либо сведения (1). Здесь слова «информация» и «сведения» рассматриваются как снноннмы. Однако существует достаточно много ситуаций, когда сведения не несут информации. Так, А. П. Чехов в рассказе «Учитель словесности» вкладывает в уста героя, учителя Ипполита Ипполитовича, фразу, ставшую символом коммуникативной банальности: «Волга впадает в Каспийское море, а лошадн кушают овес н сено». Эти сведения являются истинной правдой, однако информации они не содержат. Важный момент в понимании сущности изучаемого явления: данное сообщение не несет информации, оно содержит об-щеизвестный факт.

Информативными являются не всякие сведения, а лишь те, которые несут нечто важное, новое, ценное для получателя. Именно получатель сообщения решает, считать ли сообщение информативным для себя нлн нет. Учитывая сказанное, можно уточнить предыдущую формулировку: информация - это такие сведения, которые либо имеют значимость (ценность) для принимающего, либо приобретают ее (2). Уточним ряд позиций:

информация существует в определенных условиях, она с ними связана, существует источник сведений, объект- информатор, который может распространять некоторые сведения;

информация обладает неодинаковой ценностью с точки зрения пользователей, принимающих ее;

принимающий сведения производит отбор, разделение их на информативные и бесполезные (последние называются шумом).

Информация в человеческом общении всегда имеет смысл, основана на разрыве в знаниях между говорящими.

Специалист по связям с общественностью или журналист должен понимать: его сообщение будет восприниматься как информативное лишь тогда, когда оно актуально либо по-новому представляет факты, значительно возбуждает интерес.

Правомерно говорить о субъективной ценности информации. Не все люди будут воспринимать одни и те же сведения как значимые для себя. Сведения о курсе мировых валют имеют значимую ценность (информативны) для бизнесмена, для владельца валюты, но к ним безразлично отнесется тот, кто не связан с валютными операциями. Информация функционально связана с целями получателя. В обыденном понимании поступление сообщения связано с некоторыми событиями. Именно события являются источником сообщения, содержащего или не содержащего информацию.

Процесс обмена информацией играет важную роль в жизнн любого существа. Способность к передаче или приему информации в самом широком смысле является критерием жизни Сообщение об изменении условий в среде существования обнаруживается живым организмом как благоприятное нлн опасное, требующее определенных реакций. Понятие информация настолько всеобъемлюще, что некоторые ученые включают его в определение жизни, на-пример Н". Винер.

Информация участвует в актах связи с внсшннм миром. Коммуникация - это связь, это обмен информацией.

Таким образом, коммуникация, информация, жизнеспособность - это понятия одного круга.

Еще одно свойство информации. Потеряв новизну, информация исчезает. Мы не перечитываем букварь, так как в нем все известно, неинформативно

Отсюда некоторые допотитепъные выводы:

информация - это неизвестное, неопределенное,

субъективная информация исчезает после ее восприятия пользователем.

Неопределенность и информативность связаны математическими зависимостями чем больше неопределенность, тем сооби(ение информативнее.

Итак, у информации имеется два противоречивых свойства:

это некоторый объем данных, который существует объективно, независимо, может быть измерен (например, данные в компьютере; объем, количество печатных символов в книге);

информационная ценность, польза этих данных определяется тем, что они будут понятны людям, смогут расширить, уточнить их знания. Следовательно, оценка «информативности» конкретных данных является субъективной; она зависит от объема знаний конкретного нндиаидуума. Факт, что соотношение 2x2 = 4 для первоклассника является настоящим открытием, но уже через некоторое время эти сведения становятся для него банальностью.

В XX в. в связи с развитием научного познания понятие информации существенно углубилось. Информация стала рассматриваться как нечто самостоятельное в рамках новой науки, кибернетики, изучающей процессы управления. Кибернетика доказывает, что информация участаует в процессах управления и развития любых систем (живых организмов или автоматических устройств), обеспечивающих устойчивость н выживаемость. Опираясь на исходные кибернетические идеи, философы пытаются дать широкое обоснование своим аоззреииям на свойства информации как философской категории. В философской науке сложилось две ведущих идеи, по- разному объясняющие свойства информации и ее характе-ристики.

Приверженцы одной школы (Б. В. Бирюков, И. Б. Но- внк, А. Д. Урсул н др.) квалифицируют информацию как свойство любых материальных объектов. По мнению по-следователей этого направления (их иногда называют атрибуты стам и), информация может быть извлечена из любого материального объекта жнвой н неживой природы. Материя рассматривается как хранилище «мертвой информации». Информация содержится объективно, но в скрытом аиде. В составе объектов природы всегда существует некая структура (набор частей, когда обязательно учитываются связи между составными частями), которую возможно познать. Поэтому такую информацию называют скрытой, структурной (иногда - связанной). Извлечь информацию может лишь наблюдатель, человек. Он обрабатывает ее, кодирует н перекодирует для передачи информации от объекта к субъекту. Итак, информация - это активно и целесообразно используемая часть знаний (3).

Смысл активности заключается в непосредственном или опосредованном (например, с помощью межличностного контакта в общении и т. п.) взаимодействии с объектом познания. Информация становится востребованной лишь при наличии разумного существа, получателя информации, способного осмыслить содержание хранящегося сообщения. Информация актуализируется при появлении познающего, мыслящего субъекта, воздействует на рецепторы его органов чувств, вызывает соответствующие реакции, принятие решений, вовлекается в управление поведением. Этот процесс (извлечение информации) индивидуален. Например, художник любуется особым оттенком в цвете глаз натурщицы, а врач усматривает в этих же оттенках цвета глаз признаки опасного заболевания.

Существует множество определений и взглядов на понятие "информация". Так, например, наиболее общее философское определение звучит следующим образом: "Информация есть отражение реального мира. Информация - отраженное разнообразие, то есть нарушение однообразия. Информация является одним из основных универсальных свойств материи". В узком, практическом толковании определение понятия "информация" представляется так: "Информация есть все сведения, являющееся объектом хранения, передачи и преобразования".

Автор теории информации К. Шеннон (1916) определил понятие информации как коммуникацию, связь, в процессе которой устраняется неопределенность. Шеннон предложил в к. 40-х годов единицу измерения информации - бит. Каждому сигналу в теории приписывалась априорная вероятность его появления. Чем меньше вероятность появления того или иного сигнала, тем больше информации он несет для потребителя (т.е. чем неожиданнее новость, тем больше ее информативность).

Информация равна нулю, когда возможно только одно событие. С ростом числа событий она увеличивается и достигает максимального значения, когда события равновероятны. При таком понимании информация - это результат выбора из набора возможных альтернатив. Однако математическая теория информации не охватывает все богатство содержания информации, поскольку она не учитывает содержательную сторону сообщения.

Дальнейшее развитие математического подхода к понятию "информация" отмечается в работах логиков (Р. Карнап, И. Бар-Хиллел) и математиков (А.Н. Колмогоров). В этих теориях понятие информации не связано ни с формой, ни с содержанием сообщений, передаваемых по каналу связи. Понятие "информация" в данном случае определяется как абстрактная величина, не существующая в физической реальности, подобно тому, как не существует мнимое число или не имеющая линейных размеров точка.

С кибернетической точки зрения информация (информационные процессы) есть во всех самоуправляемых системах (технических, биологических, социальных). При этом одна часть кибернетиков определяет информацию как содержание сигнала, сообщения, полученного кибернетической системой из внешнего мира. Здесь сигнал отождествляется с информацией, они рассматриваются как синонимы. Другая часть кибернетиков трактуют информацию как меру сложности структур, меру организации. Вот как определяет понятие "информация" американский ученый Б.Винер, сформулировавший основные направления кибернетики, автор трудов по математическому анализу, теории вероятностей, электрическим сетям и вычислительной техники: информация - это обозначение содержания, полученного из внешнего мира.

В физике информация выступает в качестве меры разнообразия. Чем выше упорядоченность (организованность) системы объекта, тем больше в ней содержится "связанной" информации. Отсюда делается вывод, что информация - фундаментальная естественнонаучная категория, находящаяся рядом с такими категориями как "вещество" и "энергия", что она является неотъемлемым свойством материи и потому существовала и будет существовать вечно. Так, например, французский физик Л. Бриллюэн (1889-1969), основоположник зонной теории твердых тел, автор трудов по квантовой механике, магнетизму, радиофизики, философии естествознания, теории информации определяет информацию как отрицание энтропии (энтропия - мера неопределенности, учитывающая вероятность появления и информативность тех или иных сообщений).

С 50-60-х годов терминология теории информации стала применяться и в физиологии (Д. Адам). Была обнаружена близкая аналогия между управлением и связью в живом организме и в информационно-технических устройствах. В результате введения понятия "сенсорная информация" (т.е. оптические, акустические, вкусовые, тепловые и прочие сигналы, поступающие к организму извне или вырабатываемые внутри его, которые преобразуются в импульсы электрической или химической природы, передающиеся по нейронным цепям в центральную нервную систему и от нее - к соответствующим эффекторам) появились новые возможности для описания и объяснения физиологических процессов раздражимости, чувствительности, восприятия окружающей среды органами чувств и функционирования нервной системы.

В рамках генетики было сформулировано понятие генетической информации - как программа (код) биосинтеза белков, материально представленных полимерными цепочками ДНК. Генетическая информация заключена преимущественно в хромосомах, где она зашифрована в определенной последовательности нуклеидов в молекулах ДНК. Реализуется эта информация в ходе развития особи (онтогенеза).

Таким образом, систематизируя вышеизложенное, можно сделать вывод, что для инженеров, биологов, генетиков, психологов понятие "информации" отождествляется с теми сигналами, импульсами, кодами, которые наблюдаются в технических и биологических системах. Радиотехники, телемеханики, программисты понимают под информацией рабочее тело, которое можно обрабатывать, транспортировать, так же как электричество в электротехнике или жидкость в гидравлике. Это рабочее тело состоит из упорядоченных дискретных или непрерывных сигналов, с которыми и имеет дело информационная техника.

С правовой точки зрения информация определяется как "некоторая совокупность различных сообщений о событиях, происходящих в правовой системе общества, ее подсистемах и элементах и во внешней по отношению к данным правовым информационным образования среде, об изменениях характеристик информационных образований и внешней среды, или как меру организации социально-экономических, политических, правовых, пространственных и временных факторов объекта. Она устраняет в правовых информационных образованиях, явлениях и процессах неопределенность и обычно связана с новыми, ранее неизвестными нам явлениями и фактами".

Информация с экономической точки зрения - это стратегический ресурс, один из основных ресурсов роста производительности предприятия. Информация - основа маневра предпринимателя с веществом и энергией, поскольку именно информация позволяет устанавливать стратегические цели и задачи предприятия и использовать открывающиеся возможности; принимать обоснованные и своевременные управленческие решения; координировать действия различных подразделений, направляя их усилия на достижение общих поставленных целей. Например, маркетологи Р.Д. Базел, Д.Ф. Кокс, Р.В. Браун определяют понятие "информация" следующим образом: "информация состоит из всех объективных фактов и всех предположений, которые влияют на восприятие человеком, принимающим решение, сущности и степени неопределенностей, связанных с данной проблемой или возможностью (в процессе управления). Все, что потенциально позволит снизить степень неопределенности, будь то факты, оценки, прогнозы, обобщенные связи или слухи, должно считаться информацией".

В менеджменте под информацией понимаются сведения об объекте управления, явлениях внешней среды, их параметрах, свойствах и состоянии на конкретный момент времени. Информация является предметом управленческого труда, средством обоснования управленческих решений, без которых процесс воздействия управляющей подсистемы на управляемую и их взаимодействие невозможен. В этом смысле информация выступает основополагающей базой процесса управления.

Значение информации для бизнеса определили Д.И. Блюменау и А.В. Соколов: "информация - это продукт научного познания, средство изучения реальной действительности в рамках, допустимых методологией одного из информационных подходов к исследованию объектов различной природы (биологических, технических, социальных). Подход предполагает описание и рассмотрение этих объектов в виде системы, включающей в себя источник, канал и приемник управляющих воздействий, допускающих их содержательную интерпретацию". Если попытаться объединить предложенные подходы, то получится следующее:

Данные несут в себе информацию о событиях, произошедших в материальном мире, поскольку они являются регистрацией сигналов, возникших в результате этих событий. Однако данные не тождественны информации. Станут ли данные информацией, зависит от того, известен ли метод преобразования данных в известные понятия. То есть, чтобы извлечь из данных информацию необходимо подобрать соответствующий форме данных адекватный метод получения информации. Данные, составляющие информацию, имеют свойства, однозначно определяющие адекватный метод получения этой информации. Причем необходимо учитывать тот факт, что информация не является статичным объектом - она динамически меняется и существует только в момент взаимодействия данных и методов. Все прочее время она пребывает в состоянии данных. Информация существует только в момент протекания информационного процесса. Все остальное время она содержится в виде данных.

Одни и те же данные могут в момент потребления представлять разную информацию в зависимости от степени адекватности взаимодействующих с ними методов.

По своей природе данные являются объективными, так как это результат регистрации объективно существующих сигналах, вызванных изменениями в материальных телах или полях. Методы являются субъективными. В основе искусственных методов лежат алгоритмы (упорядоченные последовательности команд), составленные и подготовленные людьми (субъектами). В основе естественных методов лежат биологические свойства субъектов информационного процесса. Таким образом, информация возникает и существует в момент диалектического взаимодействия объективных данных и субъективных методов.

Переходя к рассмотрению подходов к определению понятия "знания" можно выделить следующие трактовки. Знания - это:

  • * вид информации, отражающей знания, опыт и восприятие человека - специалиста (эксперта) в определенной предметной области;
  • * множество всех текущих ситуаций в объектах данного типа и способы перехода от одного описания объекта к другому;
  • * осознание и толкование определенной информации, с учетом путей наилучшего ее использования для достижения конкретных целей, характеристиками знаний являются: внутренняя интерпретируемость, структурируемость, связанность и активность.

Основываясь на приведенных выше трактовках рассматриваемых понятий, можно констатировать тот факт, что знание - это информация, но не всякая информация - знание. Информация выступает как знания, отчужденные от его носителей и обобществленные для всеобщего пользования. Другими словами, информация - это превращенная форма знаний, обеспечивающая их распространение и социальное функционирование. Получая информацию, пользователь превращает ее путем интеллектуального усвоения в свои личностные знания. Здесь мы имеем дело с так называемыми информационно-когнитивными процессами, связанными с представлением личностных знаний в виде информации и воссозданием этих знаний на основе информации.

В превращении информации в знание участвует целый ряд закономерностей, регулирующих деятельность мозга, и различных психических процессов, а также разнообразных правил, включающих знание системы общественных связей, - культурный контекст определенной эпохи. Благодаря этому знание становится достоянием общества, а не только отдельных индивидов. Между информацией и знаниями имеется разрыв. Человек должен творчески перерабатывать информацию, чтобы получить новые знания.

Таким образом, учитывая вышеизложенное, можно сделать вывод , что фиксируемые воспринимаемые факты окружающего мира представляют собой данные . При использовании данных в процессе решения конкретных задач - появляется информация . Результаты решения задач, истинная, проверенная информация (сведения ), обобщенная в виде законов, теорий, совокупностей взглядов и представлений представляет собой знания .

Данные - это тоже знания, однако знания совершенно особого рода. В первом приближении данные -это результат языковой фиксации единичного наблюдения, эксперимента, факта или ситуации . Примерами данных могут быть:

а) «такого-то числа, такого-то года, в момент t в определенной местности шел дождь» (метеорологическое данное)";

б) «цена деловой древесины в такой-то день такого-то года, по сведениям такой-то биржи, составляла столько-то долларов за тонну» (торговое данное);

в) «дефицит государственного бюджета в такой-то стране составлял в таком-то году столько-то миллиардов долларов» (финансовое данное);

г) «в такой-то момент времени автоматическая лаборатория, направляющаяся к Юпитеру, отклонилась от расчетной траектории на столько-то градусов, столько-то тысяч километров в таком-то направлении» (данные из сферы космической технологии).

С технологической точки зрения некоторые специалисты понятие «данные», как правило, определяют как информацию, которая хранится в базах данных и обрабатывается прикладными программами, или информация, представленная в виде последовательности символов и предназначенная для обработки в ЭВМ , т.е. данные включают только ту часть знаний, которые формализованы в такой степени, что над ними могут осуществляться процедуры формализованной обработки с помощью различных технических средств.

Данные - это информация, представленная в формализованном виде, пригодном для автоматической обработки при возможном участии человека . Данные - это информация, записанная (закодированная) на языке машины . Данные - это отдельные факты, характеризующие объекты, процессы и явления в предметной области, а также их свойства .

Между информацией и данными существует различие; Данные могут рассматриваться как признаки или записанные наблюдения, которые по каким-то причинам не используются, а только хранятся. Следовательно, в данный момент времени они не оказывают воздействия на поведение, на принятие решений. Однако данные превращаются в информацию, если такое воздействие существует.

Например, основной массив данных для ЭВМ состоит из таких признаков, которые не воздействуют на поведение. Пока эти данные не организованы соответствующим образом и не отражаются в виде выходного результата, чтобы руководитель действовал в соответствии с ними, они не являются информацией. Они остаются данными до тех пор, пока сотрудник не обратился к ним в связи с осуществлением тех или иных действий или в связи с некоторым решением, которое он обязан принять.

Данные превращаются в информацию, когда осознается их значение. Можно также сказать, что в том случае, когда появляется возможность использовать данные для уменьшения неопределенности о чем-либо, данные превращаются в информацию.

Циклы жизни данных

Подобно веществу и энергии, данные можно собирать, обрабатывать, хранить, изменять их формы. Однако у них есть некоторые особенности. Прежде всего, данные могут создаваться и исчезать. Так, например, данные о некотором вымершем животном могут исчезнуть, когда сжигается кусок угля с его отпечатками. Данные могут стираться, терять точность и т.д. Данные могут быть охарактеризованы циклом жизни (рис. 1.9), в котором основное значение имеют три аспекта - зарождение, обработка, хранение и поиск .

Воспроизведение и использование данных может осуществляться в различные моменты их цикла жизни и поэтому на схеме не показаны.

Рис. 1.9. Цикл «жизни» данных

При обработке на ЭВМ данные трансформируются, условно проходя следующие этапы:

1) данные как результат измерений и наблюдений:

2) данные на материальных носителях информации (таблицы, протоколы, справочники);

3) модели (структуры) данных в виде диаграмм, графиков, функций;

4) данные в компьютере на языке описания данных;

5) базы данных на машинных носителях.

Модели данных

Модель данных является ядром любой базы данных. Появление этого термина в начале 70-х годов двадцатого столетия связывается с работами американского кибернетика Э.Ф. Кодда, в которых отражался математический аспект модели данных, употребляемой в смысле структуры данных. В связи с потребностями развития технологии обработки данных в теории автоматизированных банков информации (АБИ) во второй половине 70-х годов появился инструментальный аспект модели данных, в содержание этого термина были включены ограничения, налагаемые на структуры данных и операции с ними.

В современной трактовке модель данных определяется как совокупность правил порождения структур данных в базах данных, операций над ними, а также ограничений целостности, определяющей допустимые связи и значения данных, последовательности их изменения .

Таким образом, модель данных представляет собой множество структур данных, ограничений целостности и операций манипулирования данными. Исходя из этого, можно сформулировать следующее рабочее определение: модель данных – это совокупность структур данных и операций их обработки.

В настоящее время различают" три основных типа моделей данных: иерархическая, сетевая и реляционная. Иерархическая модель данных организует данные в виде древовидной структуры и является реализацией логических связей: родовидовых отношений или отношений «целое - часть». Например, структура высшего учебного заведения - это многоуровневая иерархия (см. рис. 1.10).

Рис. 1.10. Пример иерархической структуры

Иерархическая (древовидная) БД состоит из упорядоченного набора деревьев; более точно, из упорядоченного набора нескольких экземпляров одного типа дерева. В этой модели исходные элементы порождают другие элементы, причем эти элементы в свою очередь порождают следующие элементы. Каждый порожденный элемент имеет только один порождающий элемент. Организационные структуры, списки материалов, оглавление в книгах, планы проектов, расписание встреч и многие другие совокупности данных могут быть представлены в иерархическом виде.

Основными недостатком данной модели является: а) сложность отображения связи между объектами типа «многие ко многим»; б) необходимость использования той иерархии, которая была заложена в основу БД при проектировании. Потребность в постоянной реорганизации данных (а часто невозможность этой реорганизации) привели к созданию более общей модели – сетевой.

Сетевой подход к организации данных является расширением иерархического подхода. Данная модель отличается от иерархической тем, что каждый порожденный элемент может иметь более одного порождающего элемента. Пример сетевой модели данных приведен на рис 1.11.

Поскольку сетевая БД может представлять непосредственно все виды связей, присущих данным соответствующей организации, по этим данным можно перемещаться, исследовать и запрашивать их всевозможными способами, т.е. сетевая модель не связана всего лишь одной иерархией. Однако для того, чтобы составить запрос к сетевой БД, необходимо достаточно глубоко вникнуть в её структуру (иметь под рукой схему этой БД) и выработать свой механизм навигации по базе данных, что является существенным недостатком этой модели БД.

Рис. 1.11. Пример сетевой структуры

Одним из недостатков рассмотренных выше моделей данных является то, что в некоторых случаях при иерархическом и сетевом представлении рост базы данных может привести к нарушению логического представления данных. Такие ситуации возникают при появлении новых пользователей, новых приложений и видов запросов, при учете других логических связей между элементами данных. Эти недостатки позволяет избежать реляционная модель данных.

Реляционной считается такая база данных, в которой все данные представлены для пользователя в виде прямоугольных таблиц значений данных, и все операции над базой данных сводятся к манипуляциям с таблицами.

Таблица состоит из столбцов (полей) и строк (записей); имеет имя, уникальное внутри базы данных. Таблица отражает тип объекта реального мира (сущность), а каждая ее строка - конкретный объект. Так, таблица Спортивная секция содержит сведения обо всех детях, занимающихся в данной -спортивной секции, а ее строки представляют собой набор значений атрибутов каждого конкретного ребёнка. Каждый столбец таблицы - это совокупность значений конкретного атрибута объекта. Столбец Вес, например, представляет собой совокупность всех весовых категорий детей, занимающихся в секции. В столбце Пол могут содержаться только два различных значения: «муж.» и «жен.». Эти значения выбираются из множества всех возможных значений атрибута объекта, которое называется доменом. Так, значения в столбце Вес выбираются из множества всех возможных весов детей.

Каждый столбец имеет имя, которое обычно записывается в верхней части таблицы. Эти столбцы называются полями таблицы. При проектировании таблиц в рамках конкретной СУБД имеется возможность выбрать для каждого поля его тип, т.е. определить для него набор правил по его отображению, а также определить те операции, которые можно, выполнять над данными, хранящимися в этом поле. Наборы типов могут различаться у разных СУБД.

Имя поля должно быть уникальным в таблице, однако различные таблицы могут иметь поля с одинаковыми именами. Любая таблица должна иметь, по крайней мере, одно поле; поля расположены в таблице в соответствии с порядком следования их имен при ее создании. В отличие от полей, строки не имеют имен; порядок их следования в таблице не определен, а количество логически не ограничено. Строки называются записями таблицы.

Так как строки в таблице не упорядочены, невозможно выбрать строку по ее позиции - среди них не существует "первой", "второй", "последней". Любая таблица имеет один или несколько столбцов, значения в которых однозначно идентифицируют каждую ее строку. Такой столбец (или комбинация столбцов) называется первичным ключом. В таблице Спортивная секция первичный ключ - это столбец Ф.И.О. (рис. 1.12).

Такой выбор первичного ключа имеет существенный недостаток: невозможно записать в секцию двух детей с одним и тем же значением поля Ф.И.О., что на практике встречается не так уж редко. Именно поэтому, часто вводят искусственное поле для нумерации записей в таблице. Таким полем, например, может быть номер в журнале для каждого ребёнка, который сможет обеспечить уникальность каждой записи в таблице. Если таб.лица удовлетворяет этому требованию, она называется отношением (relation).

Рис. 1.12. Реляционная модель данных

Реляционные модели данных обычно могут поддерживать четыре типа связей между таблицами:

1) Один к Одному (пример: в одной таблице хранятся сведения о школьниках, в другой сведения о прохождении школьниками прививок).

2) Один ко Многим (пример: в одной таблице хранятся сведения об учителях, в другой сведения о школьниках, у которых эти учителя являются классными руководителями).

3) Много к Одному (в качестве примера можно предложить предыдущий случай, рассматривая его с другой стороны, а именно со стороны таблицы, в которой хранятся сведения о школьниках).

4) Много ко Многим (пример: в одной таблице хранятся заказы на поставку товаров, а в другой - фирмы, исполняющие эти заказы, причем для выполнения одного заказа могут объединяться несколько фирм/

Реляционное представление данных имеет целый ряд преимуществ. Оно понятно пользователю, не являющемуся специалистом в области программирования, позволяет легко добавлять новые описания объектов и их характеристики, обладает большой гибкостью при обработке запросов.

Вопросы и задания

1. Дайте определение понятию «данные».

2. Что называется циклом жизни данных?

3. Какие модели данных вы знаете?

4. Укажите преимущества и недостатки каждой модели данных.


ИНФОРМАЦИОННЫЕ ПРОЦЕССЫ

Часто данные и информация отождествляются, однако между двумя терминами есть существенное различие:

Информация - знания, касающиеся понятий и объектов (факты, события, вещи, процессы, идеи) в человеческом мозге;

Данные - представление переработанной информации, пригодной для передачи, толкования, или обработки (компьютерные файлы, бумажные документы, записи в информационной системе).

Отличие информации от данных состоит в том, что:

1) данные - это фиксированные сведения о событиях и явлениях, которые хранятся на определенных носителях, а информация появляется в результате обработки данных при решении конкретных задач.

Например, в базах данных хранятся различные данные, а по определенному запросу система управления базой данных выдает требуемую информацию.

2)данные - это носители информации, а не сама информация.

3)Данные превращаются в информацию только тогда, когда ими заинтересуется человек. Человек извлекает информацию из данных, оценивает, анализирует ее и по результатам анализа принимает то или иное решение.

Данные превращаются в информацию несколькими путями:

Контекстуализация: мы знаем, для чего эти данные нужны;

Подсчет: мы обрабатываем данные математически;

Коррекция: мы исправляем ошибки и ликвидируем пропуски;

Сжатие: мы сжимаем, концентрируем, агрегируем данные.

Таким образом, если существует возможность использовать данные для уменьшения неопределенности знаний о каком-либо предмете, то данные превращаются в информацию. Поэтому можно утверждать, что информацией являются используемые данные.

4)Информацию можно измерять. Мера измерения содержательности информации связана с изменением степени неосведомленности получателя и основана на методах теории информации.

2. Предметная область - это часть реального мира, данные о которой мы хотим отразить в базе данных. Предметная область бесконечна и содержит как существенно важные понятия и данные, так и малозначащие или вообще не значащие данные. Таким образом, важность данных зависит от выбора предметной области.

Модель предметной области . Модель предметной области - это наши знания о предметной области. Знания могут быть как в виде неформальных знаний в мозгу эксперта, так и выражены формально при помощи каких-либо средств. Опыт показывает, что текстовый способ представления модели предметной области крайне неэффективен. Гораздо более информативными и полезными при разработке баз данных являются описания предметной области, выполненные при помощи специализированных графических нотаций. Имеется большое количество методик описания предметной области. Из наиболее известных можно назвать методику структурного анализа SADT и основанную на нем IDEF0, диаграммы потоков данных Гейна-Сарсона, методику объектно-ориентированного анализа UML, и др. Модель предметной области описывает скорее процессы, происходящие в предметной области и данные, используемые этими процессами. От того, насколько правильно смоделирована предметная область, зависит успех дальнейшей разработки приложений.

3. Ба́за да́нных - представленная в объективной форме совокупность самостоятельных материалов (статей, расчётов, нормативных актов, судебных решений и иных подобных материалов), систематизированных таким образом, чтобы эти материалы могли быть найдены и обработаны с помощью электронной вычислительной машины (ЭВМ).

Многие специалисты указывают на распространённую ошибку, состоящую в некорректном использовании термина «база данных» вместо термина «система управления базами данных», и указывают на необходимость различения этих понятий.