Анализ медико-биологических данных помощью Microsoft Excel и СПП STADIA 6.2
Комплексное статистическое исследование. Биометрия. Медико-биологическое действие тиакарпина на интактный организм мышей. Характерные особенности математизации в современной биологии, применение матстатистики. Концепция случайной изменчивости.
Рубрика | Производство и технологии |
Вид | реферат |
Язык | русский |
Дата добавления | 18.02.2009 |
Размер файла | 21,0 K |
Отправить свою хорошую работу в базу знаний просто. Используйте форму, расположенную ниже
Студенты, аспиранты, молодые ученые, использующие базу знаний в своей учебе и работе, будут вам очень благодарны.
Министерство образования Российской Федерации
Реферат
Предмет: Биохимия
Тема: Анализ медико-биологических данных помощью Microsoft Excel и СПП STADIA 6.2
Выполнил:
Проверил:
город, год
СОДЕРЖАНИЕ
ВВЕДЕНИЕ
Математическая статистика
Биометрия
Статистические пакеты
Этапы анализа данных
КОМПЛЕКСНОЕ СТАТИСТИЧЕСКОЕ ИССЛЕДОВАНИЕ
Медико-биологическое действие тиакарпина на интактный организм мышей
Выводы
Литература
ВВЕДЕНИЕ
В развитых странах практически любое решение: политическое, финансовое, техническое, научно-исследовательское и даже бытовое решение принимается только после всестороннего анализа данных. Поэтому изучение прикладной статистики и методов анализа данных является неотъемлемым компонентом образования на всех уровнях, а компьютерные пакеты для аналитических исследований и прогнозирования являются настольным рабочим инструментом любого специалиста, так или иначе связанного с информационной сферой. Известно, что окружающий нас мир характеризуется постоянной изменчивостью, порождающей разнообразие возможностей и свободу выбора. Однако тот, кто серьезно думает о перспективах своей деятельности, обязательно будет накапливать информацию об окружающем мире, пытаясь выделить закономерности из случайностей. Именно таким мощным и гибким инструментом отсеивания закономерностей от случайностей и является аппарат математической статистики. Для современной науки характерно применение точных математических методов в самых различных областях. Точность и уровень той или иной области человеческих знаний часто определяется степенью использования соответствующим разделом науки математических методов. Эволюционная теория Ч. Дарвина, явилась по существу первой эволюционной теорией, которая привнесла в исследования вероятностный дух. Анализ взаимозависимости между такими исходными понятиями эволюционной теории, как изменчивость, наследственность и отбор, оказался бы несостоятельным без того, что сейчас называется вероятностным стилем мышления. Сегодня исследование проблем организации, функционирования, взаимодействия и эволюции живых систем уже немыслимо без привлечения идей и методов теории вероятностей, математической статистики и других разделов математики. Характерной особенностью математизации биологии в наши дни является стремительный рост спроса на такие методы эмпирического материала, которые обеспечивают комплексный подход к познанию живых организмов. В исследовательской работе не всегда учитывается принцип единства и взаимосвязанности явлений в природе. Ярче всего это проявляется при организации наблюдений и экспериментов по принципу единственного фактора, которому многое жертвовалось: вводились различные ограничения и оправдывались существенные упрощения, разрабатывались искусственный схемы исследований и т.д. В результате допускалась методологическая ошибка: игнорировался принцип единства живой природы. Известно, что упущения методологического характера нельзя исправить никакими методами, в том числе и математическими. Принцип единственного фактора вошел в биологию по объективным причинам, среди которых первостепенное значение имеет факт, что человек не может непосредственно анализировать одновременное взаимодействие многих факторов. Такие математические методы, которые разработаны с всесторонним учетом принципа единства живой природы и возможности практической их реализации с использование программного обеспечения, является достижением в области постановки и анализа биологических исследований. Однако, опыт показывает, что и в век вычислительной техники лучших успехов достигают те специалисты, которые умеют не только использовать обработанную информацию, но также уяснили сущность применяемых методов. Это предохранит от механического их использования, которое рано или поздно приводит к нелепым или даже абсурдным выводам.
Математическая статистика
Математическая статистика - раздел математики, посвященный математическим методам систематизации, обработки и использования статистических данных для научных и практических выводов. Математическая статистика исходит из предположения, что наблюдаемая изменчивость наблюдаемого мира имеет два источника. Один из них действие известных причин и факторов. Они порождают изменчивость, закономерно объяснимую. Именно эти изменения и вызывающие ее факторы обычно представляют интерес у исследователя, ищущего, в первую очередь, причинные связи явлений. Однако большинство природных и общественных явлений обнаруживают изменчивость, которая не может быть целиком объяснена закономерными причинами. В таком случае прибегают к концепции случайной изменчивости, которая в данном контексте означает «подчиняющийся законам вероятности». И если предположение о таком характере явлений справедливо, то оно позволяет делать надежные выводы (достоверность которых контролируется) из данных, которые зачастую противоречивы, искажены ошибками, ненадежны и т.д. Без привлечения статистических понятий в таких случаях невозможно судить о точности и обоснованности выводов, но и вообще об их адекватности. Практика накопила большой опыт того, в каких ситуациях приемлемы представления о случайной изменчивости. Для наиболее ходовых из таких ситуаций разработаны математические модели. Наиболее важные и употребительные модели отражены в компьютерных статистических пакетах. Программное воплощение теоретических схем бывает весьма разнообразным, равно как и возможности и производительность реализуемых алгоритмов, а также удобство использования и работы с пакетом. Кроме основного ядра, в той или иной форме представленного в большинстве пакетов общего назначения, многие из них уделяют предпочтительное внимание отдельным разделам математической статистики и могут содержать менее традиционный или даже новый, оригинальный материал по этим разделам.
Биометрия
Даже в самых конкретных биологических исследованиях основной интерес представляют сведения, относящиеся не к индивидуальному объекту, а к целой группе или некоторому статистическому среднему объекту. Необходимость использования статистических методов в биологических и медицинских исследованиях связана в первую очередь с тем, что свойства биологических объектов обычно значительно варьируют в пределах популяции, а физиологические и другие параметры одной особи испытывают флуктуации во времени. Традиционно тесные связи между биологической проблематикой и собственно математической статистикой, уже давно позволили выделить рассматриваемую область прикладной статистики в отдельную дисциплину - биометрию. Биометрия - область научных знаний, охватывающая планирование и анализ результатов количественных биологических экспериментов и наблюдений методами математической статистики. Современный количественный эксперимент включает в себя самостоятельное математико-статистической исследование, которое начинается со статистического планирования эксперимента, то есть организации его постановки, и завершается статистической обработкой полученных результатов. Поэтому биометрия находит себе все более широкое общебиологическое применение, ибо задачи, которые она решает - планирование экспериментов и анализ их результатов, - составляют основу экспериментальной работы в любой частной области биологии. Биометрия строится на строгом математическом фундаменте, но этим не ограничивается. Построение биометрии идет по четырем основным разделам: 1. Отбор из громадного арсенала математических методов таких, который могут помочь биологам в их текущей работе по наблюдению, преобразованию живой природы; 2. Модификация отобранных математических методов в соответствии со специфическими особенностями биологических объектов и процессов 3. Разработка новых биометрических методов, требуемых современным развитием биологии, но еще не имеющихся в арсенале общей математики. Например, расчет показателей наследуемости и повторяемости; 4. Унификация терминологии и символики. В общей математике нет единой системы терминов и символики, имеется большое разнообразие в названиях и обозначениях по каждому показателю. При создании биометрической терминологии большинство терминов заимствуется. Но не всегда математические термины пригодны в биологии. Например, такое биологическое явление, как неодинаковость объектов в группе, неизбежное их различие в математике обозначается многими терминами, совершенно не соответствующими сущности этого явления: «изменчивость», «рассеяние», «колеблемость», «разброс». Поэтому в биометрии все они заменены одним общим термином «разнообразие». Опираясь на такие особенности ЭВМ, как быстродействие, способность хранить большие объемы информации, предоставление по использованию прикладных программ, существование разнообразных форм выдачи результатов вычислений, расширились возможности биометрии, она стала более доступной. Биометрия основывается теперь не только на таких математических дисциплинах, как теория вероятностей и математическая статистика, но на информатике и программировании на ЭВМ. Это позволяет говорить о современной биометрии как о компьютерной.
Статистические пакеты
Стандартные статистические методы включены в состав популярных электронных таблиц, таких как Excel, Lotus 1-2-3, Quattro Pro, а также в математические пакеты общего назначения, например Mathcad, Maple и др. Однако гораздо большими возможностями обладает специализированное программное обеспечение - статистические программные продукты (СПП). Международный рынок насчитывает более 1000 пакетов, решающих задачи статистического анализа данных в среде операционных систем Windows, DOS, OS/2. СПП можно разделить на: 1. Универсальные пакеты - предлагают широкий диапазон статистических методов. В них отсутствует ориентация на конкретную предметную область. Из зарубежных универсальных пакетов наиболее распространены BAS, SPSS, Systat, Minilab, Statgraphics, STATISTICA. 2. Специализированные пакеты, как правило, реализуют несколько статистических методов или методы, применяемые в конкретной предметной области. Чаще всего это системы, ориентированные на анализ временных рядов, корреляционно-регресионный, факторный или кластерный анализ. Из российских пакетов известны STADIA, Олимп, Класс-Мастер, КВАЗАР, Статистик-Консультант; американские пакеты - ODA, WinSTAT, Statit и т.д. Современные СПП реализуют ряд системных функций: ассистирование пользователю при выборе способа обработки, автоматическую организацию процесса обработки данных, обеспечение диалогового режима работы пользователя с пакетом, ведение пользовательских баз данных, автоматическое составление отчета о проделанной пользователем работе, совместимость с другими программами и некоторые другие. Методориентированные СПП, как правило, имеют следующую структуру: 1. Блок описательной статистики и разведочного анализа исходных данных: анализ резко выделяющихся значение исследуемого признака, восстановление пропущенных значений, частотная обработка исходных данных (построение гистограмм, полигонов частот, вычисление выборочных средних дисперсий и т.д.), проверка статистических гипотез об однородности исследуемых совокупностей, оценка критериев согласия, визуализация распределения статистических данных и др.; 2. Блок статистического исследования динамики и зависимостей: дисперсионный и ковариационный анализ, корреляционно-регрессионый анализ, анализ временных рядов и др.; 3. Блок классификации и снижения размерности: дискриминантный анализ, статистических анализ смесей распределений, кластерный анализ и др.; 4.
Блок методов статистического анализа нечисловых данных и экспертых оценок: анализ таблиц сопряженности, логлинейные модели, ранговые методы и др.; 5. Блок планирования эксперимента и выборочных исследований; 6. Блок вспомогательных программ. Следует отметить, что продвижение западных продуктов в российской аудитории наталкивается на ряд ограничений в связи с неадекватностью культурно-исторической ситуации. Эти пакеты предполагают наличие широкого первоначального статистического образования, доступной литературы и консультационных служб. Поэтому они содержат мало экранных подсказок и требуют внимательного изучения документации на английском языке. Указанных недостатков в значительной степени лишены известные отечественные статистические пакеты: Эвриста, Статистик-Консультант, STADIA, которые устойчиво представлены на рынке в течение последних лет. Используемая в данной работе СПП STADIA является универсальной системой, покрывающей в той или иной степени большинство основных разделов прикладной статистики, деловой и научной графики, и по своим интегральным возможностям сравнима с популярными зарубежными пакетами. Набор методов математической статистики, представленный в пакете STADIA составлен исходя из следующих соображений: . в пакет входят все наиболее часто применяемые в России и за рубежом статистические методы; . значительная часть их изучается в вузовских курсах и описана в стандартных учебниках; . пакет не перегружен очень новыми и/или сложными узкоспециализированными методами. В состав Microsoft Excel входит набор средств анализа данных (называемый пакет анализа), предназначенный для решения сложных статистических и инженерных задач. Microsoft Excel относится к весьма популярным и распространенным электронным таблицам, работающий в среде Windows.
Этапы анализа данных
В процессе анализа данных, как правило, присутствуют следующие основные этапы: 1. Ввод данных Введенные данные обычно отражаются в форме электронной таблицы или матрицы данных, где столбцы представляют различные переменные (например, рост, вес), а строки - измерение значений этих переменных, произведенные в различных условиях, в различное время, у различных объектов и т.п. 2. Преобразование данных Данные в электронной таблице можно просмотреть и скорректировать методами ручного редактирования или же полуавтоматического преобразования к виду, адекватному выбранному методу анализа. Здесь может быть использован широкий набор алгебраических, матричных, структурных преобразований, а также комбинирование этих операций в требуемой последовательности. Нередко также требуются удаление из введенных данных высокоамплитудных выбросов (которые могут быть результатом некорректных измерений) и замена или удаление пропущенных (неизмеренных) значений. 3. Визуализация данных На данные обязательно следует просто посмотреть, чтобы составить общее (в том числе и интуитивное) представление о характере их изменения, специфических особенностях и закономерностях, что очень важно при выборе стратегии и тактики дальнейшего анализа. Для этого можно использовать как исходное числовое представление, так и различные формы графического изображения. 4. Статистический анализ Собственно выбор метода, анализ данных и интерпретация результатов. 5. Представление результатов Для наглядности производимых выводов полученные результаты желательно представлять в виде адекватных, убедительных и эффектных графиков.
Комплексное статистическое исследование
Ранее было показано высокое терапевтическое противоопухолевое действие природного соединения - тиакарпина. На первом этапе изучения нового биологически активного вещества исследовали его общее, физиологическое воздействие на организм. Цель данной работы состояла в изучении и поиске наиболее безвредных доз терапевтического препарата. В связи с этим были получены результаты эксперимента на животных по влиянию тиакарпина на медико-биологические показатели интактного (здорового) организма. В частности регистрировали такие параметры сердечно- сосудистой системы, как активность ферментов аланинаминотрансферазы (АЛТ) и аспарататаминотрансферазы (АСТ), уровень белка, количество лейкоцитов - клеток иммунного реагирования организма. В печени наблюдали состояние белоксинтетической системы по содержанию в ней общего белка и уровень продуктов тиобарбитуровой кислоты (ТБК) - конечных продуктов перекисного окисления липидов. Животные (в данном случае беспородные лабораторные мыши) были поделены на группы для выяснения дозо-временного действия препарата. Тиакарпин вводили внутрибрюшинно каждый день в течение всего эксперимента за исключением контрольных животных. Медико-биологическое действие тиакарпина на интактный организм мышей
Описательная статистика
Это средство анализа служит для создания одномерного статистического отчета, содержащего информацию о центральной тенденции и изменчивости входных данных. Для всех анализируемых выборок согласно вычисленным уровням значимости (они больше критического значения 0,05) нет оснований отвергать нулевые гипотезы об отличии коэффициентов эксцесса и асимметрии от значений нормального распределения с вероятностью 95%. Таким образом использование параметрических статистических показателей в данном случае будет оправдано и достоверно. Сравнивая средние по каждому переменному (диагностикуму) с контрольными (нормальными) показателями можно сказать, что в общем тиакарпин подавляет синтез белка, хотя и незначительно, и снижает уровень продуктов перекисного окисления. Сопоставление средних и дисперсий указывает на то, что препарат оказывает значительное влияние на все показатели и особенно на белковое содержание. Результаты исследования образуют матрицу данных и, чтобы увидеть закономерность и структуру общей картины эксперимента, необходимо применить многомерные методы анализа данных.
КЛАСТЕРНЫЙ АНАЛИЗ
Эвклид+Дальн.сосед
Таблица расстояний
(1) (2) (3) (4) (5) (6) (7)
(8) (9) (10)
( 2) 22,13
( 3) 19,52 5,889
( 4) 52,35 30,44 33,39
( 5) 43,22 21,39 24,68 9,461
( 6) 48,53 26,65 29,67 3,921 5,554
( 7) 35,03 13,35 16,03 17,42 8,869 13,69
( 8) 25,92 5,49 7,185 26,53 17,61 22,74 9,236
Кластеры:
(список объектов) -> расстояние
(6,4) --> 3,921
(8,2) --> 5,49
(8,3,2) --> 7,185
(7,5) --> 8,869
(7,6,4,5) --> 17,42
(8,1,3,2) --> 25,92
(8,7,6,4,5,1,3,2) --> 52,35
При этом группу 1 можно выделить в четвертый кластер. В связи с этим применим дивизивную стратегию в попытке получить группировку на четыре кластера.
Эвклид+Дивизивная таблица расстояний
(1) (2) (3) (4) (5) (6) (7)
(8) (9) (10)
( 2) 22,13
( 3) 19,52 5,889
( 4) 52,35 30,44 33,39
( 5) 43,22 21,39 24,68 9,461
( 6) 48,53 26,65 29,67 3,921 5,554
( 7) 35,03 13,35 16,03 17,42 8,869 13,69
( 8) 25,92 5,49 7,185 26,53 17,61 22,74 9,236
Кластеры: Среднее внутрикластерное расстояние=5,673
1= (1,2,3*,8)
2= (4*,6)
3= (5*,7)
В результате получаем разделение на три кластера. Для проверки гипотезы об адекватности получаемых классификаций применяем дискриминантный метод.
ДИСКРИМИНАНТНЫЙ АНАЛИЗ
Расстояние Махаланобиса=724,3, значимость=0
Класс <--- Коэффициенты дискриминантной функции:a[0],a[1],... --->
1 -1181 45,14 58,65 528,6 -206,2 -3207
2 -429,4 26,77 37,61 330,7 -132,4 -1884
3 -1038 42,14 60,77 535,3 -223,7 -2953
Объект Класс D^2 Значим Вероят.отнесения
1 1 3,75 0,5859 1
2 1 3,75 0,5859 1
3 1 3,75 0,5859 1
4 2 2,5 0,7764 1
5 3 2,5 0,7764 1
6 2 2,5 0,7764 1
7 3 2,5 0,7764 1
8 1 3,75 0,5859 1
Как показывают результаты дискриминантного анализа, предполагаемая классификация оказалась эффективной.
Кластеризация исследуемых групп животных выявила сохранение физиологической нормы при введении тиакарпина в течение 3-х дней в дозе 7.5 мг/кг и в течение 6-и дней в дозе 50 мг/кг. Данные дозы оказывают наименьшую нагрузку на организм.
Выводы
1. Графическая визуализация экспериментальных результатов с помощью Excel показывает, что исследуемое вещество - тиакарпин, не оказывает негативного действия на показатели организма даже при введении высоких доз, а в некоторых случаях увеличение дозы способствовало подавлению процессов перекисного окисления в печени, свидетельствующее о некотором антиоксидантном и гепатопротекторном действии препарата. Неоднозначные результаты были получены по влиянию тиакарпина на белоксинтезирующую функцию организма. 2. Основываясь на результаты описательной статистики в STADIA 6.2 можно утверждать, что препарат оказывает значительное влияние на все показатели и особенно на белковое содержание. Общее действие тиакарпина направлено на подавление синтеза белка и ингибирование процессов перекисного окисления липидов. 3. Кластеризация исследуемых групп животных выявила сохранение физиологической нормы при введении тиакарпина в течение 3-х дней в дозе 7.5 мг/кг и в течение 6-и дней в дозе 50 мг/кг. Данные дозы оказывают наименьшую нагрузку на организм. 4. Использование метрики на основе коэффициента корреляции и стратегии ближайшего соседа показывает, что все пять диагностикумов не взаимосвязаны, т.е. все используемые параметры характеризуют функциональное состояние организма и обладают одинаковой диагностической информативностью.
ЛИТЕРАТУРА
1. Елисеева И.И., Юзбашев М.М. Общая теория статистики. Учебник / Под ред.
И.И. Елисеевой. - М.: Финансы и статистика, 1995. - 386 с.
2. Кулаичев А.П. Методы и средства анализа данных в среде Windows. STADIA
6.0. - М.: Информатика и компьютеры, 1996. - 257 с.
3. Лукьянова Н.Ю. Статистический анализ данных с использованием компьютера.
Учебное пособие. - Калининград: Изд-во КГУ, 2001. - 89 с.
4. Математический анализ биологических данных / Г.Н. Зайцев, М.: “Наука”,
1991. - 184 с.
5. Плохинский Н.А. Математические методы в биологии. Учебно-методическое
пособие. Изд-во Моск. ун-та, 1978. - 168 с.
Подобные документы
Решение задач анализа деятельности фирмы оптовой торговли продуктами питания с использованием Microsoft Excel. Информационная безопасность в Microsoft Office 2010. Технология решения задач защиты безопасности деятельности фирмы с помощью Microsoft Excel.
курсовая работа [4,6 M], добавлен 01.07.2013Повышение качества непрерывнолитой заготовки с помощью методов оптимизации в среде Microsoft Excel и программирования в среде Delphi c использованием технологических инструкций ОАО "НКМК" и экспериментальных данных. Математическая модель кристаллизатора.
дипломная работа [6,9 M], добавлен 06.07.2012Традиционные виды алкогольных напитков. Применение бальзамов, в состав которых входит набор целебных трав, как лекарственное средство. Действие спирта на организм человека. Обеспечение стабильности ликероводочной продукции. Технологии наливок и настоек.
научная работа [26,1 K], добавлен 04.12.2008Проведение аппроксимации данных с помощью Excel, расчет площадей (отдельно для выпуклой и вогнутой кривых периферического, серединного и корневого сечения) и целевой функции V с целью нахождения полного объема бетонной строительной конструкции.
контрольная работа [173,7 K], добавлен 26.01.2010География распространения лисицы обыкновенной в России. Особенности и нормативы размеров шкурок данных животных. Географическая изменчивость шкурок лисицы, особенности сезонной изменчивости свойств и оценка качества данной продукции. Первичная обработка.
реферат [30,3 K], добавлен 11.12.2012Обзор научно-технической литературы, медико-биологические основы фактора разделения. Разработка, проектирование и расчёт центрифуги лабораторной клинической. Описание конструкции и принципа действия центрифуги, вывод уравнения движения рабочего органа.
курсовая работа [435,7 K], добавлен 20.10.2009Применение координатно-измерительных машин в современной метрологии, контроль сложных поверхностей с помощью контактного сканирования и сравнения с математической моделью. Контроль геометрических параметров деталей заготовительно-штамповочной линии.
реферат [1,4 M], добавлен 03.06.2019Добыча бариевой руды. Применение бария в производстве. Воздействие бария и его соединений на организм. Применение бария и кальция в качестве раскислителя при выплавке стали. Анализ соединений бария, образующихся при его применении в производстве стали.
курсовая работа [333,4 K], добавлен 13.05.2017Изучение истории происхождения нефти. Исследование физических свойств и химического состава. Схема современной нефтеперегонной установки. Фракции после разгонки сырой нефти. Анализ добычи, транспортировки, переработки, хранения. Продукты нефтепереработки.
презентация [2,8 M], добавлен 11.03.2014Персонал, привлекаемый к участию в эксперименте по оценке прецизионности. Графический анализ данных совместимости. Представление результатов и используемые обозначения. Расчет общего среднего значения и дисперсий. Статистическое тестирование выбросов.
курсовая работа [2,0 M], добавлен 03.12.2014