Что такое биоинформатика? Банк SwissProt С.А.Спирин 7, 8,10 февраля 2006 г., ФББ МГУ.

Презентация:



Advertisements
Похожие презентации
Что такое биоинформатика? Банк SwissProt С.А.Спирин 7, 8,10 февраля 2006 г., ФББ МГУ.
Advertisements

Биоинформатика Исследование информационных процессов в биологических системах (клетках, органах, организме, популяции). Изучение и внедрение в компьютерную.
Биоинформатика Область науки, в которой решаются биологические задачи с помощью вычислительных методов математики и информационных технологий.
Профессиональные банки последовательностей – UniProt, SwissProt, TrEMBL О.Занегина
Выполнил: Сарбалаков А.К. Что такое биоинформатика? Исследование информационных процессов в биологических системах (клетках, органах, организме, популяции).
Структура курсов информатики и биоинформатики. Банки данных Архивные (примеры: PDB, GenBank) за содержание каждой записи отвечает её автор-экспериментатор.
Банки информации в молекулярной биологии С.А.Спирин 11/III – 2006.
Вводная лекция Курс «Биоинформатика» ф-т биоинженерии и биоинформатики МГУ А.Б.Рахманинова, 4/IX – 2009 использованы материалы лекций С.А.Спирина (2006)
ИНФОРМАЦИОННЫЕ И КОММУНИКАЦИОННЫЕ ТЕХНОЛОГИИ В БИОЛОГИИ Выполнил: Булавская Ксения.
Вводная лекция Курс «Биоинформатика» ф-т биоинженерии и биоинформатики МГУ А.Б.Рахманинова, 3/IX – 2007, использованы материалы лекции С.А.Спирина, 2006.
Курс «Биоинформатика» ф-т биоинженерии и биоинформатики МГУ А.В. Алексеевский. Использованы материалы лекций А.Б.Рахманиновой и С.А.Спирина.
Gtcactaaatactttaaccaatataggcatagcgcacagacagataaaaattacagagtacacaacatccatgaaacgcattagcaccaccattaccaccaccatcaccattacca gcttttcattctgactgcaacgggcaatatgtctctgtgtggattaaaaaaagagtgtctgatagcagcttctgaactggttacctgccgtgagtaaattaaaattttattgactta.
The PIR-PSD current release 78.03, November 24, 2003, contains entries. 65 proteins The PIR was established in 1984 by the National Biomedical.
DNA vs. computer 1.Про 5-3 и всякую химию 2.Про банки данных (архивные vs. курируемые) 3.Святая троица EMBL – GenBank – DDBJ 4.Собственно EMBL, его разделы,
Курс «Биоинформатика» ф-т биоинженерии и биоинформатики МГУ А.В. Алексеевский. Использованы материалы лекций А.Б.Рахманиновой и С.А.Спирина.
Swiss-Prot – одна из первых баз данных белковых последовательностей, gold standard белковой аннотации. Аннотация выполнена вручную группой профессиональных.
Стандартная запись Swiss-Prot. Стандартные поля: entry, name, origin Название записи, уникальный идентификатор (ID), предыдущие идентификаторы соответствующей.
Решение задач биоинформатики при помощи веб - и интернет - сервисов.
Молекулярный филогенез. ancestor descendant 1 descendant 2 Предположение: жизнь - монофилетична Любые два организма имеют общего предка в прошлом.
Pfam, ProSite, InterPro,... Банки структурной биологической информации GenBank, ENA(EMBL), DDBJ RefSeq Архивные базы последовательностей нуклеиновых кислот.
Транксрипт:

Что такое биоинформатика? Банк SwissProt С.А.Спирин 7, 8,10 февраля 2006 г., ФББ МГУ

Что такое биоинформатика? Исследование информационных процессов в биологических системах (клетках, органах, организме, популяции). Изучение и внедрение в компьютерную науку «биологических» методов анализа информации (нейросетей, генетических алгоритмов, нечеткой логики и др.). Применение компьютерных методов для решения биологических задач. Телепатия, парапсихология, информационные поля и т.п. ?

Биоинформатика Исследование информационных процессов в биологических системах (клетках, органах, организме, популяции). Изучение и внедрение в компьютерную науку «биологических» методов анализа информации (нейросетей, генетических алгоритмов, нечеткой логики и др.). Применение компьютерных методов для решения биологических задач. Телепатия, парапсихология, информационные поля и т.п.

Примеры задач биоинформатики Разработка алгоритмов для анализа большого объема биологических данных –Алгоритм поиска генов в геноме Анализ и интерпретация биологических данных таких, как нуклеотидные и аминокислотные последовательности, структура молекул белков, структура комплексов молекул белков с другими молекулами. –Изучение структуры активного центра белка Разработка программного обеспечения для управления и быстрого доступа к биологическим данным –Создание банка данных аминокислотных последовательностей

Что понимать под биоинформатикой? Как видим, смысл термина ещё же... Применение компьютерных методов для решения биологических задач Применение компьютерных методов для решения задач молекулярной биологии... и еще же... Компьютерный анализ экспериментальных данных о структурах биологических макромолекул (белков и нуклеиновых кислот) с целью получения биологической информации

Итак... Биоинформатика = вычислительная молекулярная биология Почему так сузился смысл термина?

gatcctccatatacaacggtatctccacctcaggtttagatctcaacaacggaaccattg ccgacatgagacagttaggtatcgtcgagagttacaagctaaaacgagcagtagtcagct ctgcatctgaagccgctgaagttctactaagggtggataacatcatccgtgcaagaccaa gaaccgccaatagacaacatatgtaacatatttaggatatacctcgaaaataataaaccg ccacactgtcattattataattagaaacagaacgcaaaaattatccactatataattcaa agacgcgaaaaaaaaagaacaacgcgtcatagaacttttggcaattcgcgtcacaaataa attttggcaacttatgtttcctcttcgagcagtactcgagccctgtctcaagaatgtaat aatacccatcgtaggtatggttaaagatagcatctccacaacctcaaagctccttgccga gagtcgccctcctttgtcgagtaattttcacttttcatatgagaacttattttcttattc tttactctcacatcctgtagtgattgacactgcaacagccaccatcactagaagaacaga acaattacttaatagaaaaattatatcttcctcgaaacgatttcctgcttccaacatcta cgtatatcaagaagcattcacttaccatgacacagcttcagatttcattattgctgacag ctactatatcactactccatctagtagtggccacgccctatgaggcatatcctatcggaa aacaataccccccagtggcaagagtcaatgaatcgtttacatttcaaatttccaatgata cctataaatcgtctgtagacaagacagctcaaataacatacaattgcttcgacttaccga gctggctttcgtttgactctagttctagaacgttctcaggtgaaccttcttctgacttac tatctgatgcgaacaccacgttgtatttcaatgtaatactcgagggtacggactctgccg acagcacgtctttgaacaatacataccaatttgttgttacaaaccgtccatccatctcgc tatcgtcagatttcaatctattggcgttgttaaaaaactatggttatactaacggcaaaa acgctctgaaactagatcctaatgaagtcttcaacgtgacttttgaccgttcaatgttca ctaacgaagaatccattgtgtcgtattacggacgttctcagttgtataatgcgccgttac ccaattggctgttcttcgattctggcgagttgaagtttactgggacggcaccggtgataa actcggcgattgctccagaaacaagctacagttttgtcatcatcgctacagacattgaag gattttctgccgttgaggtagaattcgaattagtcatcggggctcaccagttaactacct ctattcaaaatagtttgataatcaacgttactgacacaggtaacgtttcatatgacttac ctctaaactatgtttatctcgatgacgatcctatttcttctgataaattgggttctataa

В конце 1970-х годов был изобретён относительно быстрый и дешёвый метод экспериментального определения последовательности оснований в ДНК Организм ДНК «в пробирке»Последовательность выделение секвенирование...TGCCACAAATCAC...

Для хранения все возрастающей информации о последовательностях ДНК в 1982 году был основан GenBank GenBank хранилище последовательностей нуклеиновых кислот в виде компьютерных файлов Объем GenBankа: 1982: букв в 606 последовательностях 1992: букв в последовательностях 2002: букв в последовательностях 2004: букв в последовательностях 2005: букв в последовательностях (из ~ организмов) Размер файлов 196 Gb

Пионеры биоинформатики Лайнус Полинг 1962 Zuckerkandl, E., and L. Pauling Molecular disease, evolution, and genic heterogeneity. Horizons in Biochemistry, Academic Press, New York, Zuckerkandl, E., and L. Pauling Evolutionary divergence and convergence in proteins. Evolving Genes and Proteins, Academic Press, New York, Анализ аминокислотных последовательностей глобинов нескольких позвоночных Гипотеза молекулярных часов

Пионеры биоинформатики Маргарет Дейхофф Однобуквенный код аминокислот A,C,D,E,F,G,H… Матрицы аминокислотных замен PAM (Point Accepted Mutation) 1965 Атлас последовательностей белков и их структур (1965)

Первый банк данных Атлас белковых последовательностей и их структур Первая версия атласа содержала описание 65 (!) последовательностей белков

Банки данных Архивные (примеры: PDB, GenBank) за содержание каждой записи отвечает её автор-экспериментатор Курируемые за содержание записей отвечают специальные люди кураторы Автоматические записи генерируются компьютерными программами

Банк данных Swiss-Prot 1986 Swiss-Prot – база знаний о белковых последовательностях Курируемая база данных Золотой стандарт аннотации

Банк данных Swiss-Prot Амос Байрох Руководитель группы Swiss-Prot в Швейцарском Институте Биоинформатики С 1987 поддерживается в сотрудничестве между Swiss Institute of Bioinformatics (SIB) European Bioinformatics Institute (EBI)

Банк данных Swiss-Prot Статистика роста количества документов Текущий релиз 48.9 (24 января 2006) содержит документов

Банк данных TrEMBL Формальная трансляция всех кодирующих нуклеотидных последовательностей из банка EMBL Автоматическая классификация и аннотация TrEMBL (Translated EMBL) Текущий релиз 31.9 (24 января 2006) содержит документа

Тенденция объединения 2002

Банк данных UniProt UniProt (Universal Protein Resource) UniProt Knowlegebase – SwissProt+TrEMBL UniProt Archive – UniParc UniProt Reference – UniRef

~ последовательностей DDBJEMBL GenBank ttttacctctttttagtgatattgtgatatagagcaaaaatcccgacattgtgtcgggattgtttttaaactcttgttgattttaatttttcaatcgcttctttattaaagaagtagtgtgtgcc acaacactcacattgcatatcaatacggcctttatgttcggctaatatttcgtcaatttcttcatcagagatgagcagtagatgcagaactagaacgctcagcagagcagccaca gaaaaattgtacatcttgtgctggataaagattaacggtttcttcgtgatataaacgataggagtaactcttctgcagggagaccaaataattcttcatcttttactgttgctgcgagc gtagttaaatgctcaaaatcttctggtgtaccagaaccatcaggcataatttgtaataacatacctgctgccactggcttgccttcatattctccagtacgaataattaattgagtttg aagactcatattttcagtgaagtttcgatcgcccttaggaggggccgcgctttctctttcaa компьютерный поиск гена, трансляция и компьютерная аннотация UniRef (UniProt non-redundant Reference databases) PIR-PSD UniParc (UniProt Archive) последовательностей Экспертиза Базы данных научной литературы

Соотношение числа белков, представленных в разных банках Последовательностей во много раз больше, чем структур! Большинство последовательностей не аннотированы!

Документ банка данных Swiss-Prot Описание документа: идентификатор, имя, дата создания и модификации Аннотация последовательности Последовательность

Основные поля записи SwissProt ID AC DE OS OC И сама последовательность, конечно.