Разделы презентаций


Что такое биоинформатика? Банк SwissProt

Содержание

Что такое биоинформатика? Исследование информационных процессов в биологических системах (клетках, органах, организме, популяции). Изучение и внедрение в компьютерную науку «биологических» методов анализа информации (нейросетей, генетических алгоритмов, нечеткой логики и др.). Применение

Слайды и текст этой презентации

Слайд 1Что такое биоинформатика? Банк SwissProt
С.А.Спирин
7, 8,10 февраля 2006 г., ФББ МГУ

Что такое биоинформатика?  Банк SwissProtС.А.Спирин7, 8,10 февраля 2006 г., ФББ МГУ

Слайд 2Что такое биоинформатика?
Исследование информационных процессов в биологических системах (клетках,

органах, организме, популяции).
Изучение и внедрение в компьютерную науку «биологических»

методов анализа информации (нейросетей, генетических алгоритмов, нечеткой логики и др.).
Применение компьютерных методов для решения биологических задач.
Телепатия, парапсихология, информационные поля и т.п.

?

Что такое биоинформатика? Исследование информационных процессов в биологических системах (клетках, органах, организме, популяции). Изучение и внедрение в

Слайд 3Биоинформатика
Исследование информационных процессов в биологических системах (клетках, органах, организме, популяции).
Изучение

и внедрение в компьютерную науку «биологических» методов анализа информации (нейросетей,

генетических алгоритмов, нечеткой логики и др.).
Применение компьютерных методов для решения биологических задач.
Телепатия, парапсихология, информационные поля и т.п.

БиоинформатикаИсследование информационных процессов в биологических системах (клетках, органах, организме, популяции).Изучение и внедрение в компьютерную науку «биологических» методов

Слайд 4Примеры задач биоинформатики
Разработка алгоритмов для анализа большого объема биологических данных
Алгоритм

поиска генов в геноме


Анализ и интерпретация биологических данных таких, как

нуклеотидные и аминокислотные последовательности, структура молекул белков, структура комплексов молекул белков с другими молекулами.
Изучение структуры активного центра белка


Разработка программного обеспечения для управления и быстрого доступа к биологическим данным
Создание банка данных аминокислотных последовательностей
Примеры задач биоинформатикиРазработка алгоритмов для анализа большого объема биологических данныхАлгоритм поиска генов в геномеАнализ и интерпретация биологических

Слайд 5


Что понимать под биоинформатикой?
Как видим, смысл термина ещё ỳже...
Применение компьютерных

методов для решения биологических задач
Применение компьютерных методов для решения задач
молекулярной

биологии

... и еще ỳже...

Компьютерный анализ экспериментальных данных о структурах биологических макромолекул (белков и нуклеиновых кислот) с целью получения биологической информации


Что понимать под биоинформатикой?Как видим, смысл термина ещё ỳже...Применение компьютерных методов для решения биологических задачПрименение компьютерных методов

Слайд 6Итак...
Биоинформатика = вычислительная молекулярная биология
Почему так сузился смысл термина?

Итак...Биоинформатика = вычислительная молекулярная биологияПочему так сузился смысл термина?

Слайд 7gatcctccatatacaacggtatctccacctcaggtttagatctcaacaacggaaccattg
ccgacatgagacagttaggtatcgtcgagagttacaagctaaaacgagcagtagtcagct
ctgcatctgaagccgctgaagttctactaagggtggataacatcatccgtgcaagaccaa
gaaccgccaatagacaacatatgtaacatatttaggatatacctcgaaaataataaaccg
ccacactgtcattattataattagaaacagaacgcaaaaattatccactatataattcaa
agacgcgaaaaaaaaagaacaacgcgtcatagaacttttggcaattcgcgtcacaaataa
attttggcaacttatgtttcctcttcgagcagtactcgagccctgtctcaagaatgtaat
aatacccatcgtaggtatggttaaagatagcatctccacaacctcaaagctccttgccga
gagtcgccctcctttgtcgagtaattttcacttttcatatgagaacttattttcttattc
tttactctcacatcctgtagtgattgacactgcaacagccaccatcactagaagaacaga
acaattacttaatagaaaaattatatcttcctcgaaacgatttcctgcttccaacatcta
cgtatatcaagaagcattcacttaccatgacacagcttcagatttcattattgctgacag
ctactatatcactactccatctagtagtggccacgccctatgaggcatatcctatcggaa
aacaataccccccagtggcaagagtcaatgaatcgtttacatttcaaatttccaatgata
cctataaatcgtctgtagacaagacagctcaaataacatacaattgcttcgacttaccga
gctggctttcgtttgactctagttctagaacgttctcaggtgaaccttcttctgacttac
tatctgatgcgaacaccacgttgtatttcaatgtaatactcgagggtacggactctgccg
acagcacgtctttgaacaatacataccaatttgttgttacaaaccgtccatccatctcgc
tatcgtcagatttcaatctattggcgttgttaaaaaactatggttatactaacggcaaaa
acgctctgaaactagatcctaatgaagtcttcaacgtgacttttgaccgttcaatgttca
ctaacgaagaatccattgtgtcgtattacggacgttctcagttgtataatgcgccgttac
ccaattggctgttcttcgattctggcgagttgaagtttactgggacggcaccggtgataa
actcggcgattgctccagaaacaagctacagttttgtcatcatcgctacagacattgaag
gattttctgccgttgaggtagaattcgaattagtcatcggggctcaccagttaactacct
ctattcaaaatagtttgataatcaacgttactgacacaggtaacgtttcatatgacttac
ctctaaactatgtttatctcgatgacgatcctatttcttctgataaattgggttctataa

gatcctccatatacaacggtatctccacctcaggtttagatctcaacaacggaaccattgccgacatgagacagttaggtatcgtcgagagttacaagctaaaacgagcagtagtcagctctgcatctgaagccgctgaagttctactaagggtggataacatcatccgtgcaagaccaagaaccgccaatagacaacatatgtaacatatttaggatatacctcgaaaataataaaccgccacactgtcattattataattagaaacagaacgcaaaaattatccactatataattcaaagacgcgaaaaaaaaagaacaacgcgtcatagaacttttggcaattcgcgtcacaaataaattttggcaacttatgtttcctcttcgagcagtactcgagccctgtctcaagaatgtaataatacccatcgtaggtatggttaaagatagcatctccacaacctcaaagctccttgccgagagtcgccctcctttgtcgagtaattttcacttttcatatgagaacttattttcttattctttactctcacatcctgtagtgattgacactgcaacagccaccatcactagaagaacagaacaattacttaatagaaaaattatatcttcctcgaaacgatttcctgcttccaacatctacgtatatcaagaagcattcacttaccatgacacagcttcagatttcattattgctgacagctactatatcactactccatctagtagtggccacgccctatgaggcatatcctatcggaaaacaataccccccagtggcaagagtcaatgaatcgtttacatttcaaatttccaatgatacctataaatcgtctgtagacaagacagctcaaataacatacaattgcttcgacttaccgagctggctttcgtttgactctagttctagaacgttctcaggtgaaccttcttctgacttactatctgatgcgaacaccacgttgtatttcaatgtaatactcgagggtacggactctgccgacagcacgtctttgaacaatacataccaatttgttgttacaaaccgtccatccatctcgctatcgtcagatttcaatctattggcgttgttaaaaaactatggttatactaacggcaaaaacgctctgaaactagatcctaatgaagtcttcaacgtgacttttgaccgttcaatgttcactaacgaagaatccattgtgtcgtattacggacgttctcagttgtataatgcgccgttacccaattggctgttcttcgattctggcgagttgaagtttactgggacggcaccggtgataaactcggcgattgctccagaaacaagctacagttttgtcatcatcgctacagacattgaaggattttctgccgttgaggtagaattcgaattagtcatcggggctcaccagttaactacctctattcaaaatagtttgataatcaacgttactgacacaggtaacgtttcatatgacttacctctaaactatgtttatctcgatgacgatcctatttcttctgataaattgggttctataa

Слайд 8В конце 1970-х годов был изобретён относительно
быстрый и дешёвый метод

экспериментального определения
последовательности оснований в ДНК
Организм
ДНК «в пробирке»
Последовательность


выделение
секвенирование
...TGCCACAAATCAC...

В конце 1970-х годов был изобретён относительнобыстрый и дешёвый метод экспериментального определения последовательности оснований в ДНКОрганизмДНК «в

Слайд 9Для хранения все возрастающей информации о последовательностях ДНК в 1982

году был основан GenBank
GenBank — хранилище последовательностей нуклеиновых кислот в

виде компьютерных файлов

Объем GenBank’а:
1982: 680 338 букв в 606 последовательностях
1992: 101 008 486 букв в 78 608 последовательностях
2002: 28 507 990 166 букв в 22 318 883 последовательностях 2004: 44 575 745 176 букв в 40 604 319 последовательностях 2005: 56 037 734 462 букв в 52 016 762 последовательностях (из ~165 000 организмов)
Размер файлов — 196 Gb
Для хранения все возрастающей информации о последовательностях ДНК в 1982 году был основан GenBankGenBank — хранилище последовательностей

Слайд 10Пионеры биоинформатики
Лайнус Полинг
1962
Zuckerkandl, E., and L. Pauling. 1962. Molecular disease,

evolution, and genic heterogeneity. Horizons in Biochemistry, Academic Press, New

York, 189-225.

Zuckerkandl, E., and L. Pauling. 1965. Evolutionary divergence and convergence
in proteins. Evolving Genes and Proteins, Academic Press, New York, 97-166.

Анализ аминокислотных последовательностей глобинов нескольких позвоночных

Гипотеза молекулярных часов

Пионеры биоинформатикиЛайнус Полинг1962Zuckerkandl, E., and L. Pauling. 1962. Molecular disease, evolution, and genic heterogeneity. Horizons in Biochemistry,

Слайд 11Пионеры биоинформатики
Маргарет Дейхофф
Однобуквенный код аминокислот
A,C,D,E,F,G,H…

Матрицы аминокислотных замен PAM (Point Accepted

Mutation)
1965
Атлас последовательностей белков и их структур (1965)

Пионеры биоинформатикиМаргарет ДейхоффОднобуквенный код аминокислот	A,C,D,E,F,G,H…Матрицы аминокислотных замен PAM (Point Accepted Mutation)1965Атлас последовательностей белков и их структур (1965)

Слайд 12Первый “банк данных”
Атлас белковых последовательностей и их структур

1965 -1978
Первая версия

атласа содержала описание 65 (!) последовательностей белков

Первый “банк данных”Атлас белковых последовательностей и их структур1965 -1978Первая версия атласа содержала описание 65 (!) последовательностей белков

Слайд 13Банки данных
Архивные (примеры: PDB, GenBank) за содержание каждой записи

отвечает её автор-экспериментатор
Курируемые за содержание записей отвечают специальные люди —

кураторы
Автоматические записи генерируются компьютерными программами
Банки данных Архивные   (примеры: PDB, GenBank) 	за содержание каждой записи отвечает её автор-экспериментатор  Курируемые

Слайд 14Банк данных Swiss-Prot
1986
Swiss-Prot – база знаний о белковых последовательностях
http://www.expasy.org/sprot/
Курируемая

база данных
“Золотой стандарт” аннотации

Банк данных Swiss-Prot1986Swiss-Prot – база знаний о белковых последовательностяхhttp://www.expasy.org/sprot/ Курируемая база данных  “Золотой стандарт” аннотации

Слайд 15Банк данных Swiss-Prot
Амос Байрох
Руководитель группы Swiss-Prot в Швейцарском Институте

Биоинформатики
С 1987 поддерживается в сотрудничестве между

Swiss Institute of Bioinformatics

(SIB)
European Bioinformatics Institute (EBI)
Банк данных Swiss-ProtАмос Байрох Руководитель группы Swiss-Prot в Швейцарском Институте БиоинформатикиС 1987 поддерживается в сотрудничестве между Swiss

Слайд 16Банк данных Swiss-Prot
Статистика роста
количества документов
Текущий релиз 48.9 (24 января

2006) содержит 206586 документов
1986
2006
2001

Банк данных Swiss-ProtСтатистика роста количества документовТекущий релиз 48.9 (24 января 2006) содержит 206586 документов198620062001

Слайд 17Банк данных TrEMBL

Формальная трансляция всех кодирующих нуклеотидных последовательностей из банка

EMBL

Автоматическая классификация и аннотация

TrEMBL (Translated EMBL)
Текущий релиз 31.9 (24

января 2006) содержит 2 586 884 документа
Банк данных TrEMBLФормальная трансляция всех кодирующих нуклеотидных последовательностей из банка EMBLАвтоматическая классификация и аннотацияTrEMBL (Translated EMBL) Текущий

Слайд 18Тенденция объединения
2002

Тенденция объединения2002

Слайд 19Банк данных UniProt
UniProt (Universal Protein Resource)
UniProt Knowlegebase – SwissProt+TrEMBL

UniProt

Archive – UniParc

UniProt Reference – UniRef

Банк данных UniProtUniProt (Universal Protein Resource) UniProt Knowlegebase – SwissProt+TrEMBLUniProt Archive – UniParcUniProt Reference – UniRef

Слайд 20

~2 500 000
последовательностей









компьютерный поиск гена, трансляция

и компьютерная аннотация


UniRef
(UniProt
non-redundant
Reference
databases)

UniParc (UniProt Archive)


∼200 000 последовательностей
Экспертиза

Базы

данных
научной литературы


~2 500 000    последовательностейкомпьютерный поиск гена, трансляция и компьютерная аннотацияUniRef (UniProt non-redundant Reference databases)UniParc

Слайд 21Соотношение числа белков, представленных в разных банках
3 078 524
33 321
206 586
Последовательностей

во много раз больше, чем структур!

Большинство последовательностей не аннотированы!

Соотношение числа белков, представленных в разных банках3 078 52433 321206 586Последовательностей во много раз больше, чем структур!Большинство

Слайд 22Документ банка данных Swiss-Prot
Описание документа: идентификатор,
имя, дата создания и

модификации
Аннотация
последовательности
Последовательность



Документ банка данных Swiss-ProtОписание документа: идентификатор, имя, дата создания и модификации Аннотация последовательностиПоследовательность

Слайд 23Основные поля записи SwissProt
ID
AC
DE
OS
OC
И сама последовательность, конечно.

Основные поля записи SwissProtIDACDEOSOCИ сама последовательность, конечно.

Обратная связь

Если не удалось найти и скачать доклад-презентацию, Вы можете заказать его на нашем сайте. Мы постараемся найти нужный Вам материал и отправим по электронной почте. Не стесняйтесь обращаться к нам, если у вас возникли вопросы или пожелания:

Email: Нажмите что бы посмотреть 

Что такое TheSlide.ru?

Это сайт презентации, докладов, проектов в PowerPoint. Здесь удобно  хранить и делиться своими презентациями с другими пользователями.


Для правообладателей

Яндекс.Метрика