محققی که یک توالی پپتیدی کاندید در دست دارد، دنبال جواب یک سؤال سریع است: آیا چیزی شبیه این قبلاً آزمایش شده و جواب داده؟ گشتن در یک اکسل چند هزار ردیفی این را جواب نمیدهد؛ یک جستوجوی توالی درست جواب میدهد، اما فقط اگر پایگاهداده خودش این جستوجو را داشته باشد، نه فقط دادهها را در ردیفها.
یک فهرست توالی، ابزار جستوجو نیست
خیلی از پایگاهدادههای پپتیدهای ضدمیکروبی در واقع یک اکسل با یک کادر جستوجو هستند که فقط روی نام یا ارگانیسم منبع تطبیق میدهد. این وقتی مفید است که از قبل بدانید دنبال چه چیزی میگردید. اما وقتی یک توالی جدید دارید و میخواهید بدانید شبیه کدام پپتیدهای شناختهشده است، بیفایده است؛ دقیقاً همین تطبیقهای نزدیکبهیکسان چیزی هستند که جستوجوی مبتنیبر نام هرگز نشانشان نمیدهد.
جستوجوی شباهت، خودِ سؤال را عوض میکند
یک جستوجوی همترازی بهسبک BLAST، توالی ارسالی را با کل پایگاهداده مقایسه میکند و نتایج را بر اساس شباهت واقعی رتبهبندی میکند، نه بر اساس متادیتایی که یک ویراستار به آن چسبانده. این کار سؤال «آیا چیزی شبیه این وجود دارد» را از یک جستوجوی دستی به یک کوئری چند ثانیهای با نتایج رتبهبندیشده تبدیل میکند. برای کسی که یک دسته پپتید کاندید را در برابر فعالیتهای شناختهشده میسنجد، این فرق بین یک بعدازظهر و یک هفته است.
چیزی که واقعاً کمک میکند
جستوجوی توالی که خودِ پایگاهداده داشته باشد، نه ابزاری جدا که محقق باید داده را به آن اکسپورت کند. تبدیل فرمت کمتر، نسخههای پراکندهی کمتر از دیتاست، و نتیجهای که مستقیم به همان رکورد با دادهی فعالیت و منبعش وصل است.