آشنایی با co-expression
در زیست شناسی مولکولی، یکی از پرسش های اساسی این است که ژن ها در چه زمانی، در کدام بافت و تحت تاثیر چه شرایطی فعال یا غیرفعال می شوند. عملکرد سلول حاصل فعالیت یک ژن منفرد نیست، بلکه معمولا مجموعه ای از ژن ها به صورت هماهنگ در کنار هم عمل می کنند تا فرایندهای پیچیده زیستی را پیش ببرند. به همین دلیل، مطالعه الگوهای بیان ژن تنها زمانی معنا پیدا می کند که بتوان روابط بین ژن ها را نیز بررسی کرد. در این چارچوب، مفهومی به نام co-expression اهمیت زیادی پیدا می کند و به یکی از پایه های تحلیل داده های ترنسکریپتومی تبدیل شده است. اما co-expression چیست؟ به طور خلاصه، اگر دو یا چند ژن در مجموعه ای از نمونه ها، بافت ها یا شرایط آزمایشی الگوی تغییر مشابهی داشته باشند، گفته می شود این ژن ها co-expressed هستند. برای مثال، ممکن است در پاسخ به یک استرس سلولی، چند ژن به صورت همزمان افزایش بیان نشان دهند و در شرایط عادی نیز همگی کاهش پیدا کنند. این هماهنگی در تغییرات، می تواند نشانه ای از تنظیم مشترک یا مشارکت در یک عملکرد زیستی مشابه باشد.
با توسعه فناوری هایی مانند microarray و RNA sequencing، امکان اندازه گیری همزمان بیان هزاران ژن فراهم شده است. این پیشرفت باعث شده تحلیل co-expression به ابزاری قدرتمند برای شناسایی مسیرهای زیستی، کشف ماژول های ژنی، پیش بینی عملکرد ژن های ناشناخته و درک بهتر سازمان یافتگی فعالیت ژن ها در سلول تبدیل شود. به همین دلیل، آشنایی با co-expression برای دانشجویان و پژوهشگران حوزه های زیستی، ژنتیک و بیوانفورماتیک اهمیت زیادی دارد.
چرا بعضی ژن ها با هم فعال می شوند؟
در سلول، بسیاری از فعالیت های حیاتی به همکاری همزمان چندین مولکول وابسته هستند. برای اینکه یک فرایند زیستی به درستی انجام شود، معمولا لازم است چند پروتئین مختلف در زمان مناسب و با مقدار مناسب تولید شوند. از آنجا که هر پروتئین از روی یک ژن ساخته می شود، سلول باید بتواند بیان چند ژن را به صورت هماهنگ تنظیم کند. به همین علت، در داده های بیان ژن اغلب مشاهده می شود که گروهی از ژن ها به طور همزمان فعال یا غیرفعال می شوند.
یکی از مهم ترین دلایل این هماهنگی، وجود تنظیم کننده های مشترک است. برای نمونه، یک فاکتور رونویسی می تواند به نواحی تنظیمی چند ژن متصل شود و رونویسی همه آن ها را تحت تاثیر قرار دهد. در چنین وضعیتی، فعال شدن یا غیرفعال شدن آن فاکتور رونویسی باعث می شود چند ژن با هم تغییر بیان پیدا کنند. به همین ترتیب، بعضی microRNAها، تغییرات اپی ژنتیکی و وضعیت باز یا بسته بودن کروماتین نیز می توانند همزمان روی مجموعه ای از ژن ها اثر بگذارند و الگوی بیان مشابهی در آن ها ایجاد کنند.
عامل مهم دیگر، مشارکت ژن ها در یک مسیر زیستی مشترک است. اگر چند ژن در یک مسیر متابولیکی، در چرخه سلولی، در پاسخ ایمنی یا در تمایز سلولی نقش داشته باشند، سلول معمولا بیان آن ها را به صورت هماهنگ تنظیم می کند. برای مثال، در یک مسیر آنزیمی، تولید تنها یکی از اجزای مسیر کافی نیست و باید چندین آنزیم در کنار هم ساخته شوند تا واکنش ها به شکل پیوسته انجام گیرند. این هماهنگی عملکردی، اغلب به صورت همبستگی در داده های بیان ژن دیده می شود.
نوع بافت و وضعیت فیزیولوژیک سلول نیز نقش تعیین کننده ای دارد. ژن هایی که برای عملکرد عضله ضروری هستند، در سلول های عضلانی بیان بالاتری دارند، در حالی که همان ژن ها ممکن است در سلول های عصبی یا کبدی بسیار کم بیان شوند. همچنین در شرایطی مانند التهاب، کمبود اکسیژن، پاسخ به دارو یا استرس اکسیداتیو، مجموعه ای از ژن ها به صورت هماهنگ فعال می شوند. بنابراین co-expression در بسیاری از موارد بازتابی از منطق تنظیمی و عملکردی سلول است.
co-expression چیست؟ یک تعریف جامع و کاربردی
در ساده ترین تعریف، co-expression به شباهت در الگوی بیان دو یا چند ژن در مجموعه ای از نمونه ها اشاره دارد. منظور از این شباهت آن است که وقتی بیان یک ژن در برخی شرایط افزایش پیدا می کند، بیان ژن دیگر نیز روندی مشابه نشان دهد و زمانی که یکی کاهش می یابد، دیگری هم کاهش پیدا کند. بنابراین پاسخ به این پرسش که co-expression چیست، صرفا به بالا یا پایین بودن بیان ژن مربوط نیست، بلکه به هماهنگی در تغییرات بیان مربوط می شود.
برای درک بهتر، فرض کنید بیان چند ژن در بافت های مختلف یا در نمونه های متعلق به بیماران متفاوت اندازه گیری شده است. اگر مشاهده شود که دو ژن در بیشتر این نمونه ها رفتاری مشابه دارند، یعنی در نمونه های با بیان بالا هر دو افزایش یافته اند و در نمونه های با بیان پایین هر دو کاهش یافته اند، می توان گفت این دو ژن دارای co-expression هستند. در اینجا آنچه اهمیت دارد، شکل تغییرات در طول نمونه هاست، نه فقط مقدار مطلق بیان.
نکته مهم این است که co-expression به معنای رابطه مستقیم علت و معلولی بین ژن ها نیست. ممکن است دو ژن هرگز مستقیما بر یکدیگر اثر نگذارند، اما هر دو تحت کنترل یک تنظیم کننده مشترک باشند یا در پاسخ به یک وضعیت سلولی مشابه تغییر کنند. به همین دلیل، co-expression بیشتر به عنوان یک نشانه از ارتباط احتمالی عملکردی یا تنظیمی در نظر گرفته می شود، نه یک اثبات قطعی از تعامل مستقیم.
در مطالعات ژنومیک و ترنسکریپتومیک، این مفهوم اهمیت زیادی دارد، زیرا به پژوهشگران اجازه می دهد در میان حجم عظیمی از داده ها، الگوهای پنهان را شناسایی کنند. وقتی هزاران ژن به طور همزمان اندازه گیری می شوند، بررسی این که کدام ژن ها رفتار مشابهی دارند، می تواند راهی موثر برای کشف مسیرهای زیستی، ساخت شبکه های ژنی و پیشنهاد نقش برای ژن های کمتر شناخته شده باشد.
co-expression در داده های بیان ژن چگونه دیده می شود؟
برای مطالعه co-expression، ابتدا باید داده های بیان ژن در دسترس باشد. این داده ها معمولا از فناوری هایی مانند RNA sequencing و microarray به دست می آیند که امکان اندازه گیری همزمان بیان هزاران ژن را در تعداد زیادی نمونه فراهم می کنند. هر نمونه ممکن است مربوط به یک بافت، یک بیمار، یک مرحله رشد، یک زمان مشخص پس از تحریک یا یک شرایط آزمایشی خاص باشد.
خروجی این آزمایش ها معمولا به صورت یک ماتریس بیان ژن نمایش داده می شود. در این ماتریس، سطرها نمایانگر ژن ها و ستون ها نمایانگر نمونه ها هستند. هر عدد درون ماتریس، سطح بیان یک ژن را در یک نمونه خاص نشان می دهد. با بررسی مقادیر هر ژن در ستون های مختلف، می توان الگوی تغییرات بیان آن ژن را در نمونه های گوناگون مشاهده کرد.
co-expression زمانی آشکار می شود که الگوی تغییرات دو ژن در این ماتریس به یکدیگر شبیه باشد. برای مثال، اگر ژن A و ژن B در نمونه های مشابه بالا بروند و در همان نمونه ها با هم پایین بیایند، این شباهت می تواند نشان دهنده co-expression باشد. برعکس، اگر تغییرات این دو ژن هیچ هماهنگی مشخصی نداشته باشد، نمی توان برای آن ها co-expression قابل توجهی در نظر گرفت.
برای نمایش بهتر این روابط، از نمودارها و روش های مصورسازی نیز استفاده می شود. یکی از روش های رایج، رسم نمودار پراکندگی برای بیان دو ژن در مجموعه ای از نمونه هاست. اگر نقاط نمودار حول یک روند مشخص قرار بگیرند، نشان می دهد میان بیان این دو ژن نوعی ارتباط وجود دارد. در مقیاس بزرگ تر، از نقشه های حرارتی، خوشه بندی و شبکه های ژنی استفاده می شود تا الگوهای co-expression در مجموعه های بزرگ داده به شکلی واضح تر دیده شوند.
چگونه مشخص می شود دو ژن co-expressed هستند؟
برای تعیین اینکه دو ژن co-expressed هستند یا نه، باید میزان شباهت الگوی بیان آن ها در چندین نمونه اندازه گیری شود. این کار معمولا با روش های آماری انجام می شود. ایده اصلی این است که اگر تغییرات بیان دو ژن در طول نمونه ها به طور منظم با یکدیگر همراه باشد، می توان برای آن ها رابطه co-expression در نظر گرفت.
رایج ترین روش برای سنجش این شباهت، محاسبه ضریب همبستگی است. ضریب همبستگی نشان می دهد که تغییرات دو متغیر تا چه اندازه با هم هماهنگ هستند. در تحلیل بیان ژن، اگر این ضریب برای دو ژن مقدار بالایی داشته باشد، یعنی در بیشتر نمونه ها با هم تغییر می کنند. اگر ضریب نزدیک صفر باشد، ارتباط مشخصی در الگوی بیان آن ها دیده نمی شود. در برخی موارد نیز ممکن است همبستگی منفی مشاهده شود؛ یعنی افزایش بیان یک ژن با کاهش بیان ژن دیگر همراه باشد که این حالت هم می تواند از نظر زیستی معنادار باشد.
روش های متداول برای سنجش co-expression عبارت اند از:
- ضریب همبستگی پیرسون، که برای بررسی رابطه خطی بین مقادیر بیان مناسب است
- ضریب همبستگی اسپیرمن، که بر پایه رتبه بندی داده ها عمل می کند و در برابر برخی انحراف ها مقاوم تر است
- معیارهای فاصله و شباهت، که در خوشه بندی و برخی روش های شبکه سازی به کار می روند
- روش های پیشرفته تر مانند همبستگی جزئی یا معیارهای مبتنی بر اطلاعات متقابل، که در برخی مطالعات برای کشف روابط پیچیده تر استفاده می شوند
پس از محاسبه شاخص شباهت، معمولا یک آستانه برای انتخاب روابط معنادار تعیین می شود. اگر مقدار همبستگی از این آستانه بیشتر باشد، آن جفت ژنی به عنوان یک رابطه co-expression در نظر گرفته می شود. البته این آستانه ثابت و جهانی نیست و به عواملی مانند تعداد نمونه ها، نوع داده، کیفیت اندازه گیری و هدف مطالعه بستگی دارد. در بسیاری از تحلیل ها، علاوه بر مقدار همبستگی، از آزمون های آماری و اصلاح چندگانه نیز استفاده می شود تا احتمال شناسایی روابط کاذب کاهش یابد.
در نهایت، باید توجه داشت که این مرحله تنها آغاز تفسیر زیستی است. شناسایی دو ژن به عنوان co-expressed به معنای آن نیست که رابطه آن ها از نظر زیستی قطعی و اثبات شده است. این نتیجه بیشتر یک سرنخ آماری معتبر فراهم می کند که می تواند در کنار دانش زیستی موجود و آزمایش های تکمیلی تفسیر شود.
شبکه های co-expression ژنی چگونه ساخته می شوند؟
وقتی تعداد ژن ها زیاد باشد، بررسی روابط دو به دوی همه ژن ها به صورت جداگانه بسیار دشوار می شود. برای حل این مسئله، پژوهشگران از شبکه های co-expression ژنی استفاده می کنند. این شبکه ها راهی برای نمایش ساختار کلی روابط بین ژن ها هستند و امکان می دهند داده های پیچیده بیان ژن به شکلی منظم و قابل تفسیر دیده شوند.
در یک شبکه co-expression، هر ژن به عنوان یک گره در نظر گرفته می شود. اگر بین دو ژن شباهت کافی در الگوی بیان وجود داشته باشد، بین آن ها یک یال رسم می شود. این یال به معنای آن است که دو ژن در داده های مورد بررسی به صورت هماهنگ تغییر می کنند. در نتیجه، به جای آنکه با یک فهرست طولانی از ضرایب همبستگی مواجه باشیم، می توان تصویری از ساختار ارتباطی ژن ها در قالب یک گراف مشاهده کرد.
برای ساخت چنین شبکه ای، ابتدا میزان شباهت بین همه جفت های ژنی محاسبه می شود. سپس بر اساس یک معیار مشخص، روابط قوی تر انتخاب می شوند. در برخی روش ها، تنها روابطی که از یک آستانه عبور کنند در شبکه باقی می مانند و در برخی روش های دیگر، همه روابط با وزن های متفاوت حفظ می شوند. شبکه های وزن دار معمولا اطلاعات بیشتری درباره شدت رابطه ها در اختیار می گذارند و در تحلیل های پیشرفته بسیار کاربرد دارند.
یکی از مفاهیم کلیدی در این شبکه ها، ماژول های ژنی است. ماژول به گروهی از ژن ها گفته می شود که در شبکه ارتباطات بیشتری با یکدیگر دارند تا با ژن های خارج از گروه. چنین ماژول هایی اغلب از نظر زیستی نیز معنادار هستند، زیرا ژن های موجود در آن ها ممکن است در یک مسیر مشترک، یک پاسخ سلولی خاص یا یک ساختار بافتی مشابه نقش داشته باشند. از این رو، شناسایی ماژول ها می تواند به کشف سازمان عملکردی ژن ها در سطح سیستم کمک کند.
در بسیاری از مطالعات، از روش هایی مانند WGCNA برای ساخت و تحلیل شبکه های co-expression استفاده می شود. این نوع روش ها علاوه بر شناسایی ماژول ها، امکان ارتباط دادن هر ماژول با صفات زیستی یا بالینی را نیز فراهم می کنند. برای مثال، ممکن است یک ماژول خاص با شدت بیماری، پاسخ به درمان یا مرحله رشد همبستگی نشان دهد. چنین تحلیلی، شبکه co-expression را از یک ابزار توصیفی به یک چارچوب قدرتمند برای تولید فرضیه های زیستی تبدیل می کند.
co-expression چه کمکی به درک عملکرد ژن ها می کند؟
یکی از مسائل مهم در زیست شناسی مولکولی این است که برای تعداد زیادی از ژن ها، با وجود آنکه توالی و محل آن ها در ژنوم مشخص شده، عملکرد دقیق آن ها هنوز به خوبی شناخته نشده است. تحلیل co-expression در اینجا می تواند بسیار مفید باشد، زیرا از الگوهای بیان برای پیشنهاد نقش احتمالی ژن ها استفاده می کند.
منطق اصلی این رویکرد آن است که ژن های دارای عملکرد مشابه، اغلب الگوی بیان مشابهی نیز دارند. اگر یک ژن ناشناخته همواره در کنار گروهی از ژن های شناخته شده و مرتبط با یک فرایند خاص بیان شود، می توان حدس زد که آن ژن نیز به احتمال زیاد در همان فرایند نقش دارد. این اصل که گاهی با عنوان guilt by association شناخته می شود، یکی از مبانی مهم تحلیل های عملکردی در ژنومیکس است.
برای مثال، اگر یک ژن ناشناخته در مجموعه ای از داده ها همواره همراه با ژن های مرتبط با چرخه سلولی، تکثیر DNA و میتوز افزایش بیان نشان دهد، این الگو می تواند نشان دهد که آن ژن نیز احتمالا در تقسیم سلولی یا کنترل رشد سلول مشارکت دارد. به همین شکل، همراهی مداوم یک ژن با ژن های ایمنی، متابولیکی یا عصبی می تواند نشانه ای از نقش آن در همان حوزه ها باشد.
بررسی ماژول های شبکه ای نیز این فرایند را دقیق تر می کند. اگر یک ژن ناشناخته درون ماژولی قرار بگیرد که بیشتر اعضای آن با یک عملکرد زیستی مشخص شناخته شده اند، احتمال ارتباط عملکردی آن ژن با همان فرایند افزایش می یابد. در اینجا نه فقط یک رابطه دو به دو، بلکه موقعیت ژن در کل ساختار شبکه مورد توجه قرار می گیرد. به ویژه اگر آن ژن درون ماژول ارتباطات زیادی داشته باشد، ممکن است از عناصر مهم آن فرایند زیستی باشد.
البته تحلیل co-expression به تنهایی جایگزین آزمایش های عملکردی نیست. این تحلیل بیشتر یک ابزار فرضیه ساز است که جهت گیری مناسبی برای مطالعات بعدی ایجاد می کند. اما در عمل، همین توانایی برای اولویت بندی ژن ها و محدود کردن دامنه جست وجو، ارزش علمی زیادی دارد و می تواند زمان و هزینه پژوهش را به طور قابل توجهی کاهش دهد.
کاربردهای co-expression در تحقیقات زیستی و پزشکی
تحلیل co-expression در سال های اخیر به یکی از ابزارهای پرکاربرد در ژنومیکس، ترنسکریپتومیکس و زیست شناسی سامانه ها تبدیل شده است. دلیل این موضوع آن است که این روش می تواند از دل داده های بزرگ، الگوهایی را بیرون بکشد که با نگاه مستقیم به جدول های بیان ژن قابل مشاهده نیستند. به همین علت، کاربردهای آن از پژوهش های پایه تا مطالعات پزشکی و ترجمه ای گسترش یافته است.
یکی از مهم ترین کاربردها، پیش بینی عملکرد ژن های ناشناخته است. در بسیاری از موجودات، هنوز بخش قابل توجهی از ژن ها به طور کامل از نظر عملکردی توصیف نشده اند. با استفاده از الگوهای co-expression می توان این ژن ها را در کنار ژن های شناخته شده قرار داد و برای آن ها نقش های احتمالی پیشنهاد کرد. این کاربرد به ویژه در گونه های کمتر مطالعه شده یا در شرایطی که داده های عملکردی محدود است، اهمیت زیادی دارد.
کاربرد دیگر، شناسایی مسیرهای زیستی و فرایندهای سلولی فعال در شرایط مختلف است. وقتی ژن های هم بیان شده در قالب ماژول ها یا خوشه ها شناسایی می شوند، می توان بررسی کرد که این مجموعه ها با چه مسیرها یا عملکردهایی غنی شده اند. برای مثال، ممکن است یک ماژول با متابولیسم انرژی، پاسخ ایمنی، التهاب، آپوپتوز یا تمایز سلولی مرتبط باشد. این اطلاعات به درک بهتر وضعیت مولکولی سلول در شرایط مختلف کمک می کند.
در پزشکی و پژوهش های بیماری محور، co-expression ابزار بسیار مفیدی است. در بیماری هایی مانند سرطان، اختلالات عصبی، بیماری های خودایمنی و بیماری های متابولیک، تنها سطح بیان تک تک ژن ها تغییر نمی کند، بلکه الگوی هماهنگی بین ژن ها نیز دگرگون می شود. مقایسه شبکه های co-expression در بافت سالم و بیمار می تواند نشان دهد که کدام ماژول ها مختل شده اند و کدام مسیرها در بیماری نقش محوری دارند. این اطلاعات گاهی به شناسایی نشانگرهای زیستی جدید یا اهداف درمانی بالقوه منجر می شود.
همچنین از co-expression برای یافتن ژن های مرکزی یا hub genes استفاده می شود. این ژن ها در شبکه ارتباطات زیادی با ژن های دیگر دارند و ممکن است در پایداری یک ماژول یا تنظیم یک فرایند زیستی نقش مهمی ایفا کنند. در بسیاری از مطالعات، ژن های hub به عنوان نامزدهای مناسب برای بررسی های بیشتر انتخاب می شوند، زیرا احتمال دارد تغییر در آن ها اثر گسترده تری بر کل سیستم داشته باشد.
در کشاورزی، زیست فناوری و مطالعات تکاملی نیز تحلیل co-expression کاربرد دارد. این روش می تواند در شناسایی ژن های مرتبط با تحمل تنش، رشد، عملکرد بافت های خاص، صفات فنوتیپی مهم یا سازوکارهای تکاملی تنظیم ژن ها کمک کند. بنابراین co-expression تنها محدود به زیست شناسی انسانی نیست و در طیف وسیعی از شاخه های علوم زیستی جایگاه دارد.
محدودیت های تحلیل co-expression
با وجود ارزش بالای تحلیلی، co-expression محدودیت هایی دارد که باید در تفسیر نتایج مورد توجه قرار گیرند. مهم ترین نکته این است که همبستگی به معنای تعامل مستقیم نیست. دو ژن ممکن است الگوی بیان مشابهی داشته باشند، اما این شباهت لزوما به این معنا نیست که یکی دیگری را تنظیم می کند یا هر دو در یک مسیر واحد عمل می کنند. گاهی هر دو ژن صرفا به یک عامل سوم پاسخ می دهند و شباهت مشاهده شده نتیجه یک اثر غیرمستقیم است.
کیفیت داده ها نیز تاثیر زیادی بر نتیجه دارد. اگر تعداد نمونه ها کم باشد، برآورد همبستگی ها ناپایدار می شود و احتمال روابط کاذب افزایش می یابد. همچنین داده های بیان ژن ممکن است تحت تاثیر نویز فنی، تفاوت در کیفیت نمونه ها، اثر دسته ای، عمق توالی یابی، یا خطاهای نرمال سازی قرار بگیرند. در چنین شرایطی، روابط مشاهده شده ممکن است بازتاب تفاوت های فنی باشند نه تفاوت های واقعی زیستی.
ناهمگنی زیستی نیز یک چالش مهم است. برای مثال، اگر یک بافت از چند نوع سلول مختلف تشکیل شده باشد، تغییر در نسبت این سلول ها می تواند الگوهای co-expression را تحت تاثیر قرار دهد. در نتیجه، ممکن است همبستگی هایی دیده شوند که در واقع ناشی از ترکیب سلولی نمونه ها هستند، نه تنظیم واقعی ژن ها درون یک نوع سلول خاص. به همین دلیل، در سال های اخیر داده های single-cell RNA-seq نیز برای تحلیل های دقیق تر مورد استفاده قرار گرفته اند، هرچند خود این داده ها هم چالش های محاسباتی ویژه ای دارند.
انتخاب روش آماری و تعیین آستانه نیز بر نتایج اثر می گذارد. اگر آستانه بسیار سخت گیرانه باشد، روابط واقعی از دست می روند و اگر بیش از حد آسان گیرانه انتخاب شود، شبکه با روابط ضعیف و کم معنا پر می شود. همچنین برخی روابط زیستی غیرخطی هستند و ممکن است با روش های ساده همبستگی به خوبی شناسایی نشوند. بنابراین انتخاب معیار مناسب باید با توجه به ویژگی های داده و پرسش پژوهشی انجام شود.
در نهایت، نتایج تحلیل co-expression معمولا باید با داده ها و روش های مکمل تفسیر شوند. ترکیب این تحلیل با اطلاعاتی مانند داده های پروتئینی، تعاملات پروتئین-پروتئین، داده های اپی ژنتیک، مسیرهای شناخته شده و آزمایش های عملکردی، اعتبار زیستی یافته ها را افزایش می دهد. به همین دلیل، بهترین استفاده از co-expression زمانی حاصل می شود که این روش به عنوان بخشی از یک چارچوب تحلیلی جامع به کار رود، نه به عنوان تنها منبع نتیجه گیری.
جمع بندی
co-expression مفهومی کلیدی در تحلیل بیان ژن است و به شباهت در الگوی تغییرات بیان میان دو یا چند ژن اشاره دارد. این شباهت می تواند نشانه ای از تنظیم مشترک، حضور در یک مسیر زیستی یکسان یا مشارکت در یک عملکرد سلولی مشابه باشد. به همین دلیل، پاسخ به پرسش co-expression چیست تنها یک تعریف ساده آماری نیست، بلکه ورود به یکی از مهم ترین رویکردهای تفسیر داده های ژنومی و ترنسکریپتومی است. تحلیل co-expression به پژوهشگران کمک می کند از میان هزاران ژن، روابط معنادار را شناسایی کنند، ماژول های عملکردی بسازند، نقش احتمالی ژن های ناشناخته را پیش بینی کنند و شبکه های ژنی را در سطحی وسیع تر درک کنند. این روش به ویژه در مطالعات زیستی و پزشکی، برای کشف مسیرهای درگیر در بیماری، شناسایی ژن های کلیدی و تولید فرضیه های جدید اهمیت زیادی دارد.



