توسیع پذیر ڈیٹا پائپ لائنز بنائیں Hadoop ماحولیاتی نظام کا استعمال کرتے ہوئے بڑے ڈیٹا سیٹس کا نظم و نسق اور اس پر کارروائی کرنا سیکھیں۔
بڑے ڈیٹا (Big Data) کو مؤثر طریقے سے پروسیس کریں۔ تیز رفتار اور ڈسٹریبیوٹڈ ڈیٹا پروسیسنگ کے لیے Spark اور MapReduce کا استعمال کریں۔
NoSQL ڈیٹا بیسزمیں مہارت حاصل کریں؛ MongoDB، Cassandra، HBase، Neo4j اور Redis کے ساتھ کام کریں۔
پیمانے پر مشین لرننگکا اطلاق کریں بڑے ڈیٹا سیٹس پر Spark MLlib کا استعمال کرتے ہوئے پیش گوئی کرنے والے ماڈلز بنائیں۔
حقیقی دنیا کے تجزیاتی مسائل حل کریں اور عملی منصوبوں (hands-on projects) اور کیس اسٹڈیز کے ذریعے حقیقی ڈیٹا سیٹس کا تجزیہ کریں۔
اس کورس میں کامیابی حاصل کرنے کے لیے طلبہ کے پاس درج ذیل بنیادی علم اور مہارتیں ہونی چاہییں: