कंप्यूटर विज्ञान की नींव कच्चे डेटा और प्रसंस्कृत सूचना के अंतर को समझने पर टिकी है:
- डेटा (Data): किसी अवलोकन, माप या गणना से एकत्रित किए गए कच्चे, असंगठित, असंसाधित तथ्यों, अंकों या प्रतीकों को डेटा कहा जाता है। अपने आप में डेटा का कोई संदर्भ या अर्थ नहीं होता और इसके आधार पर कोई निर्णय नहीं लिया जा सकता। उदाहरण के लिए:
95, 88, 76, 'राहुल', 8—ये केवल अलग-अलग मान हैं। यह स्पष्ट नहीं है कि यह अंक हैं, रोल नंबर हैं या किसी घर का पता। - सूचना (Information): जब कच्चे डेटा को व्यवस्थित, संसाधित (Processed), फ़िल्टर और संरचित किया जाता है ताकि उसका एक स्पष्ट संदर्भ और अर्थ निकले, तो उसे सूचना कहते हैं। जब उपरोक्त डेटा को संसाधित किया जाता है: "कक्षा 8 के छात्र राहुल ने गणित में 95, विज्ञान में 88 और अंग्रेजी में 76 अंक प्राप्त करके कक्षा में प्रथम स्थान प्राप्त किया और 'A+' ग्रेड हासिल किया"—तो यह एक संपूर्ण सूचना (प्रगति पत्र / रिपोर्ट कार्ड) बन जाती है।
कच्चा डेटा (इनपुट) → प्रोसेसिंग (गणना, वर्गीकरण, छँटाई) → अर्थपूर्ण सूचना (आउटपुट) → तार्किक निर्णय।
कंप्यूटर के शुरुआती दौर में डेटा को अलग-अलग फाइलों (.txt, .dat या स्प्रेडशीट) में सुरक्षित रखा जाता था। इसे फ्लैट-फाइल सिस्टम (Flat-File System) कहा जाता था। जैसे-जैसे डेटा का आकार बढ़ा, फाइल सिस्टम में निम्नलिखित गंभीर समस्याएँ सामने आईं: