| name | arabic-big-data |
| name_ar | بيانات ضخمة |
| description | Master big data technologies in Arabic |
| description_ar | إتقان تقنيات البيانات الضخمة بالعربية |
| category | data-science |
| language | ar |
| dialect | msa |
| rtl | true |
| platform_all | true |
| version | 1.0.0 |
| author | salman-shaikh |
الهدف
إتقان أساسيات تقنيات البيانات الضخمة (Big Data).
مفاهيم أساسية
١. خصائص البيانات الضخمة (5V's)
| الحرف | المعنى | الوصف |
|---|
| Volume | حجم | كميات هائلة |
| Velocity | سرعة | تدفق سريع |
| Variety | تنوع | أنواع متعددة |
| Veracity | دقة | جودة بيانات |
| Value | قيمة | قيمة تجارية |
٢. معالجة موزعة
الأطر:
- Hadoop MapReduce
- Apache Spark
- Apache Flink
٣. تخزين
| النظام | النوع |
|---|
| HDFS | نظام ملفات موزع |
| S3 | تخزين كائنات |
| HBase | قاعدة NoSQL |
| Cassandra | قاعدة موزعة |
أدوات شائعة
| الأداة | الوصف |
|---|
| Apache Spark | معالجة في الذاكرة |
| Hadoop | معالجة دفعية |
| Kafka | تدفق بيانات |
| Airflow | أوركسترا |
أفضل الممارسات
✅ تصميم للتوسع
✅ معالجة قريبة من البيانات
✅ مراقبة الأداء
✅ أمان شامل
❌ لا تهمل تكلفة التخزين
❌ لا تهمل جودة البيانات
❌ لا تبالغ في التعقيد
الكلمات المفتاحية
عربي: "بيانات ضخمة", "big data", "Hadoop", "Spark"
English: "big data arabic", "Hadoop", "Spark", "distributed computing"
سجل التغييرات
v1.0.0