
Apache Spark MLlib هي مكتبة مفتوحة المصدر للتعلم الآلي وهي جزء من مشروع Apache Spark. تم تصميمها لجعل التعلم الآلي العملي قابلاً للتوسع وسهلاً في التنفيذ. يوفر MLlib مجموعة متنوعة من خوارزميات وأدوات التعلم الآلي، بما في ذلك التصنيف والانحدار والتجمع وتصفية التعاون وتقليل الأبعاد. يدمج بسلاسة مع واجهات برمجة تطبيقات Spark ويدعم عدة لغات برمجة، بما في ذلك Java وScala وPython وR.
Apache Spark تم تطويره في البداية في 2009 في AMPLab بجامعة كاليفورنيا في بيرkeley بواسطة Matei Zaharia وتم نشره كمصدر مفتوح في 2010. بدأ تطوير MLlib في 2012 كجزء من مشروع MLbase وتم نشره كمصدر مفتوح في سبتمبر 2013. منذ بدايته، تم تضمين MLlib مع Spark، حيث تم تضمين الإصدار الأول في Spark 0.8. شهد المشروع نموًا سريعًا بفضل مجتمعه المفتوح النشط، والذي يضم أكثر من 140 مساهمًا من منظمات مختلفة.
Apache Spark MLlib تقدم مجموعة شاملة من خوارزميات وأدوات التعلم الآلي. تشمل الميزات الرئيسية:
أدخلت التحديثات الأخيرة إلى Apache Spark MLlib عدة ميزات جديدة وتحسينات، بما في ذلك:
كمشروع مفتوح المصدر، يزدهر Apache Spark MLlib على ثقافة المجتمع التعاوني والشامل. يقدّر المشروع الشفافية والابتكار والتنمية المدفوعة من قبل المجتمع. يعمل المساهمون من جميع أنحاء العالم معًا لتحسين المكتبة، ومشاركة المعرفة، ودعم بعضهم البعض من خلال المنتديات وقوائم البريد والنشاطات المجتمعية.
Apache Spark MLlib لديها قاعدة مستخدمين كبيرة ونشيطة، تشمل علماء البيانات والمهندسين والباحثين من مختلف الصناعات. يتم دعم المجتمع من خلال قوائم البريد ومنتديات والنشاطات مثل قمة Spark. يستفيد المشروع من مساهمات أكثر من 140 شخصًا من أكثر من 50 منظمة، مما يعكس اعتماده الواسع ودعم المجتمع القوي.