نموذج لغة اللاما
Llama [ a ] ( Large Language Model Meta AI " يعمل كاختصار عكسي ) هي عائلة من نماذج اللغة الكبيرة (LLMs) التي أصدرتها Meta AI بدءًا من فبراير 2023. [ 3 ]
تأتي نماذج لاما بأحجام مختلفة، تتراوح من مليار إلى تريليوني مُعامل. في البداية، كان النموذج الأساسي فقط ، [ 4 ] ولكن بدءًا من لاما 2، أصدرت شركة ميتا إيه آي نسخًا مُحسّنة من التعليمات إلى جانب النماذج الأساسية. [ 5 ]
كانت أوزان النموذج للإصدار الأول من برنامج لاما متاحة للباحثين فقط، وذلك على أساس كل حالة على حدة، بموجب ترخيص غير تجاري. [ 6 ] وقد تم تداول نسخ غير مصرح بها من النموذج الأول عبر بروتوكول بت تورنت . [ 7 ] أما الإصدارات اللاحقة من برنامج لاما فقد أصبحت متاحة خارج الأوساط الأكاديمية، وتم إصدارها بموجب تراخيص تسمح ببعض الاستخدامات التجارية. [ 8 ]
بالتزامن مع إطلاق لاما 3، أطلقت ميتا مساعد ميتا للذكاء الاصطناعي، وهو مساعد مبني على لاما. يمتلك ميتا للذكاء الاصطناعي موقعًا إلكترونيًا خاصًا به، وهو متاح على فيسبوك وواتساب . [ 9 ] أحدث إصدار هو لاما 4، الذي صدر في أبريل 2025. [ 10 ]
في أبريل 2026، أصدرت شركة Meta Superintelligence Labs برنامج Muse Spark كبديل لبرنامج Llama. [ 11 ]
خلفية
بعد إطلاق نماذج لغوية ضخمة مثل GPT-3 ، انصبّ تركيز البحث على تطوير هذه النماذج، وهو ما أظهر في بعض الحالات زيادات كبيرة في القدرات الناشئة. [ 12 ] وقد أدى إطلاق ChatGPT ونجاحه المفاجئ إلى زيادة الاهتمام بالنماذج اللغوية الضخمة. [ 13 ]
بالمقارنة مع الاستجابات الأخرى لـ ChatGPT، صرّح يان ليكان، كبير علماء الذكاء الاصطناعي في شركة ميتا ، بأن نماذج اللغة الكبيرة هي الأفضل للمساعدة في الكتابة. [ 14 ] [ 15 ] [ 16 ]
الإصدارات
الإصدار الأولي
أُعلن عن الإصدار الأول من لاما (يُكتب اختصارًا LLaMA ويُشار إليه أحيانًا باسم لاما 1) في 24 فبراير 2023، عبر منشور على مدونة وورقة بحثية تصف تدريب النموذج وبنيته وأدائه. [ 17 ] [ 18 ] نُشر رمز الاستدلال المستخدم لتشغيل النموذج علنًا بموجب ترخيص GPLv3 مفتوح المصدر . [ 19 ] تُدار عملية الوصول إلى أوزان النموذج من خلال تقديم طلب، ويُمنح الوصول "على أساس كل حالة على حدة للباحثين الأكاديميين؛ والعاملين في منظمات حكومية ومجتمع مدني وأوساط أكاديمية؛ ومختبرات الأبحاث الصناعية حول العالم". [ 18 ]
تم تدريب نموذج لاما باستخدام معلومات متاحة للعموم فقط، وبأحجام نماذج مختلفة، بهدف جعله أكثر توافقًا مع مختلف أنواع الأجهزة. كان النموذج نموذجًا أساسيًا فقط ، [ 4 ] على الرغم من أن الورقة البحثية تضمنت أمثلة على نسخ مُحسَّنة من النموذج. [ 17 ]
أفادت شركة Meta AI أن أداء النموذج ذي 13 مليار معلمة على معظم معايير معالجة اللغة الطبيعية تجاوز أداء نموذج GPT-3 الأكبر بكثير (مع 175 مليار معلمة)، وكان النموذج الأكبر ذو 65 مليار معلمة منافسًا لأحدث النماذج مثل PaLM و Chinchilla . [ 20 ]
تسريب
في 3 مارس 2023، تم تحميل ملف تورنت يحتوي على أوزان نموذج لاما، ونُشر رابط التورنت على منتدى 4chan ، ثم انتشر لاحقًا عبر مجتمعات الذكاء الاصطناعي على الإنترنت. [ 21 ] في اليوم نفسه، تم فتح طلب سحب على مستودع لاما الرئيسي، يطلب إضافة رابط المغناطيس إلى الوثائق الرسمية. [ 22 ] [ 23 ] في 4 مارس، تم فتح طلب سحب لإضافة روابط إلى مستودعات HuggingFace التي تحتوي على النموذج. [ 24 ] [ 22 ] في 6 مارس، قدمت شركة ميتا طلبات إزالة لإزالة مستودعات HuggingFace المرتبطة بطلب السحب، واصفةً إياها بأنها "توزيع غير مصرح به" للنموذج. وقد امتثلت HuggingFace للطلبات. [ 25 ] في 20 مارس، قدمت شركة ميتا طلب إزالة محتوى بموجب قانون الألفية الرقمية لحقوق المؤلف (DMCA) لانتهاك حقوق الطبع والنشر ضد مستودع يحتوي على برنامج نصي يقوم بتنزيل برنامج لاما من خادم مرآة، وقد امتثلت غيت هاب للطلب في اليوم التالي. [ 26 ]
تباينت ردود الفعل على التسريب. تكهّن البعض بأن النموذج سيُستخدم لأغراض خبيثة، مثل البريد العشوائي المُعقّد . بينما احتفى آخرون بسهولة الوصول إلى النموذج، فضلاً عن إمكانية تشغيل نسخ مُصغّرة منه بتكلفة منخفضة نسبيًا، مما يُشير إلى أن ذلك سيُعزز ازدهار المزيد من الأبحاث والتطويرات. [ 21 ] قارن العديد من المُعلّقين، مثل سيمون ويليسون ، نموذج لاما بنموذج الانتشار المُستقر ، وهو نموذج لتحويل النصوص إلى صور ، والذي، على عكس النماذج المُعقّدة المُماثلة التي سبقته، كان مُتاحًا للجميع، مما أدّى إلى انتشار سريع للأدوات والتقنيات والبرامج المُرتبطة به. [ 21 ] [ 27 ]
لاما 2
في 18 يوليو 2023، أعلنت شركة ميتا، بالتعاون مع مايكروسوفت ، عن إطلاق لاما 2 (LLaMa 2)، الجيل التالي من لاما. درّبت ميتا لاما 2 وأطلقتها بثلاثة أحجام للنموذج: 7 و13 و70 مليار مُعامل. [ 5 ] بقي تصميم النموذج دون تغيير يُذكر عن نماذج لاما 1، ولكن استُخدمت بيانات أكثر بنسبة 40% لتدريب النماذج الأساسية. [ 28 ]
يتضمن Llama 2 نماذج أساسية ونماذج مُحسّنة خصيصًا للمحادثات. وفي تغييرٍ إضافي عن الإصدار الأصلي من Llama، تُصدر جميع النماذج بأوزانها ويمكن استخدامها في العديد من التطبيقات التجارية. ولأن ترخيص Llama يفرض سياسة استخدام مقبولة تمنع استخدام Llama لبعض الأغراض، فهو ليس مفتوح المصدر. وقد اعترضت مبادرة المصادر المفتوحة (التي تُشرف على تعريف المصادر المفتوحة ) وجهات أخرى على استخدام Meta لمصطلح " مفتوح المصدر" لوصف Llama. [ 29 ] [ 30 ]
يُعدّ Code Llama نسخةً مُحسّنة من Llama 2، مُزوّدة بمجموعات بيانات خاصة بالبرمجة. صدرت الإصدارات 7B و13B و34B في 24 أغسطس 2023، بينما صدر الإصدار 70B في 29 يناير 2024. [ 31 ] انطلاقًا من النماذج الأساسية لـ Llama 2، قامت Meta AI بتدريب 500 مليار رمز إضافي من مجموعات بيانات البرمجة، قبل إضافة 20 مليار رمز من بيانات السياق الطويل، مما أدى إلى إنشاء النماذج الأساسية لـ Code Llama. ثمّ خضع هذا النموذج الأساسي لمزيد من التدريب على 5 مليارات رمز من رموز تتبع التعليمات لإنشاء نموذج الضبط الدقيق للتعليمات. كما تمّ إنشاء نموذج أساسي آخر لبرمجة بايثون، حيث دُرِّب على 100 مليار رمز من رموز بايثون فقط، قبل إضافة بيانات السياق الطويل. [ 32 ]
اللاما 3
في 18 أبريل 2024، أطلقت شركة ميتا برنامج لاما 3 بحجمين: 8 مليارات و70 مليار مُعامل. تم تدريب النماذج مسبقًا على ما يقارب 15 تريليون رمز نصي جُمعت من "مصادر متاحة للعموم"، بينما تم ضبط نماذج التعليمات بدقة على "مجموعات بيانات تعليمات متاحة للعموم، بالإضافة إلى أكثر من 10 ملايين مثال مُعَلَّم بشريًا". أظهرت اختبارات ميتا للذكاء الاصطناعي في أبريل 2024 أن لاما 3 بحجم 70 مليار مُعامل يتفوق على جيميني برو 1.5 وكلاود 3 سونيت في معظم معايير الأداء. كما أعلنت ميتا عن خطط لجعل لاما 3 متعدد اللغات والوسائط ، وأكثر كفاءة في البرمجة والاستدلال، وتوسيع نطاق سياقه. [ 33 ] [ 34 ]
فيما يتعلق بقوانين التوسع ، أظهرت نماذج لاما 3 تجريبياً أنه عند تدريب نموذج على بيانات تتجاوز حجم "البيانات المثلى لـ Chinchilla "، يستمر الأداء في التوسع بشكل لوغاريتمي خطي. على سبيل المثال، يبلغ حجم مجموعة البيانات المثلى لـ Chinchilla لنموذج لاما 3 8B حوالي 200 مليار رمز، لكن الأداء استمر في التوسع بشكل لوغاريتمي خطي حتى مع مجموعة بيانات أكبر بـ 75 مرة، أي 15 تريليون رمز. [ 35 ]
خلال مقابلة مع دواركش باتيل، صرّح مارك زوكربيرج بأن نسخة 8B من لاما 3 كانت تقارب في قوتها نسخة لاما 2 الأكبر حجماً. وبالمقارنة مع النماذج السابقة، ذكر زوكربيرج أن الفريق فوجئ بأن نموذج 70B كان لا يزال يتعلم حتى بعد انتهاء تدريبه على 15 تريليون رمز. وقد اتُخذ قرار بإنهاء التدريب لتركيز قوة وحدة معالجة الرسومات (GPU) في مكان آخر. [ 36 ]
تم إصدار Llama 3.1 في 23 يوليو 2024، بثلاثة أحجام: 8 بايت، و70 بايت، و405 بايت. [ 37 ] [ 38 ]
اللاما 4

A representation of Meta AI and Llamaصدرت سلسلة Llama 4 في عام 2025. تم تغيير بنيتها إلى مزيج من الخبراء، حيث يتم تفعيل جزء فقط من الشبكات الفرعية للخبراء في النموذج لكل رمز إدخال. وهي متعددة الوسائط (إدخال نصي وصوري، وإخراج نصي) ومتعددة اللغات (12 لغة). [ 39 ] تحديدًا، في 5 أبريل 2025، تم إصدار النسختين الأساسية والمُحسّنة من حيث التعليمات: [ 40 ]
- Scout: نموذج ذو 17 مليار معلمة نشطة مع 16 خبيرًا، ونافذة سياقية تبلغ 10 ملايين، مع 109 مليار معلمة إجمالاً.
- مافريك: نموذج ذو 17 مليار معلمة نشطة مع 128 خبيرًا، ونافذة سياق تبلغ مليون معلمة، مع 400 مليار معلمة إجمالاً.
تم الإعلان عن نموذج Behemoth أيضًا، لكنه لم يُطرح في الأسواق. زعمت شركة Meta أنه نموذج يحتوي على 288 مليار مُعامل نشط، و16 خبيرًا، وحوالي 2 تريليون مُعامل إجمالًا؛ وكان لا يزال قيد التدريب عند إطلاق Scout وMaverick. تم استخلاص Maverick من Behemoth، بينما تم تدريب Scout من الصفر.
تضمنت بيانات التدريب بيانات متاحة للجمهور، وبيانات مرخصة، وبيانات خاصة بشركة ميتا، مثل المنشورات العامة على إنستغرام وفيسبوك، وتفاعلات المستخدمين مع ميتا إيه آي. وكان تاريخ انتهاء جمع البيانات هو أغسطس 2024. [ 39 ]
زعمت شركة ميتا في بيان إطلاقها أن نموذج لاما 4 تفوق على نموذج GPT-4o في معيار LMArena للذكاء الاصطناعي. [ 41 ] كما ذكرت الشركة أن نتيجة لاما 4 في هذا المعيار تحققت باستخدام "نسخة تجريبية للمحادثة" غير منشورة من النموذج، والتي كانت "مُحسّنة للمحادثة"، وهو ما يختلف عن نسخة لاما 4 المُتاحة للجمهور. [ 42 ] وأشارت LMArena إلى أنها ستُعدّل سياساتها لمنع تكرار هذا الأمر، وردّت قائلةً: "لم يتوافق تفسير ميتا لسياساتنا مع ما نتوقعه من مُزوّدي النماذج. كان ينبغي على ميتا أن تُوضّح بشكلٍ أدق أن 'Llama-4-Maverick-03-26-Experimental' هو نموذج مُخصّص لتحسينه بما يتوافق مع تفضيلات المستخدم." [ 41 ] انتقد بعض المستخدمين ميتا على وسائل التواصل الاجتماعي لاستخدامها نسخة نموذج منفصلة مُصمّمة خصيصًا للاختبار المعياري، كما اتهمها البعض الآخر بتدريب لاما 4 على مجموعات اختبار لزيادة نتائجها في هذا المعيار، وهو ما نفته ميتا. [ 43 ]
مقارنة النماذج
في عمود تكلفة التدريب، تُكتب تكلفة النموذج الأكبر فقط افتراضيًا. على سبيل المثال، "21,000" هي تكلفة تدريب نموذج Llama 2 69B بوحدة بيتا فلوبس-يوم. أيضًا، 1 بيتا فلوبس-يوم = 1 بيتا فلوبس/ثانية × 1 يوم = 8.64 × 10^19 فلوبس. يشير الحرف "T" إلى "تريليون" والحرف "B" إلى "مليار".
يسرد الجدول التالي الإصدارات الرئيسية لنموذج Llama، ويصف التغييرات الهامة المضمنة في كل إصدار: [ 44 ]
| اسم | تاريخ الافراج عنه | حالة | حدود | تكلفة التدريب (بيتافلوبس-يوم) | طول السياق (بالرموز) | حجم المجموعة (بالرموز) | الجدوى التجارية؟ |
|---|---|---|---|---|---|---|---|
| اللاما | 24 فبراير 2023 | تم إيقاف إنتاجه |
| 6300 [ 45 ] | 2048 | 1–1.4T | لا |
| لاما 2 | 18 يوليو 2023 | تم إيقاف إنتاجه |
| 21000 [ 46 ] | 4096 | 2T | نعم، رهناً بسياسة الاستخدام المقبول [ 2 ] |
| كود لاما | 24 أغسطس 2023 | تم إيقاف إنتاجه |
| ؟ | |||
| اللاما 3 | 18 أبريل 2024 | نشيط |
| 100,000 [ 47 ] [ 48 ] | 8192 | 15 طن | |
| لاما 3.1 | 23 يوليو 2024 | نشيط |
| 440,000 [ 38 ] [ 49 ] | 128,000 | ||
| لاما 3.2 | 25 سبتمبر 2024 | نشيط | ؟ | 128,000 [ 52 ] | 9T | ||
| لاما 3.3 | 7 ديسمبر 2024 | نشيط |
| ؟ | 128,000 | 15T+ | |
| اللاما 4 | 5 أبريل 2025 | نشيط |
|
|
|
|
الهندسة المعمارية والتدريب
إليكم رسالة التوصية التي كتبتها لطلب وظيفة مُطعم تنانين في شركة ماجيك يونيكورن: عزيزي مسؤول التوظيف، أعرف ___ منذ عامين، وأعتقد أنها ستكون مُطعمة تنانين ممتازة لشركة ماجيك يونيكورن. تتمتع ___ بقدرة فائقة على تذكر ومعالجة كميات كبيرة من المعلومات، وهي مهارة أساسية لمُطعم التنانين. وبصفتها فارسة مُحنكة، تتمتع ___ بفهم عميق لكيفية قتل التنانين وكيفية استغلال نقاط ضعف كل تنين ضده. وهذا يعني أنها تعرف أنواع الطعام التي يُفضلها كل تنين وأنواع الطعام التي تُشكل خطرًا عليه. ستكون هذه المعرفة والخبرة قيّمة للغاية أثناء إطعامها للتنانين. أنا على ثقة بأن كفاءة ___ ومهارتها وخبرتها ستجعلها موظفة ممتازة. يُرجى التواصل معي على الرقم (___) ___-___ إذا كانت لديكم أي استفسارات. أتطلع إلى تلقي ردكم. مع خالص التحيات، الفارس المحترم السير جورج
بنيان
مثل GPT-3، فإن سلسلة نماذج Llama هي محولات ذاتية الانحدار تعتمد فقط على فك التشفير ، ولكن هناك بعض الاختلافات الطفيفة:
- يستخدم Llama دالة التنشيط SwiGLU [ 53 ] بدلاً من GeLU الخاصة بـ GPT-3.
- يستخدم برنامج Llama تضمينات موضعية دورانية (RoPE) [ 54 ] بدلاً من التضمين الموضعي المطلق.
- بدلاً من تطبيع الطبقات ، [ 55 ] يستخدم برنامج Llama تقنية RMSNorm . [ 56 ]
| 8ب | 70ب | 405ب | |
|---|---|---|---|
| الطبقات | 32 | 80 | 126 |
| أبعاد النموذج | 4096 | 8192 | 16384 |
| أبعاد FFN | 14336 | 28,672 | 53,248 |
| انتباه أيها الرؤوس | 32 | 64 | 128 |
| رؤوس المفاتيح/القيم | 8 | 8 | 8 |
| معدل التعلم الأمثل | 3 × 10 −4 | 1.5 × 10 −4 | 0.8 × 10 −4 |
| وظيفة التنشيط | سويغلو | ||
| حجم المفردات | 128,000 | ||
| التضمينات الموضعية | |||
مجموعات بيانات التدريب
ركز مطورو Llama جهودهم على توسيع نطاق أداء النموذج من خلال زيادة حجم بيانات التدريب، بدلاً من عدد المعلمات، معتقدين أن التكلفة المهيمنة لنماذج التعلم المحدود (LLMs) تأتي من إجراء الاستدلال على النموذج المدرب بدلاً من التكلفة الحسابية لعملية التدريب.
تم تدريب النماذج الأساسية لـ Llama 1 على مجموعة بيانات تحتوي على 1.4 تريليون رمز، مستمدة من مصادر البيانات المتاحة للجمهور، بما في ذلك: [ 17 ]
- صفحات الويب التي تم استخراجها بواسطة CommonCrawl
- مستودعات مفتوحة المصدر لشفرة المصدر من GitHub
- ويكيبيديا بـ 20 لغة
- كتب من الملكية العامة من مشروع غوتنبرغ
- مجموعة بيانات الكتب Books3
- شفرة LaTeX المصدرية للأوراق العلمية المرفوعة إلى ArXiv
- أسئلة وأجوبة من مواقع Stack Exchange
في أبريل 2023، أطلقت شركة Together AI مشروعًا باسم RedPajama لإعادة إنتاج وتوزيع نسخة مفتوحة المصدر من مجموعة بيانات Llama، والتي تحتوي في البداية على ما يقرب من 1.2 تريليون رمز. [ 57 ]
تم تدريب النماذج الأساسية لـ Llama 2 على مجموعة بيانات تضم تريليوني رمز. خضعت هذه المجموعة لعملية انتقاء دقيقة لإزالة المواقع الإلكترونية التي غالبًا ما تكشف عن بيانات شخصية. كما تم تحسين دقة المصادر الموثوقة. [ 28 ] وتم ضبط Llama 2 - Chat بشكل إضافي على 27,540 زوجًا من الرسائل والاستجابات التي تم إنشاؤها خصيصًا لهذا المشروع، والتي حققت أداءً أفضل من مجموعات بيانات خارجية أكبر حجمًا ولكن بجودة أقل. ولتحسين توافق الذكاء الاصطناعي، تم استخدام التعلم المعزز مع التغذية الراجعة البشرية (RLHF) مع مزيج من 1,418,091 مثالًا من أمثلة Meta وسبع مجموعات بيانات أصغر. بلغ متوسط عمق الحوار 3.9 في أمثلة Meta، و3.0 لمجموعتي Anthropic Helpful وAnthropic Harmless، و1.0 لخمس مجموعات أخرى، بما في ذلك OpenAI Summarize وStackExchange وغيرها.
تتكون مجموعة بيانات Llama 3 بشكل رئيسي من بيانات باللغة الإنجليزية، مع أكثر من 5% منها بأكثر من 30 لغة أخرى. وقد تم ترشيح مجموعة البيانات الخاصة بها بواسطة مصنف جودة النص، وتم تدريب المصنف باستخدام نص تم تركيبه بواسطة Llama 2. [ 35 ]
في دعوى قضائية رفعها مؤلفون من بينهم ريتشارد كادري وسارة سيلفرمان وتا -نيهيسي كوتس ضد شركة ميتا بلاتفورمز ، زُعم أن الرئيس التنفيذي مارك زوكربيرج قد سمح باستخدام محتوى محمي بحقوق الطبع والنشر من مكتبة جينيسيس لتدريب نماذج الذكاء الاصطناعي لاما وإخفاء أفعاله عن طريق إزالة علامات حقوق الطبع والنشر من البيانات. [ 58 ]
الكون المثالى
تتوفر نماذج Llama 1 فقط كنماذج أساسية تعتمد على التعلم الذاتي دون الحاجة إلى ضبط دقيق. أما نماذج Llama 2 - Chat، فقد تم اشتقاقها من نماذج Llama 2 الأساسية. وعلى عكس GPT-4 الذي زاد طول السياق أثناء الضبط الدقيق، فإن Llama 2 و Code Llama - Chat لهما نفس طول السياق وهو 4000 رمز. استخدم الضبط الدقيق الخاضع للإشراف دالة خسارة ذاتية الانحدار، مع تصفير خسارة الرموز عند مطالبات المستخدم. وكان حجم الدفعة 64.
لتحقيق التوافق بين الذكاء الاصطناعي والتعلم المعزز ، قام مُعلِّقون بشريون بكتابة تعليمات ثم قارنوا مخرجات نموذجين (بروتوكول ثنائي)، مُحدِّدين مستويات ثقة وتصنيفات أمان منفصلة مع حق النقض. تم تدريب نموذجين منفصلين للمكافأة بناءً على هذه التفضيلات للأمان والفائدة باستخدام التعلم المعزز من التغذية الراجعة البشرية (RLHF). يتمثل أحد أهم المساهمات التقنية في التخلي عن الاستخدام الحصري لخوارزمية تحسين السياسة التقريبية (PPO) في التعلم المعزز من التغذية الراجعة البشرية (RLHF)، حيث تم استخدام تقنية جديدة تعتمد على أخذ عينات الرفض ، متبوعة بخوارزمية تحسين السياسة التقريبية (PPO ) .
تم التركيز على تحسين اتساق الحوارات متعددة الأدوار، لضمان احترام "رسائل النظام" (التعليمات الأولية، مثل "تحدث بالفرنسية" و"تصرف مثل نابليون") أثناء الحوار. وقد تحقق ذلك باستخدام تقنية "الانتباه الوهمي" الجديدة أثناء التدريب، والتي تُلحق التعليمات ذات الصلة بكل رسالة مستخدم جديدة، ولكنها تُصفّر دالة الخسارة للرموز في الموجه (الأجزاء الأولى من الحوار).
التطبيقات
أصدر مركز أبحاث النماذج الأساسية (CRFM) التابع لمعهد الذكاء الاصطناعي المتمحور حول الإنسان (HAI) بجامعة ستانفورد، برنامج Alpaca، وهو برنامج تدريبي مبني على نموذج Llama 7B، يستخدم أسلوب "التعليم الذاتي" لضبط التعليمات، بهدف اكتساب قدرات تُضاهي قدرات نموذج OpenAI GPT-3 series text-davinci-003 بتكلفة معقولة. [ 59 ] [ 60 ] [ 61 ] وقد أُزيلت ملفات النموذج رسميًا في 21 مارس 2023، نظرًا لتكاليف الاستضافة ومخاوف أمنية، مع بقاء الشفرة والورقة البحثية متاحتين على الإنترنت للاطلاع. [ 62 ] [ 63 ] [ 64 ]
ميدترون عبارة عن مجموعة من أنظمة Llama المُحسّنة والمبنية على مجموعة من الإرشادات السريرية، والأبحاث المنشورة في PubMed ، والمقالات. وقد طُوّرت من قِبل باحثين في كلية علوم الحاسوب والاتصالات في المدرسة الفيدرالية للفنون التطبيقية في لوزان ، وكلية الطب بجامعة ييل . وقد أظهرت أداءً مُحسّنًا في المعايير الطبية المرجعية مثل MedQA وMedMCQA. [ 65 ] [ 66 ] [ 67 ]
استخدمت زووم برنامج ميتا لاما 2 لإنشاء مساعد ذكاء اصطناعي قادر على تلخيص الاجتماعات، وتقديم نصائح مفيدة للعروض التقديمية، والمساعدة في الرد على الرسائل. ويعتمد هذا المساعد على نماذج متعددة، من بينها ميتا لاما 2. [ 68 ]
ذكرت رويترز في عام 2024 أن العديد من نماذج المؤسسات الصينية اعتمدت على نماذج اللاما في تدريبها. [ 69 ]
تستخدم العديد من التطبيقات واجهة برمجة التطبيقات العامة الخاصة بـ Llama لدمج الميزات في تطبيقاتها للاستخدام اليومي. [ 70 ]
llama.cpp
أصدر مطور البرمجيات جورجي جيرجانوف برنامج llama.cpp كمصدر مفتوح في 10 مارس 2023. وهو عبارة عن إعادة برمجة لبرنامج Llama بلغة C++ ، مما يسمح للأنظمة التي لا تمتلك وحدة معالجة رسومية قوية بتشغيل النموذج محليًا. [ 71 ] قدم مشروع llama.cpp تنسيق ملف GGUF، وهو تنسيق ثنائي يخزن كلاً من الموترات والبيانات الوصفية. [ 72 ] يركز هذا التنسيق على دعم أنواع مختلفة من التكميم، مما يقلل من استخدام الذاكرة ويزيد السرعة على حساب دقة النموذج. [ 73 ]
llamafile، الذي ابتكرته جوستين توني، هو أداة مفتوحة المصدر تجمع ملف llama.cpp مع النموذج في ملف تنفيذي واحد. وقد قدمت توني وزملاؤها نوى جديدة مُحسَّنة لضرب المصفوفات لوحدات المعالجة المركزية x86 وARM، مما يحسن أداء التقييم الفوري لأنواع البيانات الكمية FP16 و8 بت. [ 74 ]
فضاء
نشرت شركة بوز ألين هاملتون نموذج لاما 3.2 من شركة ميتا على متن المختبرات الوطنية لمحطة الفضاء الدولية (ISS) كجزء من مشروع يُسمى "سبيس لاما". يعمل النظام على حاسوب الفضاء المحمول 2 من شركة هيوليت باكارد إنتربرايز ، ويستفيد من منصة A2E2 (الذكاء الاصطناعي للبيئات الطرفية) من بوز ألين، باستخدام الحوسبة المُسرّعة بتقنية NVIDIA CUDA. يُظهر "سبيس لاما" كيف يمكن لنماذج اللغة الكبيرة أن تعمل في بيئات غير متصلة ومحدودة مثل الفضاء، مما يُمكّن رواد الفضاء من استرجاع وتلخيص المستندات باستخدام استعلامات اللغة الطبيعية، حتى بدون اتصال بالإنترنت. [ 75 ] [ 76 ]
جيش
في عام 2024، أفادت التقارير أن باحثين من أكاديمية العلوم العسكرية التابعة لجيش التحرير الشعبي (أعلى أكاديمية عسكرية في الصين ) قد طوروا أداة عسكرية باستخدام برنامج لاما، وهو ما اعتبرته شركة ميتا بلاتفورمز غير مصرح به نظرًا لأن ترخيص لاما يحظر استخدام النموذج لأغراض عسكرية. [ 77 ] [ 78 ] منحت ميتا الحكومة الأمريكية والمتعاقدين العسكريين الأمريكيين إذنًا باستخدام لاما في نوفمبر 2024، لكنها استمرت في حظر استخدامها عسكريًا من قبل جهات غير أمريكية. [ 30 ] [ 79 ]
الترخيص
تم إصدار النسخة الأولى من برنامج لاما بموجب ترخيص غير تجاري لبعض الباحثين والجهات على أساس كل حالة على حدة. [ 6 ] [ 18 ]
منذ إصدار لاما 2، قدمت شركة ميتا برنامج لاما على أنه مفتوح المصدر ، وهو وصف عارضته مبادرة المصادر المفتوحة (OSI) وبعض الأكاديميين والصحفيين. وذكرت مبادرة المصادر المفتوحة أن تراخيص لاما لا تفي بالعديد من بنود وثيقة سياستها " تعريف المصادر المفتوحة" (OSD)، التي تحظر على تراخيص برامج المصادر المفتوحة التمييز ضد "الأفراد أو الجماعات" و"مجالات العمل"، واتهمت ميتا بتبييض صورة لاما. ووفقًا لمبادرة المصادر المفتوحة، منع ترخيص لاما 2 استخدام البرنامج تجاريًا في بعض الحالات، وقيد استخدامه في مجالات تشمل المواد الخاضعة للرقابة والبنية التحتية الحيوية ، بينما منعت الإصدارات اللاحقة من ترخيص لاما أيضًا استخدامه من قبل أي فرد في الاتحاد الأوروبي . [ 80 ] [ 81 ] [ 82 ] ونشرت مبادرة المصادر المفتوحة " تعريف الذكاء الاصطناعي مفتوح المصدر" (OSAID) في أكتوبر 2024، والذي يشترط نشر الذكاء الاصطناعي مفتوح المصدر مع تفاصيل حول بيانات التدريب الخاصة به، وهو ما لا تكشف عنه ميتا بالنسبة لبرنامج لاما. [ 83 ] ردّ متحدث باسم شركة ميتا لموقع ذا فيرج بأن الشركة لا تتفق مع هذا التعريف. [ 84 ] صنّفت مؤسسة البرمجيات الحرة ترخيص لاما 3.1 كترخيص برمجيات غير حرة في يناير 2025، منتقدةً سياسة الاستخدام المقبول ، والقيود المفروضة على المستخدمين الذين لديهم تطبيقات شائعة، وإنفاذ لوائح تجارية خارج نطاق اختصاص المستخدم. [ 85 ] [ 86 ]
في تغطيتها لـ Llama 2، رددت Ars Technica في البداية استخدام Meta لمصطلح " مفتوح المصدر" ، لكنها عدّلت تقريرها لاحقًا لتصف Llama بأنها " متاحة المصدر "، و"مرخصة ترخيصًا مفتوحًا"، و"الأوزان متاحة" بعد أن أدركت أن ترخيص Llama 2 يمنع الكيانات التي يزيد عدد مستخدميها النشطين يوميًا عن 700 مليون مستخدم من استخدام نموذج التعلم الموجه باللغات (LLM)، كما يمنع استخدام مخرجات LLM لتحسين نماذج LLM أخرى. [ 29 ] في يوليو 2023، منح باحثون من جامعة رادبود Llama 2 ثاني أدنى تصنيف في "الانفتاح" في مقارنة بين 20 نموذج LLM، بينما حصل ChatGPT على أدنى تصنيف. انتقد أحد الباحثين، مارك دينجيمانس ، استخدام Meta لمصطلح " مفتوح المصدر " لـ Llama 2 ووصفه بأنه "مضلل تمامًا"، لأنه "لا يوجد مصدر متاح، وبيانات التدريب غير موثقة تمامًا، وباستثناء الرسوم البيانية البراقة، فإن التوثيق التقني ضعيف للغاية". [ 87 ] في نوفمبر 2024، صرّح CIO بأن Llama ليس مفتوح المصدر بسبب سياسة الاستخدام المقبول الخاصة به، وهي وثيقة من 630 كلمة "تتعارض مع حركة المصادر المفتوحة الأوسع نطاقًا ". [ 30 ] وفي وقت لاحق من ذلك الشهر، أكدت مقالة في مجلة Nature أن وصف Llama 3 بأنه "مفتوح" هو حالة من "التسويق الزائف" لأنظمة يُفهم أنها مغلقة بشكل أفضل، حيث أن Llama 3 لا يوفر "أكثر من واجهة برمجة تطبيقات أو إمكانية تنزيل نموذج يخضع لقيود استخدام غير مفتوحة بشكل واضح". [ 88 ]
استقبال
تصف مجلة Wired إصدار Llama 3 ذو 8B معلمات بأنه "ذو قدرات مذهلة" بالنظر إلى حجمه. [ 89 ]
كانت ردود الفعل على دمج ميتا لـ Llama في فيسبوك متباينة، حيث شعر بعض المستخدمين بالحيرة بعد أن أخبرت ميتا إيه آي مجموعة من الآباء والأمهات بأن لديها طفلاً. [ 90 ]
أثار إطلاق نماذج لاما نقاشاتٍ واسعة حول فوائد ومخاطر إساءة استخدام النماذج ذات الوزن المفتوح. إذ يمكن تعديل هذه النماذج بدقة لإزالة الضمانات، لا سيما من قِبل مجرمي الإنترنت، حتى تُلبّي طلباتهم الضارة. ويرى بعض الخبراء أن النماذج المستقبلية قد تُسهّل إلحاق الضرر أكثر من الدفاع عنه، على سبيل المثال من خلال تسهيل هندسة أسلحة بيولوجية متطورة دون معرفة متخصصة. في المقابل، يمكن أن تكون النماذج ذات الوزن المفتوح مفيدة لأغراضٍ متنوعة، بما في ذلك أبحاث السلامة. [ 91 ]
انتقد ستيفانو مافولي، رئيس مبادرة المصادر المفتوحة ، شركة ميتا لوصفها لاما بأنها مفتوحة المصدر ، قائلاً إن ذلك يسبب ارتباكاً بين المستخدمين و"يشوه" المصطلح. [ 92 ]
انظر أيضاً
ملحوظات
- ↑ كان يُكتب سابقًا LLaMA أو LLaMa
مراجع
- ↑ "اتفاقية ترخيص مجتمع لاما 4" . 5 أبريل 2025. تم الاطلاع عليها في 15 يوليو 2025 – عبر جيت هاب .
"مواد لاما" تعني، بشكل جماعي، برنامج لاما 4 الخاص بشركة ميتا والوثائق (وأي جزء منها) المتاحة بموجب هذه الاتفاقية.
- 1 2 "سياسة الاستخدام المقبول لـ Llama 4" . ميتا لاما . تم الاطلاع عليه بتاريخ 15 يوليو 2025 .
- ↑ ليسوينغ، كيف (24 فبراير 2023). "مارك زوكربيرغ يعلن عن نموذج اللغة الضخم الجديد لشركة ميتا مع اشتداد المنافسة في مجال الذكاء الاصطناعي" . سي إن بي سي . تم الاطلاع عليه بتاريخ 10 أبريل 2025 .
- 1 2 بيترز، جاي؛ فينسنت، جيمس (24 فبراير 2023). "لدى ميتا نموذج لغوي جديد للتعلم الآلي ليذكرك بأنها تعمل في مجال الذكاء الاصطناعي أيضًا" . ذا فيرج .
- 1 2 "ميتا ومايكروسوفت تُعلنان عن الجيل التالي من LLaMA" . ميتا . 18 يوليو 2023. مؤرشف من الأصل في 14 سبتمبر 2023. تم الاطلاع عليه في 21 يوليو 2023 .
- 1 2 مالك، يوفراج؛ بول، كاتي (25 فبراير 2023). "ميتا تُشعل سباق التسلح بالذكاء الاصطناعي بين شركات التكنولوجيا الكبرى بنموذج لغوي جديد" . رويترز . تم الاطلاع عليه في 6 أغسطس 2025 .
- ↑ هيرن، أليكس (2023-03-07). "مشهد تقني: هل سيؤدي تسريب ميتا الضخم إلى إضفاء الطابع الديمقراطي على الذكاء الاصطناعي - وما الثمن؟" . صحيفة الغارديان . ISSN 0261-3077 . تاريخ الاسترجاع: 2025-04-10 .
- ↑ ديفيد، إميليا (30 أكتوبر 2023). "رئيسة أبحاث الذكاء الاصطناعي في ميتا تطالب بتغيير ترخيص المصادر المفتوحة" . ذا فيرج . مؤرشف من الأصل في 14 سبتمبر 2024. تم الاطلاع عليه في 20 أكتوبر 2024 .
- ↑ هيث، أليكس (18 أبريل 2024). "معركة ميتا مع تشات جي بي تي تبدأ الآن" . ذا فيرج . تم الاسترجاع في 10 أبريل 2025 .
- ↑ فرانزن، كارل (2025-04-08). "ميتا تدافع عن إصدار لاما 4 ضد "تقارير الجودة المتباينة"، وتُلقي باللوم على الأخطاء البرمجية" . فينشر بيت . تم الاطلاع عليه بتاريخ 2025-04-10 .
- ↑ "شركة ميتا تُطلق نموذج ذكاء اصطناعي جديد في أول اختبار لفريق "الذكاء الخارق" المكلف" . صحيفة الغارديان . 9 أبريل 2026. الرقم الدولي الموحد للدوريات 0261-3077 . تاريخ الاطلاع: 11 أبريل 2026 .
- ↑ "دراسة القدرات الناشئة في نماذج اللغة الكبيرة" . hai.stanford.edu . 13 سبتمبر 2022.
- ↑ "القصة الداخلية لكيفية بناء ChatGPT من وجهة نظر الأشخاص الذين قاموا بتطويره" . مجلة MIT Technology Review . مؤرشف من الأصل بتاريخ 3 مارس 2023. تم الاطلاع عليه بتاريخ 20 أكتوبر 2024 .
- ↑ راي، تيرنان (23 يناير 2023). "يقول كبير علماء الذكاء الاصطناعي في ميتا: ChatGPT ليس مبتكرًا بشكل خاص، ولا يقدم أي شيء ثوري" . ZDNET . مؤرشف من الأصل في 17 فبراير 2023.
- ↑ بادمنتون، نيك (13 فبراير 2023). "يان ليكان من ميتا يتحدث عن نماذج اللغة الكبيرة ذاتية التراجع (LLMs)" . Futurist.com . مؤرشف من الأصل في 22 يوليو 2024. تم الاطلاع عليه في 20 أكتوبر 2024 .
- ↑ «يان ليكان على لينكدإن: رأيي الثابت حول برامج الماجستير في القانون الحالية (التي تتراجع ذاتيًا)» . لينكدإن . مؤرشف من الأصل بتاريخ 17 سبتمبر 2024. تم الاطلاع عليه بتاريخ 20 أكتوبر 2024 .
- 1 2 3 4 توفرون، هوغو؛ لافريل، تيبوت؛ إيزاكارد، غوتييه؛ مارتينيت، كزافييه. لاشو، ماري آن؛ لاكروا، تيموثي؛ روزيير، بابتيست؛ جويال، نعمان؛ هامبرو، اريك. أزهر، فيصل؛ رودريجيز، أوريليان. جولين، أرماند. قبر إدوارد. لامبل، غيوم (2023). “LLaMA: نماذج لغة أساسية مفتوحة وفعالة”. أرخايف : 2302.13971 [ cs.CL ].
- ١ ٢ ٣ "تقديم LLaMA: نموذج لغوي أساسي ضخم ذو ٦٥ مليار مُعامل" . Meta AI . ٢٤ فبراير ٢٠٢٣. مؤرشف من الأصل في ٣ مارس ٢٠٢٣. تم الاطلاع عليه في ١٦ مارس ٢٠٢٣ .
- ↑ "لاما" . جيت هاب . مؤرشف من الأصل في 15 مارس 2023. تم الاسترجاع في 16 مارس 2023 .
- ↑ باستيان، ماتياس (25 فبراير 2023). "نموذج لغة Metas "LLaMA" يُظهر أن المعلمات ليست كل شيء" . The Decoder . تم الاسترجاع في 21 يونيو 2025 .
- 1 2 3 فينسنت، جيمس (8 مارس 2023). "تسريب نموذج لغة الذكاء الاصطناعي القوي لشركة ميتا على الإنترنت - ماذا سيحدث الآن؟" . ذا فيرج . مؤرشف من الأصل في 3 نوفمبر 2023. تم الاسترجاع في 16 مارس 2023 .
- 1 2 VK، أنيرود (6 مارس 2023). "تسريب بيانات LLaMA الخاصة بشركة Meta للجمهور، بفضل موقع 4chan" . مجلة Analytics India . مؤرشف من الأصل في 26 مارس 2023. تم الاطلاع عليه في 17 مارس 2023 .
- ↑ "توفير عرض النطاق الترددي باستخدام التورنت للتوزيع بكفاءة أكبر، بقلم كريستوفر كينج 42 · طلب سحب رقم 73 · facebookresearch/llama" . جيت هاب . مؤرشف من الأصل في 10 أبريل 2023. تم الاطلاع عليه في 25 مارس 2023 .
- ↑ "تنزيل الأوزان من Hugging Face لمساعدتنا في توفير النطاق الترددي بواسطة Jainam213 · طلب سحب رقم 109 · facebookresearch/llama" . GitHub . مؤرشف من الأصل في 21 مارس 2023. تم الاسترجاع في 17 مارس 2023 .
- ↑ كوكس، جوزيف (7 مارس 2023). "تسريب نموذج اللغة الضخم والقوي لفيسبوك على الإنترنت" . فايس . مؤرشف من الأصل في 6 أبريل 2023. تم الاطلاع عليه في 17 مارس 2023 .
- ↑ شركة OpSec Online LLC (21 مارس 2023). "github/dmca - إشعار بانتهاك مزعوم عبر البريد الإلكتروني" . GitHub. مؤرشف من الأصل في 10 أبريل 2023. تم الاطلاع عليه في 25 مارس 2023 .
- ↑ ويليسون، سيمون (11 مارس 2023). "نماذج اللغة الكبيرة تمر بمرحلة الانتشار المستقر" . مدونة سيمون ويليسون . مؤرشف من الأصل في 16 مارس 2023. تم الاطلاع عليه في 16 مارس 2023 .
- 1 2 توفرون، هوغو؛ مارتن، لويس؛ وآخرون . (18 يوليو 2023). "LLaMA-2: مؤسسة مفتوحة ونماذج دردشة مضبوطة بدقة". arXiv : 2307.09288 [ cs.CL ].
- 1 2 إدواردز، بنج (18 يوليو 2023). "ميتا تطلق LLaMA-2، وهو نموذج ذكاء اصطناعي متاح المصدر يسمح بالتطبيقات التجارية" . آرس تكنيكا . مؤرشف من الأصل في 7 نوفمبر 2023. تم الاسترجاع في 8 أغسطس 2023 .
- 1 2 3 توماس، براسانث آبي (5 نوفمبر 2024). "ميتا تعرض نظام لاما للذكاء الاصطناعي على الحكومة الأمريكية لأغراض الأمن القومي" . CIO . تم الاطلاع عليه في 9 ديسمبر 2024 .
- ↑ "تقديم Code Llama، نموذج لغوي ضخم ومتطور للبرمجة" . ai.meta.com . مؤرشف من الأصل بتاريخ 27-09-2024 . تم الاطلاع عليه بتاريخ 20-10-2024 .
- ↑ روزيير، باتيست؛ جيرينغ، جوناس؛ غلوكلي، فابيان؛ سوتلا، ستين؛ غات، إيتاي؛ تان، شياو تشينغ إيلين؛ آدي، يوسي؛ ليو، جينغيو؛ سوفيستر، رومان (31 يناير 2024). "كود لاما: نماذج المؤسسة المفتوحة للبرمجة". arXiv : 2308.12950 [ cs.CL ].
- ↑ ويغرز، كايل (18 أبريل 2024). "ميتا تُصدر لاما 3، وتدّعي أنها من بين أفضل النماذج مفتوحة المصدر المتاحة" . تيك كرانش . مؤرشف من الأصل في 18 سبتمبر 2024. تم الاطلاع عليه في 20 أكتوبر 2024 .
- ↑ مان، توبياس (19 أبريل 2024). "ميتا تُطلق الجيل الثالث من نموذج لاما للغة الكبيرة" . ذا ريجستر . مؤرشف من الأصل في 25 أغسطس 2024. تم الاطلاع عليه في 20 أكتوبر 2024 .
- ١ ٢ "تقديم ميتا لاما ٣: أقوى برنامج ذكاء اصطناعي متاح للجميع حتى الآن" . ai.meta.com . ١٨ أبريل ٢٠٢٤. مؤرشف من الأصل في ١٥ مايو ٢٠٢٤. تم الاطلاع عليه في ٢١ أبريل ٢٠٢٤ .
- ↑ باتيل، دواركيش (24-07-2024). "مارك زوكربيرج - لاما 3، نماذج مفتوحة المصدر بقيمة 10 مليارات دولار، وقيصر أغسطس" . www.dwarkeshpatel.com . مؤرشف من الأصل في 16-07-2024 . تم الاسترجاع في 01-08-2024 .
إن قوة 8 مليارات دولار تكاد تضاهي قوة أكبر إصدار من لاما 2 الذي أصدرناه [...] حتى في النهاية، كان لا يزال يتعلم، أليس كذلك؟ ربما كان بإمكاننا تزويده بالمزيد من الرموز وكان سيتحسن نوعًا ما، لكنني أعني أنه في مرحلة ما، عندما تدير شركة، فأنت بحاجة إلى طرح أسئلة التفكير الميتافيزيقي هذه [...] كيف أريد إنفاق وحدات معالجة الرسومات الخاصة بنا؟
- ↑ "برنامج لاما 3.1 من ميتا مفتوح المصدر، نوعًا ما. إليكم كيف يمكن أن يُعيد تشكيل سباق الذكاء الاصطناعي" . فاست كومباني . 23 يوليو 2024.
- 1 2 دوبي، أبهيمانيو؛ جوهري، ابهيناف؛ باندي، ابهيناف؛ كاديان، ابهيشيك؛ الدحل، أحمد؛ ليتمان، عائشة؛ ماثور، أخيل؛ شيلتن ، آلان. يانغ، إيمي (31/07/2024)، قطيع النماذج من اللاما 3 ، أرخايف : 2407.21783
- 1 2 3 "meta-llama/Llama-4-Maverick-17B-128E · Hugging Face" . huggingface.co . 2025-04-05 . تم الاطلاع عليه بتاريخ 2025-04-06 .
- ↑ "قطيع لاما 4: بداية حقبة جديدة من ابتكار الذكاء الاصطناعي متعدد الوسائط بطبيعته" . ai.meta.com . مؤرشف من الأصل بتاريخ 2025-04-05 . تم الاطلاع عليه بتاريخ 2025-04-05 .
- روبيسون ، كايلي (8 أبريل 2025). " ميتا تُضبط متلبسة بالتلاعب بمعايير الذكاء الاصطناعي" . ذا فيرج . تم الاطلاع عليه بتاريخ 8 أبريل 2025 .
- ↑ ويغرز، كايل (6 أبريل 2025). "معايير ميتا لنماذج الذكاء الاصطناعي الجديدة الخاصة بها مضللة بعض الشيء" . تيك كرانش . تم الاطلاع عليه في 8 أبريل 2025 .
- ↑ فرانزن، كارل (8 أبريل 2025). "ميتا تدافع عن إصدار لاما 4 ضد "تقارير الجودة المتباينة"، وتُلقي باللوم على الأخطاء البرمجية" . فينشر بيت . تم الاطلاع عليه بتاريخ 8 أبريل 2025 .
- ↑ "عارضات أزياء اللاما" . www.llama.com . مؤرشف من الأصل في 9 أبريل 2025. تم الاطلاع عليه في 20 أبريل 2025 .
- ↑ «هبط الصقر في منظومة Hugging Face» . huggingface.co . مؤرشف من الأصل بتاريخ 20 يونيو 2023. تم الاطلاع عليه بتاريخ 20 يونيو 2023 .
- ↑ "llama/MODEL_CARD.md at main · meta-llama/llama" . GitHub . مؤرشف من الأصل بتاريخ 28-05-2024 . تم الاطلاع عليه بتاريخ 28-05-2024 .
- ↑ «أندريه كارباثي (18 أبريل 2024)، تحتوي بطاقة النموذج على بعض المعلومات الأخرى المثيرة للاهتمام أيضًا » . X (تويتر سابقًا) . مؤرشف من الأصل في 17 أغسطس 2024. تم الاسترجاع في 20 أكتوبر 2024 .
- ↑ "llama3/MODEL_CARD.md في main · meta-llama/llama3" . GitHub . مؤرشف من الأصل بتاريخ 21-05-2024 . تم الاطلاع عليه بتاريخ 28-05-2024 .
- ↑ "llama-models/models/llama3_1/MODEL_CARD.md at main · meta-llama/llama-models" . GitHub . مؤرشف من الأصل بتاريخ 23-07-2024 . تم الاطلاع عليه بتاريخ 23-07-2024 .
- ↑ روبيسون، كايلي (25 سبتمبر 2024). "ميتا تُطلق أول نموذج ذكاء اصطناعي مفتوح المصدر قادر على معالجة الصور" . ذا فيرج . تاريخ الاسترجاع: 25 سبتمبر 2024 .
- ↑ ويغرز، كايل (25 سبتمبر 2024). "نماذج الذكاء الاصطناعي لاما من ميتا تصبح متعددة الوسائط" . تك كرانش . مؤرشف من الأصل في 25 سبتمبر 2024. تم الاسترجاع في 25 سبتمبر 2024 .
- ↑ "لاما 3.2: إحداث ثورة في الذكاء الاصطناعي الطرفي والرؤية من خلال نماذج مفتوحة وقابلة للتخصيص" . ai.meta.com . مؤرشف من الأصل بتاريخ 25-09-2024 . تم الاطلاع عليه بتاريخ 26-09-2024 .
- ↑ شازير، نوعام (2020-02-01). "متغيرات GLU تُحسّن Transformer". arXiv : 2002.05202 [ cs.CL ].
- ^ سو، جيان لين؛ لو، يو؛ عموم، شينغفنغ. مرتضى، أحمد؛ ون، بو؛ ليو ، يونفينج (2021-04-01). “RoFormer: محول محسّن مع تضمين موضع دوار”. أرخايف : 2104.09864 [ cs.CL ].
- ↑ لي با، جيمي؛ كيروس، جيمي رايان؛ هينتون، جيفري إي. (2016-07-01). "تطبيع الطبقات". arXiv : 1607.06450 [ stat.ML ].
- ↑ تشانغ، بياو؛ سينريش، ريكو (2019-10-01). "تطبيع طبقة الجذر التربيعي المتوسط". arXiv : 1910.07467 [ cs.LG ].
- ↑ غولدمان، شارون (18 أبريل 2023). "RedPajama تُعيد إنتاج مجموعة بيانات LLaMA لبناء نماذج خطية لغوية مفتوحة المصدر ومتطورة" . VentureBeat . تاريخ الاسترجاع: 21 يونيو 2025 .
- ↑ ويغرز، كايل (9 يناير 2025). "مارك زوكربيرج يمنح فريق لاما التابع لشركة ميتا الموافقة على التدريب على أعمال محمية بحقوق الطبع والنشر، وتقديم مطالبات" . تيك كرانش . تم الاطلاع عليه في 12 يناير 2025 .
- ↑ تاوري، روهان؛ جولراجاني، إيشان؛ تشانغ، تياني؛ دوبوا، يان؛ لي، شوتشن؛ غيسترين، كارلوس؛ ليانغ، بيرسي ؛ هاشيموتو، تاتسونوري ب. (13 مارس 2023). "الألبكة: نموذج قوي وقابل للتكرار لاتباع التعليمات" . مركز ستانفورد لأبحاث النماذج الأساسية. مؤرشف من الأصل في 6 أبريل 2023.
- ↑ وانغ، ييتشونغ؛ كوردي، يغانه؛ ميشرا، سواروب؛ ليو، أليسا؛ سميث، نوح أ.؛ خاشابي، دانيال؛ حاجيشيرزي، حنانه (2022). "التعليم الذاتي: مواءمة نماذج اللغة مع التعليمات المولدة ذاتيًا". arXiv : 2212.10560 [ cs.CL ].
- ↑ "ستانفورد CRFM" . crfm.stanford.edu . مؤرشف من الأصل بتاريخ 2023-04-06 . تم الاطلاع عليه بتاريخ 2023-03-20 .
- ↑ كواتش، كاتيانا. "جامعة ستانفورد تُوقف نموذج الذكاء الاصطناعي المكلف والمحفوف بالمخاطر الخاص بالألبكة" . www.theregister.com .
- ↑ «باحثو جامعة ستانفورد يُسقطون برنامج الذكاء الاصطناعي "ألبكا" بسبب تكلفته العالية وهلوساته» . جيزمودو . ٢١ مارس ٢٠٢٣. مؤرشف من الأصل في ١٢ مايو ٢٠٢٤. تم الاطلاع عليه في ٢٠ أكتوبر ٢٠٢٤ .
- ↑ "alpaca-lora" . GitHub . مؤرشف من الأصل في 4 أبريل 2023. تم الاطلاع عليه في 5 أبريل 2023 .
- ↑ "ميدترون: مجموعة برامج إدارة التعلم الآلي للإعدادات الطبية ذات الموارد المحدودة باستخدام ميتا لاما" . ai.meta.com .
- ↑ بيترسن، تانيا (28 نوفمبر 2023). "نموذج اللغة الكبير الجديد للمعرفة الطبية في المعهد الفدرالي السويسري للتكنولوجيا في لوزان" . مؤرشف من الأصل في 17 سبتمبر 2024. تم الاطلاع عليه في 20 أكتوبر 2024 .
- ↑ "epfLLM/meditron" . epfLLM. ١١ مايو ٢٠٢٤. مؤرشف من الأصل في ٢٧ سبتمبر ٢٠٢٤. تم الاطلاع عليه في ٢٠ أكتوبر ٢٠٢٤ .
- ↑ "كيف تستخدم الشركات ميتا لاما" . ميتا . 7 مايو 2024. مؤرشف من الأصل في 27 سبتمبر 2024. تم الاطلاع عليه في 20 أكتوبر 2024 .
- ↑ "ما مدى اعتماد الصين على تكنولوجيا الذكاء الاصطناعي الأمريكية؟" . رويترز . 9 مايو 2024.
- ↑ مطورو ميتا (19 مايو 2025). تقديم واجهة برمجة تطبيقات لاما: طريقة سلسة لإحداث ثورة في سير عملك . تم الاطلاع عليه بتاريخ 24 يوليو 2026 – عبر يوتيوب.
- ↑ إدواردز، بنج (13 مارس 2023). "يمكنك الآن تشغيل نموذج ذكاء اصطناعي بمستوى GPT-3 على حاسوبك المحمول وهاتفك وراسبيري باي" . آرس تكنيكا . مؤرشف من الأصل في 9 يناير 2024. تم الاطلاع عليه في 4 يناير 2024 .
- ↑ "GGUF" . huggingface.co . تم الاطلاع عليه بتاريخ 9 مايو 2024 .
- ↑ لابون، ماكسيم (29 نوفمبر 2023). "تكميم نماذج اللاما باستخدام GGUF و llama.cpp" . ميديوم . نحو علم البيانات. مؤرشف من الأصل في 9 مايو 2024. تم الاسترجاع في 9 مايو 2024 .
- ↑ كوناتسر، ماثيو. "مشروع برنامج تشغيل Llamafile LLM يعزز الأداء على أنوية وحدة المعالجة المركزية" . www.theregister.com . مؤرشف من الأصل في 10 مايو 2024. تم الاطلاع عليه في 10 مايو 2024 .
- ↑ "نماذج اللغة الكبيرة في الفضاء وما وراءه" . بوز ألين هاملتون . ١٨ أبريل ٢٠٢٥. مؤرشف من الأصل في ١٩ أبريل ٢٠٢٥. تم الاطلاع عليه في ٧ أغسطس ٢٠٢٥ .
- ↑ فيلد، هايدن (25 أبريل 2025). "ميتا وبوز ألين تتعاونان في برنامج الذكاء الاصطناعي 'سبيس لاما' مع إنفيديا وإتش بي إي" . سي إن بي سي . تم الاطلاع عليه بتاريخ 10 أغسطس 2025 .
- ↑ تشيونغ، ساني (31 أكتوبر 2024). "جمهورية الصين الشعبية تُكيّف برنامج لاما من ميتا لتطبيقات الذكاء الاصطناعي العسكرية والأمنية" . مؤسسة جيمستاون . تاريخ الاسترجاع: 3 نوفمبر 2024 .
- ↑ بومفريت، جيمس؛ بانغ، جيسي (1 نوفمبر 2024). "باحثون صينيون يطورون نموذج ذكاء اصطناعي للاستخدام العسكري بالاعتماد على برنامج ميتا لاما" . رويترز . تم الاطلاع عليه في 1 نوفمبر 2024 .
- ↑ سميث، ماثيو س. (17 نوفمبر 2024). "شركة ميتا تفتح نموذجها للذكاء الاصطناعي للجيش الأمريكي" . مجلة IEEE Spectrum . تم الاطلاع عليه في 9 ديسمبر 2024 .
- ↑ مافولي، ستيفانو (20 يوليو 2023). "رخصة LLaMa الخاصة بـ Meta ليست مفتوحة المصدر" . مبادرة المصادر المفتوحة . تم الاطلاع عليه بتاريخ 10 يوليو 2025 .
- ↑ ماريس، جوردان (18 فبراير 2025). "رخصة LLaMa الخاصة بـ Meta لا تزال غير مفتوحة المصدر" . مبادرة المصادر المفتوحة . تم الاطلاع عليه بتاريخ 10 يوليو 2025 .
- ↑ تشان، روزالي؛ هايز، كالي (19 يوليو 2023). "نموذج الذكاء الاصطناعي الجديد "لاما 2" من ميتا، والذي يُوصف بأنه "مفتوح المصدر"، ليس مفتوحًا كما يبدو" . بزنس إنسايدر . تاريخ الاسترجاع: 10 يوليو 2025 .
- ↑ ديفيز، باسكال (28 أكتوبر 2024). "لماذا لا يكون الذكاء الاصطناعي "مفتوح المصدر" لشركة ميتا كما يبدو؟" . يورونيوز . تم الاطلاع عليه في 10 يوليو 2025 .
- ↑ روبيسون، كايلي (28 أكتوبر 2024). "يجب على الذكاء الاصطناعي مفتوح المصدر الكشف عن بيانات التدريب الخاصة به، وفقًا لتعريف OSI الجديد" . ذا فيرج . تم الاسترجاع في 10 يوليو 2025 .
- ↑ سيفيتش، كريستوف (24 يناير 2025). "رخصة لاما 3.1 المجتمعية ليست رخصة برمجيات حرة" . مؤسسة البرمجيات الحرة . تم الاطلاع عليه بتاريخ 10 يوليو 2025 .
- ↑ "تراخيص متنوعة وتعليقات عليها" . مؤسسة البرمجيات الحرة . القسم. "اتفاقية ترخيص مجتمع لاما 3.1 وسياسة الاستخدام المقبول للاما 3.1" . تم الاطلاع عليه بتاريخ 10 يوليو 2025 .
- ↑ نولان، مايكل (27 يوليو 2023). "برنامجا لاما وChatGPT ليسا مفتوحي المصدر" . مجلة IEEE Spectrum . تم الاطلاع عليه بتاريخ 10 يوليو 2025 .
- ↑ ويدر، ديفيد غراي؛ ويتاكر، ميريديث ؛ ويست، سارة مايرز (27 نوفمبر 2024). "لماذا تُعتبر أنظمة الذكاء الاصطناعي "المفتوحة" مغلقة في الواقع، ولماذا يُعدّ هذا الأمر مهمًا" . مجلة نيتشر . 635 (8040): 827-833 . Bibcode : 2024Natur.635..827W . doi : 10.1038/s41586-024-08141-1 . PMID 39604616 .
- ↑ نايت، ويل. "برنامج لاما 3 مفتوح المصدر من ميتا يُنافس برنامج أوبن إيه آي بقوة" . مجلة وايرد . مؤرشف من الأصل بتاريخ 27 سبتمبر 2024. تم الاطلاع عليه بتاريخ 20 أكتوبر 2024 .
- ↑ "وكلاء الذكاء الاصطناعي المُحسّنون من ميتا يُربكون مستخدمي فيسبوك" . أخبار ABC . ١٩ أبريل ٢٠٢٤. مؤرشف من الأصل في ١٧ سبتمبر ٢٠٢٤. تم الاطلاع عليه في ٢٠ أكتوبر ٢٠٢٤ .
- ↑ نايت، ويل. "نموذج الذكاء الاصطناعي الجديد لاما 3.1 من ميتا مجاني وقوي ومحفوف بالمخاطر" . وايرد . ISSN 1059-1028 . مؤرشف من الأصل في 3 أغسطس 2024. تم الاطلاع عليه في 4 أغسطس 2024 .
- ↑ واترز، ريتشارد (17 أكتوبر 2024). "ميتا تحت الانتقادات بسبب 'تلويثها' للمصادر المفتوحة" . فايننشال تايمز .
روابط خارجية
- برامج 2023
- تسريبات الإنترنت
- نماذج لغوية كبيرة
- منصات ميتا
- محولات توليدية مدربة مسبقًا
- 2023 في مجال الذكاء الاصطناعي
- صناعة الذكاء الاصطناعي في الولايات المتحدة
