دال-إي

DALL-E و DALL-E 2 و DALL-E 3 (المُنمقة DALL·E ) هي نماذج لتحويل النص إلى صورة طورتها OpenAI باستخدام منهجيات التعلم العميق لإنشاء صور رقمية من أوصاف اللغة الطبيعية المعروفة باسم المطالبات .

أُعلن عن الإصدار الأول من DALL-E في يناير 2021. وفي العام التالي، صدر الإصدار DALL-E 2. أُتيح DALL-E 3 بشكل أصلي في ChatGPT لعملاء ChatGPT Plus وChatGPT Enterprise في أكتوبر 2023، [ 1 ] مع توفره عبر واجهة برمجة تطبيقات OpenAI [ 2 ] ومنصة "Labs" في أوائل نوفمبر. [ 3 ] طبقت مايكروسوفت النموذج في أداة إنشاء الصور من Bing وتخطط لتطبيقه في تطبيق Designer الخاص بها. [ 4 ] يعمل Microsoft Copilot على DALL-E 3 مع أداة إنشاء الصور من Bing. [ 5 ] في مارس 2025، استُبدل DALL-E 3 في ChatGPT بإمكانيات إنشاء الصور الأصلية لـ GPT Image . [ 6 ]

التاريخ والخلفية

تم الكشف عن DALL-E من قبل OpenAI في منشور مدونة بتاريخ 5 يناير 2021، ويستخدم نسخة معدلة من GPT-3 لإنشاء الصور. [ 7 ]

في 6 أبريل 2022، أعلنت OpenAI عن DALL-E 2، وهو نموذج مُطوّر مُصمّم لإنتاج صور أكثر واقعية بدقة أعلى، "يجمع بين المفاهيم والخصائص والأنماط". [ 8 ] في 20 يوليو 2022، دخل DALL-E 2 مرحلة تجريبية، حيث تم إرسال دعوات إلى مليون شخص على قائمة الانتظار؛ [ 9 ] وكان بإمكان المستخدمين إنتاج عدد مُحدد من الصور مجانًا شهريًا، مع إمكانية شراء المزيد. [ 10 ] وكان الوصول إليه مقتصرًا سابقًا على مستخدمين مُختارين مُسبقًا لمعاينة بحثية، نظرًا لمخاوف تتعلق بالأخلاقيات والسلامة. [ 11 ] [ 12 ] في 28 سبتمبر 2022، أُتيح DALL-E 2 للجميع، وتم إلغاء شرط قائمة الانتظار. [ 13 ] في سبتمبر 2023، أعلنت OpenAI عن أحدث نموذج صور لديها، DALL-E 3، القادر على فهم "دقة وتفاصيل أكثر بكثير" من الإصدارات السابقة. [ 14 ] في أوائل نوفمبر 2022، أطلقت OpenAI نموذج DALL-E 2 كواجهة برمجة تطبيقات (API) ، مما أتاح للمطورين دمج النموذج في تطبيقاتهم. وكشفت مايكروسوفت عن تطبيقها لنموذج DALL-E 2 في تطبيق Designer وأداة Image Creator المدمجة في محركي بحث Bing و Microsoft Edge . [ 15 ] تعمل واجهة برمجة التطبيقات بنظام الدفع لكل صورة، وتختلف الأسعار باختلاف دقة الصورة. وتتوفر خصومات على الكميات الكبيرة للشركات التي تتعاون مع فريق المؤسسات في OpenAI. [ 16 ]

اسم البرنامج هو مزيج من اسمي شخصية الروبوت المتحركة WALL-E من إنتاج شركة بيكسار والفنان السريالي الإسباني سلفادور دالي . [ 17 ] [ 7 ]

في فبراير 2024، بدأت OpenAI بإضافة علامات مائية إلى الصور التي تم إنشاؤها بواسطة DALL-E، والتي تحتوي على بيانات وصفية وفقًا لمعيار C2PA (ائتلاف أصل المحتوى ومصداقيته) الذي تروج له مبادرة مصداقية المحتوى . [ 18 ]

تكنولوجيا

طُوِّر أول نموذج مُولِّد مُدرَّب مُسبقًا من نوع Transformer (GPT) بواسطة OpenAI في عام 2018، [ 19 ] باستخدام بنية Transformer . وتم توسيع نطاق الإصدار الأول، GPT-1، [ 20 ] لإنتاج GPT-2 في عام 2019؛ [ 21 ] وفي عام 2020، تم توسيع نطاقه مرة أخرى لإنتاج GPT-3 ، الذي يحتوي على 175 مليار مُعامل. [ 22 ] [ 7 ] [ 23 ]

دال-إي

يتكون DALL-E من ثلاثة مكونات: نموذج VAE منفصل ، ونموذج Transformer يعتمد على فك التشفير التلقائي فقط (12 مليار معلمة) مشابه لـ GPT-3، وزوج CLIP من مشفر الصور ومشفر النصوص. [ 24 ]

يمكن لنموذج VAE المنفصل تحويل الصورة إلى سلسلة من الرموز، والعكس صحيح، حيث يمكنه تحويل سلسلة الرموز مرة أخرى إلى صورة. وهذا ضروري لأن نموذج Transformer لا يعالج بيانات الصور مباشرةً. [ 24 ]

يُدخل إلى نموذج Transformer سلسلة من وصف الصورة المُجزأ إلى رموز، متبوعة بأجزاء من الصورة مُجزأة إلى رموز أيضًا. وصف الصورة باللغة الإنجليزية، مُجزأ إلى رموز باستخدام ترميز أزواج البايت (حجم المفردات 16384)، ويمكن أن يصل طوله إلى 256 رمزًا. كل صورة هي صورة RGB بحجم 256×256، مُقسمة إلى 32×32 جزءًا، كل جزء منها بحجم 4×4. ثم يُحوّل كل جزء بواسطة مُشفّر تلقائي تبايني منفصل إلى رمز (حجم المفردات 8192). [ 24 ]

طُوِّرَ نموذج DALL-E وأُعلن عنه للجمهور بالتزامن مع نموذج CLIP (التدريب المسبق للغة والصور باستخدام أسلوب التباين) . [ 25 ] CLIP هو نموذج منفصل يعتمد على التعلم التبايني ، وقد دُرِّبَ على 400 مليون زوج من الصور مع تعليقات نصية مُستخرجة من الإنترنت. يتمثل دوره في "فهم وترتيب" مُخرجات DALL-E من خلال التنبؤ بأي تعليق من قائمة تضم 32,768 تعليقًا تم اختيارها عشوائيًا من مجموعة البيانات (من بينها تعليق واحد صحيح) هو الأنسب للصورة. [ 26 ]

يتم استخدام زوج CLIP المدرب لتصفية قائمة أولية أكبر من الصور التي تم إنشاؤها بواسطة DALL-E لاختيار الصورة الأقرب إلى النص المطلوب. [ 24 ]

دال-إي 2

يستخدم DALL-E 2 عدد 3.5 مليار مُعامل، وهو عدد أقل من سابقه. [ 24 ] وبدلاً من نموذج Transformer التراجعي الذاتي، يستخدم DALL-E 2 نموذج انتشار مشروط بتضمينات صور CLIP، والتي يتم توليدها أثناء الاستدلال من تضمينات نصوص CLIP بواسطة نموذج مسبق. [ 24 ] وهذا هو نفس تصميم Stable Diffusion ، الذي صدر بعد بضعة أشهر.

دال-إي 3

على الرغم من كتابة تقرير فني لـ DALL-E 3، إلا أنه لا يتضمن تفاصيل التدريب أو التنفيذ للنموذج، بل يركز بدلاً من ذلك على قدرات تتبع التعليمات المحسنة التي تم تطويرها لـ DALL-E 3. [ 27 ]

القدرات

يستطيع برنامج DALL-E توليد صور بأنماط متعددة، بما في ذلك الصور الواقعية واللوحات والرموز التعبيرية . [ 7 ] كما يمكنه "معالجة وإعادة ترتيب" العناصر في صوره، [ 7 ] ويستطيع وضع عناصر التصميم بدقة في تركيبات جديدة دون تعليمات صريحة. وقد أشار توم دان، في مقال له على موقع BoingBoing، إلى أنه "على سبيل المثال، عندما يُطلب من DALL-E رسم فجل دايكون ينفخ أنفه، أو يحتسي لاتيه، أو يركب دراجة أحادية العجلة، فإنه غالبًا ما يرسم المنديل واليدين والقدمين في مواقع معقولة." [ 28 ] وأظهر DALL-E قدرة على "ملء الفراغات" لاستنتاج التفاصيل المناسبة دون توجيهات محددة، مثل إضافة صور عيد الميلاد إلى التوجيهات المرتبطة عادةً بالاحتفال، [ 29 ] ووضع الظلال بشكل مناسب على الصور التي لم تذكرها. [ 30 ] علاوة على ذلك، يُظهر DALL-E فهمًا واسعًا للاتجاهات البصرية والتصميمية.

يستطيع نظام DALL-E إنتاج صور لمجموعة واسعة من الأوصاف العشوائية من وجهات نظر مختلفة [ 31 ] مع حالات فشل نادرة للغاية. [ 17 ] وقد وجد مارك ريدل، الأستاذ المشارك في كلية الحوسبة التفاعلية بمعهد جورجيا للتكنولوجيا ، أن نظام DALL-E قادر على دمج المفاهيم (التي تُوصف بأنها عنصر أساسي في الإبداع البشري ). [ 32 ] [ 33 ]

إن قدرته على الاستدلال البصري كافية لحل مصفوفات رافن (وهي اختبارات بصرية تُجرى عادةً على البشر لقياس الذكاء). [ 34 ] [ 35 ]

صورة تم إنشاؤها بواسطة DALL-E 3 بناءً على النص التالي: "رسم توضيحي لأفوكادو جالس على كرسي معالج نفسي، يقول: "أشعر بفراغ كبير في داخلي"، مع وجود ثقب بحجم النواة في وسطه. المعالج النفسي، وهو ملعقة، يدون ملاحظات".

يُطبّق DALL-E 3 التعليمات المعقدة بدقة وتفصيل أكبر من الإصدارات السابقة، وهو قادر على توليد نصوص أكثر تماسكًا ودقة. [ 36 ] [ 14 ] DALL-E 3 مُدمج في ChatGPT Plus. [ 14 ]

تعديل الصورة

نسختان "مختلفتان" من أغنية " فتاة ذات قرط لؤلؤي" تم إنشاؤهما باستخدام برنامج DALL-E 2

بإمكان برنامجي DALL-E 2 وDALL-E 3، عند إدخال صورة موجودة، إنتاج نسخ مختلفة منها كمخرجات فردية بناءً على الصورة الأصلية، بالإضافة إلى إمكانية تعديل الصورة لتوسيعها أو تغييرها. وتعتمد قدرات "التعبئة" و"الرسم الخارجي" في هذين البرنامجين على سياق الصورة لملء الفراغات باستخدام وسيط متوافق مع الصورة الأصلية، وذلك بناءً على توجيهات محددة.

على سبيل المثال، يمكن استخدام هذه التقنية لإدراج عنصر جديد في صورة، أو لتوسيع صورة خارج حدودها الأصلية. [ 37 ] ووفقًا لشركة OpenAI، فإن "تقنية Outpainting تأخذ في الاعتبار العناصر المرئية الموجودة في الصورة - بما في ذلك الظلال والانعكاسات والنسيج - للحفاظ على سياق الصورة الأصلية." [ 38 ]

القيود التقنية

يُعاني نظام DALL-E 2 من قصور في فهم اللغة. فهو يعجز أحيانًا عن التمييز بين "كتاب أصفر ومزهرية حمراء" و"كتاب أحمر ومزهرية صفراء"، أو بين "باندا يصنع فن اللاتيه" و"فن اللاتيه لباندا". [ 39 ] كما يُولّد صورًا لرائد فضاء يمتطي حصانًا عند إدخال عبارة "حصان يمتطي رائد فضاء". [ 40 ] ويفشل أيضًا في توليد الصور الصحيحة في ظروفٍ مُتعددة. فقد يؤدي طلب أكثر من ثلاثة عناصر، أو استخدام أدوات النفي، أو الأرقام، أو الجمل المتصلة إلى أخطاء، وقد تظهر خصائص العناصر على العنصر الخطأ. [ 31 ] وتشمل القيود الإضافية توليد النصوص، والرموز المتناظرة، وأنواع أخرى من الطباعة، مما ينتج عنه غالبًا كلامٌ غير مفهوم أشبه بالحلم. كما أن قدرة النموذج على التعامل مع المعلومات العلمية محدودة، مثل علم الفلك أو الصور الطبية. [ 41 ]

محاولة لإنشاء نص ياباني باستخدام المطالبة "شخص يشير إلى تانوكي ، مع فقاعة كلام تقول 'これは狸です! ' " ، مما يؤدي إلى عرض النص باستخدام كانجي وكانا لا معنى لهما

المخاوف الأخلاقية

يؤثر اعتماد DALL-E 2 على مجموعات البيانات العامة على نتائجه، ويؤدي إلى تحيز خوارزمي في بعض الحالات، مثل توليد أعداد أكبر من الرجال مقارنةً بالنساء في الطلبات التي لا تُحدد الجنس. [ 41 ] خضعت بيانات تدريب DALL-E 2 للتصفية لإزالة الصور العنيفة والجنسية، ولكن وُجد أن هذا يزيد من التحيز في بعض الحالات، مثل تقليل عدد النساء المُولَّدات. [ 42 ] تفترض OpenAI أن هذا قد يكون بسبب احتمالية تصوير النساء بصورة جنسية في بيانات التدريب، مما أدى إلى تأثير التصفية على النتائج. [ 42 ] في سبتمبر 2022، أكدت OpenAI لموقع The Verge أن DALL-E يُدرج عبارات بشكل غير مرئي في طلبات المستخدم لمعالجة التحيز في النتائج؛ على سبيل المثال، تُدرج عبارات مثل "رجل أسود" و"امرأة آسيوية" في الطلبات التي لا تُحدد الجنس أو العرق. [ 43 ] تدّعي OpenAI أنها تعالج المخاوف بشأن المحتوى الذي قد يُصنّف على أنه "محتوى فاضح" - والذي يتضمن عُريًا أو محتوى جنسيًا - باستخدام DALL-E 3 من خلال مرشحات الإدخال/الإخراج، وقوائم الحظر، ورفض ChatGPT، والتدخلات على مستوى النموذج. [ 44 ] مع ذلك، لا يزال DALL-E 3 يُمثّل الأشخاص بشكل غير متناسب على أنهم بيض، وإناث، وشباب. ويمكن للمستخدمين معالجة هذا الأمر جزئيًا من خلال توجيهات أكثر تحديدًا لإنشاء الصور. 

من المخاوف المتعلقة ببرنامج DALL-E 2 ونماذج توليد الصور المشابهة، إمكانية استخدامها لنشر الصور المزيفة بتقنية التزييف العميق وغيرها من أشكال التضليل. [ 45 ] [ 46 ] ولمعالجة هذه المشكلة، يرفض البرنامج الرسائل التي تتضمن شخصيات عامة والصور التي تحتوي على وجوه بشرية. [ 47 ] كما يتم حظر الرسائل التي قد تحتوي على محتوى غير لائق، وتُحلل الصور المرفوعة للكشف عن أي مواد مسيئة. [ 48 ] ومن عيوب التصفية القائمة على الرسائل سهولة تجاوزها باستخدام عبارات بديلة تُعطي نتائج مشابهة. على سبيل المثال، يتم تصفية كلمة "دم"، بينما لا يتم تصفية كلمتي "كاتشب" و"سائل أحمر". [ 49 ] [ 48 ]

من المخاوف الأخرى المتعلقة ببرنامج DALL-E 2 والنماذج المشابهة له، احتمال تسببه في بطالة تقنية للفنانين والمصورين ومصممي الجرافيك نظرًا لدقته وشيوعه. [ 50 ] [ 51 ] صُمم برنامج DALL-E 3 لمنع المستخدمين من إنتاج أعمال فنية بأسلوب الفنانين المعاصرين. [ 14 ] وبينما تُصرّح OpenAI بأن الصور المُنتجة باستخدام هذه النماذج لا تتطلب إذنًا لإعادة طباعتها أو بيعها أو تسويقها، [ 52 ] فقد أُثيرت مخاوف قانونية بشأن ملكية هذه الصور. [ 53 ] [ 54 ]

في عام 2023، عرضت مايكروسوفت على وزارة الدفاع الأمريكية استخدام نماذج DALL-E لتدريب أنظمة إدارة ساحة المعركة . [ 55 ] وفي يناير 2024، رفعت OpenAI الحظر الشامل المفروض على استخدام هذه النماذج في المجال العسكري والحربي من سياسات استخدامها. [ 56 ]

استقبال

صور تم إنشاؤها بواسطة DALL-E بناءً على الطلب التالي: "رسم توضيحي لفجل دايكون صغير يرتدي تنورة توتو ويمشي مع كلب"

تركز معظم التغطيات الإعلامية لبرنامج DALL-E على مجموعة فرعية صغيرة من مخرجاته "السريالية" [ 25 ] أو "الغريبة" [ 32 ] . وقد ذُكرت مخرجات DALL-E، التي تمثل "رسمًا توضيحيًا لفجل دايكون صغير يرتدي تنورة توتو ويمشي مع كلب"، في مقالات من Input [ 57 ] و NBC [ 58 ] و Nature [ 59 ] ومنشورات أخرى [ 7 ] [ 60 ] [ 61 ] . كما حظيت مخرجاته التي تمثل "كرسيًا بذراعين على شكل أفوكادو" بتغطية واسعة [ 25 ] [ 33 ] .

ذكر موقع ExtremeTech أنه "يمكنك أن تطلب من DALL-E صورةً لهاتف أو مكنسة كهربائية من فترة زمنية محددة، وسيفهم كيف تغيرت هذه الأشياء". [ 29 ] كما أشار موقع Engadget إلى قدرته غير العادية على "فهم كيفية تغير الهواتف وغيرها من الأشياء بمرور الوقت". [ 30 ]

بحسب مجلة MIT Technology Review ، كان أحد أهداف OpenAI هو "منح نماذج اللغة فهمًا أفضل للمفاهيم اليومية التي يستخدمها البشر لفهم الأشياء". [ 25 ]

حظي مشروع DALL-E 2 باستقبال إيجابي من مستثمري وول ستريت، حيث رأت بعض الشركات أنه قد يمثل نقطة تحول لصناعة مستقبلية تبلغ قيمتها تريليونات الدولارات. وبحلول منتصف عام 2019، كانت شركة OpenAI قد تلقت بالفعل تمويلًا يزيد عن مليار دولار من مايكروسوفت وخوسلا فنتشرز، [ 62 ] [ 63 ] [ 64 ] وفي يناير 2023، عقب إطلاق DALL-E 2 وChatGPT، تلقت تمويلًا إضافيًا بقيمة 10 مليارات دولار من مايكروسوفت. [ 65 ]

أبدى مجتمع الأنمي الياباني ردود فعل سلبية تجاه برنامج DALL-E 2 والنماذج المشابهة. [ 66 ] [ 67 ] [ 68 ] ويُقدّم الفنانون عادةً حجتين ضد هذا البرنامج. الأولى هي أن فن الذكاء الاصطناعي ليس فنًا حقيقيًا لأنه لا يُخلق بقصد من الإنسان. "إن مقارنة الصور المُولّدة بواسطة الذكاء الاصطناعي بأعمالهم الخاصة تُقلّل من قيمة الوقت والمهارة المبذولين في فنهم. وقد تعرّضت أدوات توليد الصور المدعومة بالذكاء الاصطناعي لانتقادات شديدة من الفنانين لأنها تُدرّب على أعمال فنية بشرية مُستخرجة من الإنترنت." [ 9 ] أما الحجة الثانية فتتعلق بقانون حقوق النشر والبيانات التي تُدرّب عليها نماذج تحويل النصوص إلى صور. لم تُفصح OpenAI عن معلومات حول مجموعات البيانات التي استُخدمت لتدريب DALL-E 2، مما أثار مخاوف البعض من استخدام أعمال الفنانين في التدريب دون إذن. ولا تزال قوانين حقوق النشر المتعلقة بهذه المواضيع غير واضحة في الوقت الحالي. [ 10 ]

بعد دمج DALL-E 3 في Bing Chat وChatGPT، واجهت مايكروسوفت وOpenAI انتقاداتٍ بسبب الإفراط في تصفية المحتوى، حيث وصف النقاد DALL-E بأنه "خضع لعملية استئصال فصّي". [ 69 ] واستُشهد بحظر الصور الناتجة عن اقتراحات مثل "رجل يكسر خزانة خوادم بمطرقة ثقيلة" كدليل على ذلك. وخلال الأيام الأولى من إطلاقه، أفادت التقارير بزيادة التصفية إلى درجة حظر الصور الناتجة عن بعض اقتراحات Bing نفسها. [ 69 ] [ 70 ] ورأى موقع TechRadar أن المبالغة في الحذر قد تحدّ من قيمة DALL-E كأداة إبداعية. [ 70 ]

بدائل مفتوحة المصدر

توليد الصور بواسطة DALL-E Mini في يونيو 2022

نظرًا لعدم نشر OpenAI لشفرة المصدر أو أوزان أي من النماذج الثلاثة، فقد بُذلت عدة محاولات لإنشاء نماذج مفتوحة المصدر تُقدم قدرات مماثلة. [ 71 ] [ 72 ] يُعدّ Craiyon (الذي كان يُعرف سابقًا باسم DALL-E Mini حتى طلبت OpenAI تغيير اسمه في يونيو 2022) نموذج ذكاء اصطناعي مُستند إلى DALL-E الأصلي، وقد تم تدريبه على بيانات غير مُفلترة من الإنترنت، وتم إصداره عام 2022 على منصة Spaces التابعة لشركة Hugging Face. وقد حظي باهتمام إعلامي كبير في منتصف عام 2022 بعد إصداره، وذلك لقدرته على إنتاج صور فكاهية. [ 73 ] [ 74 ] [ 75 ] ومن الأمثلة الأخرى على نماذج تحويل النصوص إلى صور مفتوحة المصدر، Stable Diffusion من Stability AI. [ 76 ]

انظر أيضاً

مراجع

  1. ديفيد، إميليا (20 سبتمبر 2023). "أوبن إيه آي تُصدر النسخة الثالثة من دال-إي" . ذا فيرج . مؤرشف من الأصل في 20 سبتمبر 2023. تم الاطلاع عليه في 21 سبتمبر 2023 .
  2. "منصة OpenAI" . platform.openai.com . مؤرشف من الأصل بتاريخ 20 مارس 2023. تم الاطلاع عليه بتاريخ 10 نوفمبر 2023 .
  3. نايلز، ريموند (10 نوفمبر 2023) [تم التحديث هذا الأسبوع]. "واجهة برمجة تطبيقات DALL-E 3" . مركز مساعدة OpenAI . مؤرشف من الأصل في 10 نوفمبر 2023. تم الاسترجاع في 10 نوفمبر 2023 .
  4. مهدي، يوسف (21 سبتمبر 2023). "الإعلان عن مايكروسوفت كوبيلوت، رفيقك الذكي اليومي" . مدونة مايكروسوفت الرسمية . مؤرشف من الأصل في 21 سبتمبر 2023. تم الاطلاع عليه في 21 سبتمبر 2023 .
  5. "تحسينات الذكاء الاصطناعي في الفن باستخدام DALL-E 3" . مايكروسوفت . تم الاطلاع عليه في 1 أكتوبر 2024 .
  6. زيف، كايل؛ ويغرز، ماكسويل (25 مارس 2025). "ميزة توليد الصور في ChatGPT تحصل على ترقية" . TechCrunch . تم الاسترجاع في 12 مايو 2025 .
  7. 1 2 3 4 5 6 جونسون، خاري (5 يناير 2021). "OpenAI تُطلق DALL-E لتوليد الصور من النصوص" . VentureBeat. مؤرشف من الأصل في 5 يناير 2021. تم الاطلاع عليه في 5 يناير 2021 .
  8. "DALL·E 2" . OpenAI . مؤرشف من الأصل في 6 أبريل 2022. تم الاسترجاع في 6 يوليو 2022 .
  9. 1 2 "DALL·E متوفر الآن في مرحلة تجريبية" . OpenAI . 20 يوليو 2022. مؤرشف من الأصل في 20 يوليو 2022. تم الاسترجاع في 20 يوليو 2022 .
  10. ألين ، بوبي (20 يوليو 2022). " سريالي أم واقعي أكثر من اللازم؟ أداة الذكاء الاصطناعي المذهلة DALL-E تنقل صورها إلى مستوى أوسع" . NPR . مؤرشف من الأصل في 20 يوليو 2022. تم الاسترجاع في 20 يوليو 2022 .
  11. "قائمة انتظار DALL·E" . labs.openai.com . مؤرشف من الأصل في 4 يوليو 2022. تم الاطلاع عليه في 6 يوليو 2022 .
  12. "من أطفال ترامب إلى التزييف العميق: دال-إي وأخلاقيات فن الذكاء الاصطناعي" . صحيفة الغارديان . ١٨ يونيو ٢٠٢٢. مؤرشف من الأصل في ٦ يوليو ٢٠٢٢. تم الاطلاع عليه في ٦ يوليو ٢٠٢٢ .
  13. "DALL·E متوفر الآن بدون قائمة انتظار" . OpenAI . 28 سبتمبر 2022. مؤرشف من الأصل في 4 أكتوبر 2022. تم الاطلاع عليه في 5 أكتوبر 2022 .
  14. 1 2 3 4 "DALL·E 3" . OpenAI . مؤرشف من الأصل في 20 سبتمبر 2023. تم الاسترجاع في 21 سبتمبر 2023 .
  15. "واجهة برمجة تطبيقات DALL·E متاحة الآن في الإصدار التجريبي العام" . OpenAI . 3 نوفمبر 2022. مؤرشف من الأصل في 19 نوفمبر 2022. تم الاطلاع عليه في 19 نوفمبر 2022 .
  16. ويغرز، كايل (3 نوفمبر 2022). "الآن بإمكان أي شخص إنشاء تطبيقات تستخدم DALL-E 2 لإنشاء الصور" . تيك كرانش . مؤرشف من الأصل في 19 نوفمبر 2022. تم الاطلاع عليه في 19 نوفمبر 2022 .
  17. 1 2 كولدوي، ديفين (5 يناير 2021). "يُنشئ برنامج DALL-E من OpenAI صورًا واقعية لأي شيء تطلبه منه حرفيًا" . مؤرشف من الأصل في 6 يناير 2021. تم الاطلاع عليه في 5 يناير 2021 .
  18. جروكوت، مات (8 فبراير 2024). "الصور المُولّدة بالذكاء الاصطناعي على DALL-E تحتوي الآن على علامة أصالة المحتوى" . بيتا بيكسل . تم الاطلاع عليه في 4 أبريل 2024 .
  19. رادفورد، أليك؛ ناراسيمهان، كارتيك؛ ساليمانس، تيم؛ سوتسكيفر، إيليا (11 يونيو 2018). "تحسين فهم اللغة من خلال التدريب التوليدي المسبق" (ملف PDF) . OpenAI . ص 12. مؤرشف (ملف PDF) من الأصل في 26 يناير 2021. تم الاطلاع عليه في 23 يناير 2021 . 
  20. "GPT-1 إلى GPT-4: شرح ومقارنة نماذج GPT من OpenAI" . 11 أبريل 2023. مؤرشف من الأصل في 15 أبريل 2023. تم الاطلاع عليه في 29 أبريل 2023 .
  21. رادفورد، أليك؛ وو، جيفري؛ تشايلد، ريون؛ وآخرون . (14 فبراير 2019). "نماذج اللغة هي متعلمون متعددون المهام غير خاضعين للإشراف" (ملف PDF) . cdn.openai.com . 1 (8). مؤرشف (ملف PDF) من الأصل في 6 فبراير 2021. تم الاسترجاع في 19 ديسمبر 2020 . 
  22. براون، توم ب.؛ مان، بنجامين؛ رايدر، نيك؛ وآخرون . (22 يوليو 2020). "نماذج اللغة هي متعلمون بأمثلة قليلة". arXiv : 2005.14165 [ cs.CL ]. 
  23. راميش، أديتيا؛ بافلوف، ميخائيل؛ جوه، غابرييل؛ وآخرون . (24 فبراير 2021). "توليد الصور من النصوص بدون استخدام أي بيانات". arXiv : 2102.12092 [ cs.LG ]. 
  24. 1 2 3 4 5 6 راميش، أديتيا؛ داريوال، برافولا؛ نيكول، أليكس؛ تشو، كيسي؛ تشين، مارك (12 أبريل 2022). "توليد الصور المشروطة بالنص الهرمي باستخدام CLIP Latents". arXiv : 2204.06125 [ cs.CV ].
  25. ١ ٢ ٣ ٤ هيفن، ويل دوغلاس (٥ يناير ٢٠٢١). "هذا الكرسي المصنوع من الأفوكادو قد يكون مستقبل الذكاء الاصطناعي" . مجلة إم آي تي ​​للتكنولوجيا. مؤرشف من الأصل في ٥ يناير ٢٠٢١. تم الاطلاع عليه في ٥ يناير ٢٠٢١ .
  26. رادفورد، أليك؛ كيم، جونغ ووك؛ هالاسي، كريس؛ وآخرون . (1 يوليو 2021). تعلم نماذج بصرية قابلة للنقل من خلال الإشراف على اللغة الطبيعية . وقائع المؤتمر الدولي الثامن والثلاثين للتعلم الآلي. PMLR. ص 8748-8763 .  
  27. ^ شي، زان؛ تشو، شو؛ تشيو، شيبينج؛ تشو، شياودان (2020). “تحسين التسميات التوضيحية للصور باستخدام أفضل للتسميات التوضيحية”. أرخايف : 2006.11807 [ cs.CV ].
  28. دان، ثوم (10 فبراير 2021). "شبكة عصبية للذكاء الاصطناعي تحوّل التعليقات النصية إلى فن، مثل بيكاتشو قنديل البحر" . بوينغ بوينغ . مؤرشف من الأصل في 22 فبراير 2021. تم الاطلاع عليه في 2 مارس 2021 .
  29. 1 2 ويتوام، رايان (6 يناير 2021). "برنامج 'DALL-E' من OpenAI يُولّد صورًا من أوصاف نصية" . إكستريم تك . مؤرشف من الأصل في 28 يناير 2021. تم الاطلاع عليه في 2 مارس 2021 .
  30. 1 2 دينت، ستيف (6 يناير 2021). "تطبيق DALL-E من OpenAI يُنشئ صورًا من وصف فقط" . Engadget . مؤرشف من الأصل في 27 يناير 2021. تم الاطلاع عليه في 2 مارس 2021 .
  31. 1 2 ماركوس، غاري؛ ديفيس، إرنست؛ آرونسون، سكوت (2 مايو 2022). "تحليل أولي للغاية لـ DALL-E 2". arXiv : 2204.13807 [ cs.CV ].
  32. 1 2 شيد، سام (8 يناير 2021). "لماذا يتحدث الجميع عن مولد صور أصدره مختبر ذكاء اصطناعي مدعوم من إيلون ماسك؟" . سي إن بي سي . مؤرشف من الأصل في 16 يوليو 2022. تم الاطلاع عليه في 2 مارس 2021 .
  33. 1 2 ويكفيلد، جين (6 يناير 2021). "الذكاء الاصطناعي يرسم فجلًا صغيرًا يرتدي تنورة توتو وهو يمشي مع كلبه" . هيئة الإذاعة البريطانية . مؤرشف من الأصل في 2 مارس 2021. تم الاسترجاع في 3 مارس 2021 .
  34. ماركويتز، ديل (10 يناير 2021). "إليك كيفية عمل مولد الصور السحري DALL-E من OpenAI" . TheNextWeb . مؤرشف من الأصل في 23 فبراير 2021. تم الاطلاع عليه في 2 مارس 2021 .
  35. "DALL·E: إنشاء صور من نص" . OpenAI . 5 يناير 2021. مؤرشف من الأصل في 27 مارس 2021. تم الاطلاع عليه في 13 أغسطس 2022 .
  36. إدواردز، بنج (20 سبتمبر 2023). "مولد الصور الجديد بتقنية الذكاء الاصطناعي من OpenAI يتجاوز حدود الدقة في التفاصيل والسرعة" . آرس تكنيكا . مؤرشف من الأصل في 21 سبتمبر 2023. تم الاطلاع عليه في 21 سبتمبر 2023 .
  37. كولدوي، ديفين (6 أبريل 2022). "أداة جديدة من OpenAI ترسم أي شيء، بشكل أكبر وأفضل من أي وقت مضى" . TechCrunch . مؤرشف من الأصل في 6 مايو 2023. تم الاطلاع عليه في 26 نوفمبر 2022 .
  38. "DALL·E: تقديم تقنية Outpainting" . OpenAI . 31 أغسطس 2022. مؤرشف من الأصل في 26 نوفمبر 2022. تم الاطلاع عليه في 26 نوفمبر 2022 .
  39. ساهاريا، شيتوان؛ تشان، ويليام؛ ساكسينا، سوراب؛ وآخرون . (23 مايو 2022). "نماذج نشر النصوص إلى الصور الواقعية مع فهم عميق للغة". arXiv : 2205.11487 [ cs.CV ]. 
  40. ماركوس، غاري (28 مايو 2022). "حصان يمتطي رائد فضاء" . الطريق إلى الذكاء الاصطناعي الذي يمكننا الوثوق به . مؤرشف من الأصل في 19 يونيو 2022. تم الاطلاع عليه في 18 يونيو 2022 .
  41. 1 2 ستريكلاند، إليزا (14 يوليو 2022). "إخفاقات القمر الصناعي DALL-E 2 هي أكثر ما يثير الاهتمام فيه" . مجلة IEEE Spectrum . مؤرشف من الأصل في 15 يوليو 2022. تم الاطلاع عليه في 16 أغسطس 2022 .
  42. 1 2 "DALL·E 2 Pre-Training Mitigations" . OpenAI . 28 يونيو 2022. مؤرشف من الأصل في 19 يوليو 2022. تم الاسترجاع في 18 يوليو 2022 .
  43. جيمس فينسنت (29 سبتمبر 2022). "مولد الصور DALL-E من OpenAI متاح للاستخدام الفوري للجميع" . ذا فيرج . مؤرشف من الأصل في 29 سبتمبر 2022. تم الاطلاع عليه في 29 سبتمبر 2022 .
  44. OpenAI (3 أكتوبر 2023). "بطاقة نظام DALL-E 3" (ملف PDF) .
  45. تايلور، جوش (18 يونيو 2022). "من أطفال ترامب إلى التزييف العميق: دال-إي وأخلاقيات فن الذكاء الاصطناعي" . صحيفة الغارديان . مؤرشف من الأصل في 6 يوليو 2022. تم الاطلاع عليه في 2 أغسطس 2022 .
  46. نايت، ويل (13 يوليو 2022). "عندما يصنع الذكاء الاصطناعي الفن، يُشعل البشر شرارة الإبداع" . مجلة وايرد . مؤرشف من الأصل في 2 أغسطس 2022. تم الاطلاع عليه في 2 أغسطس 2022 .
  47. روز، جانوس (24 يونيو 2022). "دال-إي يُنتج الآن وجوهًا واقعية لأشخاص وهميين" . فايس . مؤرشف من الأصل في 30 يوليو 2022. تم الاطلاع عليه في 2 أغسطس 2022 .
  48. 1 2 OpenAI (19 يونيو 2022). "معاينة DALL·E 2 - المخاطر والقيود" . GitHub . مؤرشف من الأصل في 2 أغسطس 2022. تم الاسترجاع في 2 أغسطس 2022 .
  49. لين، لورا (1 يوليو 2022). "دال-إي، ارسم لي لوحة أخرى لبيكاسو، من فضلك" . مجلة نيويوركر . مؤرشف من الأصل في 2 أغسطس 2022. تم الاطلاع عليه في 2 أغسطس 2022 .
  50. غولدمان، شارون (26 يوليو 2022). "OpenAI: هل سيقضي DALL-E 2 على المسارات المهنية الإبداعية؟" . مؤرشف من الأصل في 15 أغسطس 2022. تم الاطلاع عليه في 16 أغسطس 2022 .
  51. بلين، لوز (29 يوليو 2022). "دال-إي 2: أداة أحلام وتهديد وجودي للفنانين البصريين" . مؤرشف من الأصل في 17 أغسطس 2022. تم الاطلاع عليه في 16 أغسطس 2022 .
  52. ^ "دال · إي 3" . openai.com . تم الاسترجاع 10 أبريل 2025 .
  53. مركز قانون الفنون (21 نوفمبر 2022). "فني أم اصطناعي؟ مخاوف الملكية وحقوق النشر في الأعمال الفنية المولدة بالذكاء الاصطناعي - مركز قانون الفنون" . itsartlaw.org . تاريخ الاطلاع: 10 أبريل 2025 .
  54. "الذكاء الاصطناعي التوليدي يواجه مشكلة في الملكية الفكرية" . مجلة هارفارد بزنس ريفيو . 7 أبريل 2023. ISSN 0017-8012 . تاريخ الاطلاع: 10 أبريل 2025 . 
  55. بيدل، سام (10 أبريل 2024). "مايكروسوفت تروج لـ DALL-E من OpenAI كأداة ميدانية للجيش الأمريكي" . ذا إنترسبت .
  56. بيدل، سام (12 يناير 2024). "OpenAI تلغي بهدوء الحظر المفروض على استخدام ChatGPT لأغراض "العسكرية والحربية"" . The Intercept .
  57. كاسانا، مهرين (7 يناير 2021). "هذا الذكاء الاصطناعي يحوّل النص إلى فن سريالي قائم على الإيحاءات" . المدخلات. مؤرشف من الأصل في 29 يناير 2021. تم الاسترجاع في 2 مارس 2021 .
  58. إهرنكرانز، ميلاني (27 يناير 2021). "إليكم دال-إي: خوارزمية تعلمت رسم أي شيء تخبرها به" . أخبار إن بي سي . مؤرشف من الأصل في 20 فبراير 2021. تم الاسترجاع في 2 مارس 2021 .
  59. ستوف، إيما (5 فبراير 2021). "سيرك الدببة المائية وشجرة الحياة - أفضل الصور العلمية لشهر يناير" . مجلة نيتشر . مؤرشف من الأصل في 8 مارس 2021. تم الاطلاع عليه في 2 مارس 2021 .
  60. نايت، ويل (26 يناير 2021). "هذا الذكاء الاصطناعي قد ينتقل من 'الفن' إلى قيادة سيارة ذاتية القيادة" . وايرد . مؤرشف من الأصل في 21 فبراير 2021. تم الاطلاع عليه في 2 مارس 2021 .
  61. ميتز، راشيل (2 فبراير 2021). "فجل يرتدي تنورة باليه ويمشي مع كلب؟ هذا الذكاء الاصطناعي قادر على رسمه بدقة متناهية" . سي إن إن. مؤرشف من الأصل في 16 يوليو 2022. تم الاطلاع عليه في 2 مارس 2021 .
  62. ليسوينغ، كيف (8 أكتوبر 2022). "لماذا يشعر وادي السيليكون بهذا الحماس تجاه الرسومات الغريبة التي يرسمها الذكاء الاصطناعي؟" . سي إن بي سي . مؤرشف من الأصل في 29 يوليو 2023. تم الاطلاع عليه في 1 ديسمبر 2022 .
  63. إيثرينغتون، داريل (22 يوليو 2019). "مايكروسوفت تستثمر مليار دولار في OpenAI في شراكة جديدة متعددة السنوات" . TechCrunch . مؤرشف من الأصل في 22 يوليو 2019. تم الاطلاع عليه في 21 سبتمبر 2023 .
  64. «أول داعم لرأس المال الاستثماري لشركة OpenAI يُدلي برأيه حول الذكاء الاصطناعي التوليدي» مجلة فورتشن . مؤرشف من الأصل بتاريخ 23 أكتوبر 2023. تم الاطلاع عليه بتاريخ 21 سبتمبر 2023 .
  65. ميتز، كيد؛ وايز، كارين (23 يناير 2023). "مايكروسوفت تستثمر 10 مليارات دولار في أوبن إيه آي، مبتكرة ChatGPT" . صحيفة نيويورك تايمز . ISSN 0362-4331 . مؤرشف من الأصل في 21 سبتمبر 2023. تم الاطلاع عليه في 21 سبتمبر 2023 . 
  66. «الفن المُولّد بالذكاء الاصطناعي يُثير ردود فعل غاضبة من مجتمع الأنمي في اليابان» . ريست أوف وورلد . ٢٧ أكتوبر ٢٠٢٢. مؤرشف من الأصل في ٣١ ديسمبر ٢٠٢٢. تم الاطلاع عليه في ٣ يناير ٢٠٢٣ .
  67. روز، كيفن (2 سبتمبر 2022). "صورة مُولّدة بالذكاء الاصطناعي تفوز بجائزة فنية. الفنانون غير راضين" . صحيفة نيويورك تايمز . ISSN 0362-4331 . مؤرشف من الأصل في 31 مايو 2023. تم الاطلاع عليه في 3 يناير 2023 . 
  68. داوز، رايان (15 ديسمبر 2022). "تزايد ردود الفعل السلبية تجاه ArtStation في أعقاب استجابة احتجاجات الذكاء الاصطناعي على الفن" . أخبار الذكاء الاصطناعي . مؤرشف من الأصل في 3 يناير 2023. تم الاطلاع عليه في 3 يناير 2023 .
  69. 1 2 كوردن، جيز (8 أكتوبر 2023). "كان إنشاء الصور باستخدام Bing Dall-E 3 رائعًا لبضعة أيام، لكن مايكروسوفت قامت الآن، كما هو متوقع، بتعطيله بشكل كبير" . ويندوز سنترال . مؤرشف من الأصل في 10 أكتوبر 2023. تم الاطلاع عليه في 11 أكتوبر 2023 .
  70. 1 2 آلان، دارين (9 أكتوبر 2023). "مايكروسوفت تُقيّد أداة إنشاء الصور من Bing AI - والنتائج غير منطقية" . TechRadar . مؤرشف من الأصل في 10 أكتوبر 2023. تم الاطلاع عليه في 11 أكتوبر 2023 .
  71. سحر مور، سترايب (16 أبريل 2022). "كيف يمكن لـ DALL-E 2 حلّ تحديات رئيسية في مجال رؤية الحاسوب" . فينشر بيت . مؤرشف من الأصل في 24 مايو 2022. تم الاطلاع عليه في 15 يونيو 2022 .
  72. "jina-ai/dalle-flow" . جينا للذكاء الاصطناعي. ١٧ يونيو ٢٠٢٢. مؤرشف من الأصل في ١٧ يونيو ٢٠٢٢. تم الاطلاع عليه في ١٧ يونيو ٢٠٢٢ .
  73. كارسون، إيرين (14 يونيو 2022). "كل ما تود معرفته عن دال-إي ميني، مُنشئ الفنّ المُذهل بتقنية الذكاء الاصطناعي" . سي نت . مؤرشف من الأصل في 15 يونيو 2022. تم الاطلاع عليه في 15 يونيو 2022 .
  74. شرودر، أودرا (9 يونيو 2022). "برنامج الذكاء الاصطناعي DALL-E mini يُنتج بعض الصور الملعونة حقًا" . ديلي دوت . مؤرشف من الأصل في 10 يونيو 2022. تم الاطلاع عليه في 15 يونيو 2022 .
  75. دياز، آنا (15 يونيو 2022). "يستخدم الناس جهاز DALL-E mini لصنع صور ساخرة غريبة - مثل صورة بيكاتشو على شكل كلب البج" . بوليغون . مؤرشف من الأصل في 15 يونيو 2022. تم الاطلاع عليه في 15 يونيو 2022 .
  76. Stability-AI/stablediffusion ، Stability AI، 7 أبريل 2025 ، تم الاطلاع عليه في 8 أبريل 2025