دال-اي
العلامة المائية موجودة على صور DALL·E | |
صورة تم إنشاؤها بواسطة DALL·E 2، من المطالبة "دببة تيدي تعمل على أبحاث الذكاء الاصطناعي الجديدة تحت الماء باستخدام تكنولوجيا التسعينيات" | |
| المطور(ون) | أوبن أيه آي |
|---|---|
| الإصدار الأولي | 5 يناير 2021 |
| إصدار مستقر | DALL·E 3 / 10 أغسطس 2023 |
| يكتب | نموذج النص إلى الصورة |
| موقع إلكتروني | مختبرات.openai.com |
| Part of a series on |
| Artificial intelligence |
|---|
DALL·E و DALL·E 2 و DALL·E 3 (تُنطق DOLL-E) هي نماذج نص إلى صورة طورتها OpenAI باستخدام منهجيات التعلم العميق لتوليد صور رقمية من أوصاف اللغة الطبيعية المعروفة باسم " المطالبات ".
تم الإعلان عن الإصدار الأول من DALL-E في يناير 2021. وفي العام التالي، تم إصدار خليفته DALL-E 2. تم إصدار DALL·E 3 بشكل أصلي في ChatGPT لعملاء ChatGPT Plus وChatGPT Enterprise في أكتوبر 2023، [1] مع التوافر عبر واجهة برمجة تطبيقات OpenAI [2] ومنصة "Labs" المقدمة في أوائل نوفمبر. [3] نفذت Microsoft النموذج في أداة Image Creator الخاصة بـ Bing وتخطط لتطبيقه في تطبيق Designer الخاص بها. [4]
التاريخ والخلفية
تم الكشف عن DALL·E بواسطة OpenAI في منشور مدونة في 5 يناير 2021، ويستخدم إصدارًا من GPT-3 [5] معدّلًا لتوليد الصور.
في 6 أبريل 2022، أعلنت شركة OpenAI عن DALL·E 2، وهو خليفة مصمم لتوليد صور أكثر واقعية بدقة أعلى "يمكنها الجمع بين المفاهيم والسمات والأنماط". [6] في 20 يوليو 2022، دخل DALL·E 2 في مرحلة تجريبية مع إرسال دعوات إلى مليون فرد مدرج في قائمة الانتظار؛ [7] يمكن للمستخدمين إنشاء عدد معين من الصور مجانًا كل شهر وقد يشترون المزيد. [8] كان الوصول مقيدًا سابقًا للمستخدمين المحددين مسبقًا لمعاينة البحث بسبب المخاوف بشأن الأخلاق والسلامة. [9] [10] في 28 سبتمبر 2022، تم فتح DALL·E 2 للجميع وتم إزالة متطلب قائمة الانتظار. [11] في سبتمبر 2023، أعلنت شركة OpenAI عن أحدث نموذج للصور، DALL·E 3، القادر على فهم "المزيد من الفروق الدقيقة والتفاصيل" من الإصدارات السابقة. [12] في أوائل نوفمبر 2022، أصدرت OpenAI DALL·E 2 كواجهة برمجة تطبيقات ، مما يسمح للمطورين بدمج النموذج في تطبيقاتهم الخاصة. كشفت Microsoft عن تنفيذها لـ DALL·E 2 في تطبيق Designer وأداة Image Creator المضمنة في Bing و Microsoft Edge . [13] تعمل واجهة برمجة التطبيقات على أساس التكلفة لكل صورة، مع اختلاف الأسعار حسب دقة الصورة. تتوفر خصومات على الحجم للشركات التي تعمل مع فريق المؤسسة في OpenAI. [14]
اسم البرنامج عبارة عن مزيج من أسماء شخصية الروبوت المتحركة WALL-E من إنتاج شركة بيكسار والفنان السريالي الكاتالوني سلفادور دالي . [15] [5]
في فبراير 2024، بدأت OpenAI في إضافة علامات مائية إلى الصور التي تم إنشاؤها بواسطة DALL-E، والتي تحتوي على بيانات وصفية وفقًا لمعيار C2PA (تحالف منشأ المحتوى والأصالة) الذي تروج له مبادرة أصالة المحتوى . [16]
تكنولوجيا
تم تطوير أول نموذج محول مُدرَّب مسبقًا (GPT) بواسطة OpenAI في عام 2018، [17] باستخدام بنية المحول . تم توسيع التكرار الأول، GPT-1، [18] لإنتاج GPT-2 في عام 2019؛ [19] في عام 2020، تم توسيعه مرة أخرى لإنتاج GPT-3 ، مع 175 مليار معلمة. [20] [5] [21]
دال-اي
يحتوي DALL·E على ثلاثة مكونات: VAE منفصل ، ومحول فك تشفير تلقائي الانحدار فقط (12 مليار معلمة) مشابه لـ GPT-3، وزوج CLIP من مشفر الصورة ومشفر النص. [22]
يمكن لـ VAE المنفصل تحويل صورة إلى سلسلة من الرموز، وعلى العكس من ذلك، تحويل سلسلة من الرموز مرة أخرى إلى صورة. وهذا ضروري لأن المحول لا يعالج بيانات الصورة بشكل مباشر. [22]
المدخلات إلى نموذج المحول عبارة عن سلسلة من تسميات الصور المميزة متبوعة ببقع صور مميزة. التسمية التوضيحية للصورة باللغة الإنجليزية، مرمزة بواسطة ترميز أزواج البايتات (حجم المفردات 16384)، ويمكن أن يصل طولها إلى 256 رمزًا. كل صورة عبارة عن صورة RGB بحجم 256 × 256، مقسمة إلى 32 × 32 رقعة كل منها 4 × 4. ثم يتم تحويل كل رقعة بواسطة مشفر ذاتي متغير منفصل إلى رمز (حجم المفردات 8192). [22]
تم تطوير DALL·E والإعلان عنه للجمهور بالاشتراك مع CLIP (تدريب اللغة التباينية على الصورة مسبقًا) . [23] CLIP هو نموذج منفصل يعتمد على التعلم التبايني الذي تم تدريبه على 400 مليون زوج من الصور مع تعليقات نصية تم جمعها من الإنترنت. يتمثل دوره في "فهم وتصنيف" مخرجات DALL·E من خلال التنبؤ بأي تعليق من قائمة مكونة من 32768 تعليقًا تم اختيارها عشوائيًا من مجموعة البيانات (أحدها كان الإجابة الصحيحة) هو الأنسب للصورة. [24]
يتم استخدام زوج CLIP المدرب لتصفية قائمة أولية أكبر من الصور التي تم إنشاؤها بواسطة DALL·E لتحديد الصورة الأقرب إلى موجه النص. [22]
دال-اي 2
يستخدم DALL·E 2 3.5 مليار معلمة، وهو عدد أصغر من سابقه. [22] بدلاً من المحول الانحداري التلقائي، يستخدم DALL·E 2 نموذج انتشار مشروط بتضمينات صور CLIP، والتي يتم إنشاؤها أثناء الاستدلال من تضمينات نص CLIP بواسطة نموذج سابق. [22] هذا هو نفس هندسة Stable Diffusion ، التي تم إصدارها بعد بضعة أشهر.
القدرات
يمكن لـ DALL·E إنشاء صور بأنماط متعددة، بما في ذلك الصور الواقعية واللوحات والرموز التعبيرية . [5] ويمكنه "التلاعب وإعادة ترتيب" الأشياء في صوره، [5] ويمكنه وضع عناصر التصميم بشكل صحيح في تركيبات جديدة دون تعليمات صريحة. لاحظ توم دون الكاتب في BoingBoing أنه "على سبيل المثال، عندما يُطلب منه رسم فجل دايكون ينفخ أنفه، أو يشرب لاتيه، أو يركب دراجة أحادية العجلة، غالبًا ما يرسم DALL·E المنديل واليدين والقدمين في أماكن معقولة". [25] أظهر DALL·E القدرة على "ملء الفراغات" لاستنتاج التفاصيل المناسبة دون مطالبات محددة، مثل إضافة صور عيد الميلاد إلى المطالبات المرتبطة عادةً بالاحتفال، [26] والظلال الموضوعة بشكل مناسب للصور التي لم تذكرها. [27] علاوة على ذلك، يُظهر DALL·E فهمًا واسعًا للاتجاهات المرئية والتصميمية. [ بحاجة لمصدر ]
يمكن لـ DALL·E إنتاج صور لمجموعة واسعة من الأوصاف التعسفية من وجهات نظر مختلفة [28] مع حالات فشل نادرة فقط. [15] وجد مارك ريدل، الأستاذ المشارك في كلية الحوسبة التفاعلية في معهد جورجيا للتكنولوجيا ، أن DALL-E يمكنه دمج المفاهيم (التي توصف بأنها عنصر أساسي للإبداع البشري ). [29] [30]
قدرتها على التفكير البصري كافية لحل مصفوفات ريفن (اختبارات بصرية تُجرى غالبًا على البشر لقياس الذكاء). [31] [32]

يتبع DALL·E 3 إرشادات معقدة بدقة وتفصيل أكبر من سابقاته، وهو قادر على إنشاء نص أكثر تماسكًا ودقة. [33] [12] تم دمج DALL·E 3 في ChatGPT Plus. [12]
تعديل الصورة
في حالة وجود صورة موجودة، يمكن لبرنامج DALL·E 2 إنتاج "تنويعات" من الصورة كمخرجات فردية استنادًا إلى الأصل، فضلاً عن تحرير الصورة لتعديلها أو توسيعها. تستخدم خاصية "الطلاء الداخلي" و"الطلاء الخارجي" في برنامج DALL·E 2 السياق من الصورة لملء المناطق المفقودة باستخدام وسيط متوافق مع الأصل، باتباع موجه معين.
على سبيل المثال، يمكن استخدام هذا لإدراج موضوع جديد في صورة، أو توسيع صورة خارج حدودها الأصلية. [34] وفقًا لـ OpenAI، "تأخذ Outpainting في الاعتبار العناصر المرئية الموجودة في الصورة - بما في ذلك الظلال والانعكاسات والملمس - للحفاظ على سياق الصورة الأصلية." [35]
القيود الفنية
إن فهم لغة DALL·E 2 محدود. فهو أحيانًا غير قادر على التمييز بين "كتاب أصفر ومزهرية حمراء" و"كتاب أحمر ومزهرية صفراء" أو "باندا يصنع فن اللاتيه" و"فن اللاتيه لباندا". [36] فهو يولد صورًا لـ "رائد فضاء يمتطي حصانًا" عندما يُعرض عليه الموجه "حصان يمتطي رائد فضاء". [37] كما يفشل في توليد الصور الصحيحة في مجموعة متنوعة من الظروف. قد يؤدي طلب أكثر من ثلاثة أشياء، والنفي، والأرقام، والجمل المتصلة إلى أخطاء، وقد تظهر سمات الأشياء على الشيء الخطأ. [28] تشمل القيود الإضافية التعامل مع النص - والذي، حتى مع الحروف الواضحة، ينتج عنه دائمًا هراء يشبه الحلم - وقدرته المحدودة على معالجة المعلومات العلمية، مثل علم الفلك أو التصوير الطبي. [38]

المخاوف الأخلاقية
يؤثر اعتماد DALL·E 2 على مجموعات البيانات العامة على نتائجه ويؤدي إلى تحيز خوارزمي في بعض الحالات، مثل توليد أعداد أكبر من الرجال مقارنة بالنساء للطلبات التي لا تذكر الجنس. [38] تمت تصفية بيانات تدريب DALL·E 2 لإزالة الصور العنيفة والجنسية، ولكن وجد أن هذا يزيد من التحيز في بعض الحالات مثل تقليل تكرار توليد النساء. [39] تفترض OpenAI أن هذا قد يكون لأن النساء كن أكثر عرضة للتمييز الجنسي في بيانات التدريب مما تسبب في تأثير المرشح على النتائج. [39] في سبتمبر 2022، أكدت OpenAI لموقع The Verge أن DALL·E تُدرج عبارات بشكل غير مرئي في مطالبات المستخدم لمعالجة التحيز في النتائج؛ على سبيل المثال، يتم إدراج "رجل أسود" و"امرأة آسيوية" في مطالبات لا تحدد الجنس أو العرق. [40]
من بين المخاوف بشأن DALL·E 2 ونماذج توليد الصور المماثلة أنه يمكن استخدامها لنشر التزييف العميق وأشكال أخرى من المعلومات المضللة. [41] [42] وفي محاولة للتخفيف من ذلك، يرفض البرنامج المطالبات التي تتضمن شخصيات عامة والتحميلات التي تحتوي على وجوه بشرية. [43] يتم حظر المطالبات التي تحتوي على محتوى غير مرغوب فيه، ويتم تحليل الصور المحملة للكشف عن المواد المسيئة. [44] من عيوب التصفية القائمة على المطالبات أنه من السهل تجاوزها باستخدام عبارات بديلة تؤدي إلى إخراج مماثل. على سبيل المثال، يتم تصفية كلمة "دم"، ولكن لا يتم تصفية "كاتشب" و"سائل أحمر". [45] [44]
هناك قلق آخر بشأن DALL·E 2 والنماذج المماثلة وهو أنها قد تتسبب في بطالة تكنولوجية للفنانين والمصورين والمصممين الجرافيكيين بسبب دقتها وشعبيتها. [46] [47] تم تصميم DALL·E 3 لمنع المستخدمين من إنشاء أعمال فنية بأسلوب الفنانين الأحياء حاليًا. [12]
في عام 2023، اقترحت شركة مايكروسوفت على وزارة الدفاع الأمريكية استخدام نماذج DALL·E لتدريب نظام إدارة ساحة المعركة . [48] في يناير 2024، رفعت شركة OpenAI حظرها الشامل على الاستخدام العسكري والحربي من سياسات الاستخدام الخاصة بها. [49]
استقبال

تركز معظم تغطية DALL·E على مجموعة فرعية صغيرة من المخرجات "السريالية" [23] أو "الغريبة" [29] . تم ذكر مخرجات DALL-E عن "رسم توضيحي لفجل دايكون صغير يرتدي تنورة قصيرة يمشي مع كلب" في مقالات من Input و [50] NBC و [51] Nature و [52] ومنشورات أخرى. [5] [53] [54] كما تم تغطية مخرجاتها عن "كرسي بذراعين على شكل أفوكادو" على نطاق واسع. [23] [30]
صرحت شركة ExtremeTech "يمكنك أن تطلب من DALL·E صورة لهاتف أو مكنسة كهربائية من فترة زمنية محددة، وسوف يفهم كيف تغيرت هذه الأشياء". [26] كما أشارت Engadget إلى قدرتها غير العادية على "فهم كيف تتغير الهواتف والأشياء الأخرى بمرور الوقت". [27]
وفقًا لمجلة MIT Technology Review ، كان أحد أهداف OpenAI هو "إعطاء نماذج اللغة فهمًا أفضل للمفاهيم اليومية التي يستخدمها البشر لفهم الأشياء". [23]
حظي مستثمرو وول ستريت باستقبال إيجابي لـ DALL·E 2، حيث تعتقد بعض الشركات أنه قد يمثل نقطة تحول لصناعة مستقبلية تبلغ قيمتها عدة تريليونات من الدولارات. بحلول منتصف عام 2019، تلقت OpenAI بالفعل أكثر من مليار دولار في التمويل من Microsoft وKhosla Ventures، [55] [56] [57] وفي يناير 2023، بعد إطلاق DALL·E 2 وChatGPT، تلقت 10 مليارات دولار إضافية في التمويل من Microsoft. [58]
كان لمجتمع الرسوم المتحركة الياباني رد فعل سلبي تجاه DALL·E 2 والنماذج المماثلة. [59] [60] [61] يقدم الفنانون عادة حجتين ضد البرنامج. الأولى هي أن فن الذكاء الاصطناعي ليس فنًا لأنه لم يتم إنشاؤه بواسطة إنسان بقصد. "إن تقابل الصور التي تم إنشاؤها بواسطة الذكاء الاصطناعي مع أعمالهم الخاصة أمر مهين ويقوض الوقت والمهارة التي تدخل في فنهم. تعرضت أدوات إنشاء الصور التي يقودها الذكاء الاصطناعي لانتقادات شديدة من قبل الفنانين لأنها مدربة على فن من صنع الإنسان تم جمعه من الويب." [7] والثانية هي المشكلة المتعلقة بقانون حقوق النشر والبيانات التي يتم تدريب نماذج تحويل النص إلى صورة عليها. لم تصدر OpenAI معلومات حول مجموعة البيانات التي تم استخدامها لتدريب DALL·E 2، مما أثار مخاوف البعض من استخدام عمل الفنانين للتدريب دون إذن. قوانين حقوق النشر المحيطة بهذه الموضوعات غير حاسمة في الوقت الحالي. [8]
بعد دمج DALL·E 3 في Bing Chat وChatGPT، واجهت Microsoft وOpenAI انتقادات بسبب الإفراط في تصفية المحتوى، حيث قال المنتقدون إن DALL·E قد "خضع لعملية استئصال الفص الجبهي". [62] وقد تم الاستشهاد بتمييز الصور الناتجة عن مطالبات مثل "رجل يكسر رف الخادم بمطرقة ثقيلة" كدليل. خلال الأيام الأولى من إطلاقه، ورد أن التصفية زادت إلى الحد الذي تم فيه حظر الصور الناتجة عن بعض المطالبات المقترحة من Bing. [62] [63] زعم TechRadar أن الاعتماد بشكل كبير على جانب الحذر يمكن أن يحد من قيمة DALL·E كأداة إبداعية. [63]
تنفيذات مفتوحة المصدر
نظرًا لأن OpenAI لم تصدر كود المصدر لأي من النماذج الثلاثة، فقد كانت هناك محاولات عديدة لإنشاء نماذج مفتوحة المصدر تقدم قدرات مماثلة. [64] [65] تم إصدار Craiyon (المعروف سابقًا باسم DALL·E Mini حتى طلبت OpenAI تغيير الاسم في يونيو 2022) في عام 2022 على منصة Spaces الخاصة بـ Hugging Face ، وهو نموذج ذكاء اصطناعي يعتمد على DALL·E الأصلي الذي تم تدريبه على بيانات غير مفلترة من الإنترنت. وقد جذب انتباهًا إعلاميًا كبيرًا في منتصف عام 2022، بعد إصداره بسبب قدرته على إنتاج صور فكاهية. [66] [67] [68]
انظر أيضا
مراجع
- ^ ديفيد، إميليا (20 سبتمبر 2023). "OpenAI تصدر الإصدار الثالث من DALL·E". The Verge . مؤرشف من الأصل في 20 سبتمبر 2023 . تم الاسترجاع 21 سبتمبر 2023 .
- ^ "منصة OpenAI". platform.openai.com . مؤرشف من الأصل في 20 مارس 2023 . تم الاسترجاع 10 نوفمبر 2023 .
- ^ Niles, Raymond (10 نوفمبر 2023) [تم التحديث هذا الأسبوع]. "DALL-E 3 API". مركز مساعدة OpenAI . مؤرشف من الأصل في 10 نوفمبر 2023 . تم الاسترجاع في 10 نوفمبر 2023 .
- ^ مهدي، يوسف (21 سبتمبر 2023). "الإعلان عن Microsoft Copilot، رفيق الذكاء الاصطناعي اليومي الخاص بك". مدونة Microsoft الرسمية . مؤرشف من الأصل في 21 سبتمبر 2023. استرجاع 21 سبتمبر 2023 .
- ^ abcdef Johnson, Khari (5 يناير 2021). "OpenAI debuts DALL-E for generate images from text". VentureBeat. مؤرشف من الأصل في 5 يناير 2021 . تم الاسترجاع في 5 يناير 2021 .
- ^ "DALL·E 2". OpenAI . مؤرشف من الأصل في 6 أبريل 2022 . تم الاسترجاع 6 يوليو 2022 .
- ^ "DALL·E متوفر الآن في الإصدار التجريبي". OpenAI . 20 يوليو 2022. مؤرشف من الأصل في 20 يوليو 2022 . تم الاسترجاع 20 يوليو 2022 .
- ^ ab Allyn, Bobby (20 يوليو 2022). "سريالية أم حقيقية للغاية؟ أداة الذكاء الاصطناعي المذهلة DALL·E تأخذ صورها إلى مرحلة أكبر". NPR . مؤرشف من الأصل في 20 يوليو 2022 . تم الاسترجاع في 20 يوليو 2022 .
- ^ "قائمة انتظار DALL·E". labs.openai.com . مؤرشف من الأصل في 4 يوليو 2022 . تم الاسترجاع 6 يوليو 2022 .
- ^ "من أطفال ترامب الذين لا يهتمون إلى التزوير العميق: دال إي وأخلاقيات فن الذكاء الاصطناعي". الجارديان . 18 يونيو 2022. مؤرشف من الأصل في 6 يوليو 2022. تم الاسترجاع 6 يوليو 2022 .
- ^ "DALL·E متاح الآن بدون قائمة انتظار". OpenAI . 28 سبتمبر 2022. مؤرشف من الأصل في 4 أكتوبر 2022 . تم الاسترجاع 5 أكتوبر 2022 .
- ^ abcd "DALL·E 3". OpenAI . مؤرشف من الأصل في 20 سبتمبر 2023 . تم الاسترجاع 21 سبتمبر 2023 .
- ^ "واجهة برمجة تطبيقات DALL·E متاحة الآن في الإصدار التجريبي العام". OpenAI . 3 نوفمبر 2022. مؤرشف من الأصل في 19 نوفمبر 2022 . تم الاسترجاع 19 نوفمبر 2022 .
- ^ Wiggers, Kyle (3 نوفمبر 2022). "الآن يمكن لأي شخص إنشاء تطبيقات تستخدم DALL·E 2 لتوليد الصور". TechCrunch . مؤرشف من الأصل في 19 نوفمبر 2022 . تم الاسترجاع في 19 نوفمبر 2022 .
- ^ ab Coldewey, Devin (5 يناير 2021). "DALL-E من OpenAI يخلق صورًا معقولة لأي شيء تطلبه منه حرفيًا". مؤرشف من الأصل في 6 يناير 2021 . تم الاسترجاع في 5 يناير 2021 .
- ^ Growcoot, Matt (8 فبراير 2024). "صور الذكاء الاصطناعي المولدة على DALL-E تحتوي الآن على علامة أصالة المحتوى". PetaPixel . تم الاسترجاع في 4 أبريل 2024 .
- ^ رادفورد، أليك؛ ناراسيمهان، كارثيك؛ سليمانس، تيم؛ سوتسكيفر، إيليا (11 يونيو 2018). "تحسين فهم اللغة من خلال التدريب المسبق التوليدي" (PDF) . OpenAI . ص. 12. مؤرشف من الأصل (PDF) في 26 يناير 2021. تم الاسترجاع في 23 يناير 2021 .
- ^ "GPT-1 إلى GPT-4: شرح ومقارنة كل من نماذج GPT من OpenAI". 11 أبريل 2023. مؤرشف من الأصل في 15 أبريل 2023. تم الاسترجاع 29 أبريل 2023 .
- ^ رادفورد، أليك؛ وو، جيفري؛ تشايلد، ريوون؛ وآخرون (14 فبراير 2019). "نماذج اللغة هي متعلمون متعددو المهام غير خاضعين للإشراف" (PDF) . cdn.openai.com . 1 (8). مؤرشف من الأصل (PDF) في 6 فبراير 2021. تم الاسترجاع في 19 ديسمبر 2020 .
- ^ براون، توم ب.؛ مان، بنيامين؛ رايدر، نيك؛ وآخرون (22 يوليو 2020). "نماذج اللغة هي متعلمون من قِبَل عدد قليل من الناس". arXiv : 2005.14165 [cs.CL].
- ^ راميش، أديتيا؛ بافلوف، ميخائيل؛ جوه، غابرييل؛ وآخرون (24 فبراير 2021). "تحويل النص إلى صورة باستخدام تقنية Zero-Shot". arXiv : 2102.12092 [cs.LG].
- ^ abcdef Ramesh, Aditya; Dhariwal, Prafulla; Nichol, Alex; Chu, Casey; Chen, Mark (12 أبريل 2022). "توليد الصور المشروطة النصية الهرمية باستخدام CLIP Latents". arXiv : 2204.06125 [cs.CV].
- ^ abcd Heaven, Will Douglas (5 يناير 2021). "قد يكون هذا الكرسي المصنوع من الأفوكادو هو مستقبل الذكاء الاصطناعي". MIT Technology Review. مؤرشف من الأصل في 5 يناير 2021 . تم الاسترجاع في 5 يناير 2021 .
- ^ رادفورد، أليك؛ كيم، جونج ووك؛ هالاسي، كريس؛ وآخرون (1 يوليو 2021). تعلم النماذج المرئية القابلة للنقل من الإشراف على اللغة الطبيعية. وقائع المؤتمر الدولي الثامن والثلاثين حول التعلم الآلي. مجلة التعلم الآلي. ص 8748-8763.
- ^ Dunn, Thom (10 فبراير 2021). "هذه الشبكة العصبية للذكاء الاصطناعي تحول تعليقات النصوص إلى فن، مثل بيكاتشو قنديل البحر". BoingBoing . مؤرشف من الأصل في 22 فبراير 2021 . تم الاسترجاع 2 مارس 2021 .
- ^ ab Whitwam, Ryan (6 January 2021). "برنامج OpenAI's 'DALL-E' ينشئ صورًا من أوصاف نصية". ExtremeTech . مؤرشف من الأصل في 28 يناير 2021 . تم الاسترجاع 2 مارس 2021 .
- ^ ab Dent, Steve (6 يناير 2021). "تطبيق DALL-E من OpenAI يولد صورًا من مجرد وصف". Engadget . مؤرشف من الأصل في 27 يناير 2021 . تم الاسترجاع 2 مارس 2021 .
- ^ ab Marcus, Gary; Davis, Ernest; Aaronson, Scott (2 مايو 2022). "تحليل أولي للغاية لـ DALL-E 2". arXiv : 2204.13807 [cs.CV].
- ^ ab Shead, Sam (8 January 2021). "لماذا يتحدث الجميع عن مولد صور أصدره مختبر الذكاء الاصطناعي المدعوم من Elon Musk". CNBC . مؤرشف من الأصل في 16 يوليو 2022 . تم الاسترجاع 2 مارس 2021 .
- ^ ab Wakefield, Jane (6 January 2021). "AI draws dog-walking baby radish in a tutu". هيئة الإذاعة البريطانية . مؤرشف من الأصل في 2 مارس 2021. تم الاسترجاع 3 مارس 2021 .
- ^ ماركويتز، ديل (10 يناير 2021). "إليك كيفية عمل مولد الصور السحري DALL-E من OpenAI". TheNextWeb . مؤرشف من الأصل في 23 فبراير 2021. تم الاسترجاع 2 مارس 2021 .
- ^ "DALL·E: إنشاء صور من النص". OpenAI . 5 يناير 2021. مؤرشف من الأصل في 27 مارس 2021 . تم الاسترجاع 13 أغسطس 2022 .
- ^ إدواردز، بينج (20 سبتمبر 2023). "مولد الصور الجديد للذكاء الاصطناعي من OpenAI يدفع الحدود في التفاصيل والدقة الفورية". Ars Technica . مؤرشف من الأصل في 21 سبتمبر 2023 . تم الاسترجاع في 21 سبتمبر 2023 .
- ^ Coldewey, Devin (6 أبريل 2022). "أداة جديدة لرسم أي شيء، أكبر وأفضل من أي وقت مضى". TechCrunch . مؤرشف من الأصل في 6 مايو 2023 . تم الاسترجاع 26 نوفمبر 2022 .
- ^ "DALL·E: تقديم Outpainting". OpenAI . 31 أغسطس 2022. مؤرشف من الأصل في 26 نوفمبر 2022 . تم الاسترجاع 26 نوفمبر 2022 .
- ^ صحاريا، تشيتوان؛ تشان، ويليام؛ ساكسينا، سوراب؛ وآخرون (23 مايو 2022). "نماذج انتشار النص إلى الصورة الواقعية مع فهم اللغة العميق". arXiv : 2205.11487 [cs.CV].
- ^ ماركوس، غاري (28 مايو 2022). "ركوب الخيل لرائد فضاء". الطريق إلى الذكاء الاصطناعي الذي يمكننا أن نثق به . مؤرشف من الأصل في 19 يونيو 2022. استرجاع 18 يونيو 2022 .
- ^ ab Strickland, Eliza (14 يوليو 2022). "فشل DALL·E 2 هو الشيء الأكثر إثارة للاهتمام حوله". IEEE Spectrum . مؤرشف من الأصل في 15 يوليو 2022 . تم الاسترجاع في 16 أغسطس 2022 .
- ^ ab "DALL·E 2 Pre-Training Mitigations". OpenAI . 28 يونيو 2022. مؤرشف من الأصل في 19 يوليو 2022. تم الاسترجاع 18 يوليو 2022 .
- ^ جيمس فينسينت (29 سبتمبر 2022). "مولد الصور DALL·E من OpenAI متاح لأي شخص لاستخدامه على الفور". The Verge . مؤرشف من الأصل في 29 سبتمبر 2022 . تم الاسترجاع في 29 سبتمبر 2022 .
- ^ تايلور، جوش (18 يونيو 2022). "من أطفال ترامب الذين لا يهتمون إلى التزييف العميق: دال-إي وأخلاقيات فن الذكاء الاصطناعي". الجارديان . مؤرشف من الأصل في 6 يوليو 2022. تم الاسترجاع 2 أغسطس 2022 .
- ^ Knight, Will (13 July 2022). "عندما تصنع الذكاء الاصطناعي الفن، يزود البشر بالشرارة الإبداعية". Wired . مؤرشف من الأصل في 2 أغسطس 2022 . تم الاسترجاع 2 أغسطس 2022 .
- ^ روز، جانوس (24 يونيو 2022). "DALL-E يقوم الآن بإنشاء وجوه واقعية لأشخاص مزيفين". Vice . مؤرشف من الأصل في 30 يوليو 2022 . تم الاسترجاع 2 أغسطس 2022 .
- ^ من OpenAI (19 يونيو 2022). "معاينة DALL·E 2 – المخاطر والقيود". GitHub . مؤرشف من الأصل في 2 أغسطس 2022 . تم الاسترجاع 2 أغسطس 2022 .
- ^ لين، لورا (1 يوليو 2022). "دال-إي، اصنع لي بيكاسو آخر، من فضلك". النيويوركر . مؤرشف من الأصل في 2 أغسطس 2022. تم الاسترجاع 2 أغسطس 2022 .
- ^ جولدمان، شارون (26 يوليو 2022). "OpenAI: هل سيقتل DALL·E 2 المهن الإبداعية؟". مؤرشف من الأصل في 15 أغسطس 2022. تم الاسترجاع 16 أغسطس 2022 .
- ^ Blain, Loz (29 يوليو 2022). "DALL-E 2: أداة حلم وتهديد وجودي للفنانين التشكيليين". مؤرشف من الأصل في 17 أغسطس 2022 . تم الاسترجاع 16 أغسطس 2022 .
- ^ بيدل، سام (10 أبريل 2024). "مايكروسوفت تقترح برنامج DALL-E التابع لشركة OpenAI كأداة في ساحة المعركة للجيش الأمريكي". The Intercept .
- ^ بيدل، سام (12 يناير 2024). "OpenAI تحذف بهدوء الحظر على استخدام ChatGPT لـ"الأغراض العسكرية والحربية"". The Intercept .
- ^ كاسانا، مهرين (7 يناير 2021). "هذا الذكاء الاصطناعي يحول النص إلى فن سريالي يعتمد على الاقتراح". مدخل. مؤرشف من الأصل في 29 يناير 2021 . تم الاسترجاع 2 مارس 2021 .
- ^ إيرينكرانز، ميلاني (27 يناير 2021). "ها هو دال-إي: خوارزمية تعلمت رسم أي شيء تخبرها به". إن بي سي نيوز . مؤرشف من الأصل في 20 فبراير 2021. تم الاسترجاع 2 مارس 2021 .
- ^ ستوف، إيما (5 فبراير 2021). "سيرك بطيئات الخطو وشجرة الحياة - أفضل صور العلوم لشهر يناير". الطبيعة . مؤرشف من الأصل في 8 مارس 2021. استرجاع 2 مارس 2021 .
- ^ Knight, Will (26 January 2021). "This AI Could Go From 'Art' to Steering a Self-Driving Car". Wired . مؤرشف من الأصل في 21 فبراير 2021 . تم الاسترجاع 2 مارس 2021 .
- ^ ميتز، راشيل (2 فبراير 2021). "فجل يرتدي تنورة قصيرة يمشي مع كلب؟ هذا الذكاء الاصطناعي يمكنه رسمه بشكل جيد حقًا". سي إن إن. مؤرشف من الأصل في 16 يوليو 2022. تم الاسترجاع 2 مارس 2021 .
- ^ Leswing, Kif (8 أكتوبر 2022). "لماذا يشعر وادي السيليكون بالإثارة الشديدة تجاه الرسومات المحرجة التي أنجزها الذكاء الاصطناعي". CNBC . مؤرشف من الأصل في 29 يوليو 2023 . تم الاسترجاع 1 ديسمبر 2022 .
- ^ إيثرينغتون، داريل (22 يوليو 2019). "مايكروسوفت تستثمر مليار دولار في OpenAI في شراكة جديدة متعددة السنوات". TechCrunch . مؤرشف من الأصل في 22 يوليو 2019. تم الاسترجاع 21 سبتمبر 2023 .
- ^ "أول داعم لـ OpenAI من رأس المال الاستثماري يزن في مجال الذكاء الاصطناعي التوليدي" Fortune . مؤرشف من الأصل في 23 أكتوبر 2023 . تم الاسترجاع في 21 سبتمبر 2023 .
- ^ ميتز، كيد؛ وايز، كارين (23 يناير 2023). "مايكروسوفت تستثمر 10 مليارات دولار في OpenAI، مبتكر ChatGPT". نيويورك تايمز . ISSN 0362-4331. مؤرشف من الأصل في 21 سبتمبر 2023. تم الاسترجاع في 21 سبتمبر 2023 .
- ^ "فن تم إنشاؤه بواسطة الذكاء الاصطناعي يثير ردود فعل غاضبة من مجتمع الرسوم المتحركة الياباني". بقية العالم . 27 أكتوبر 2022. مؤرشف من الأصل في 31 ديسمبر 2022. تم الاسترجاع 3 يناير 2023 .
- ^ روز، كيفن (2 سبتمبر 2022). "صورة تم إنشاؤها بواسطة الذكاء الاصطناعي فازت بجائزة فنية. الفنانون ليسوا سعداء". نيويورك تايمز . ISSN 0362-4331. مؤرشف من الأصل في 31 مايو 2023. تم الاسترجاع 3 يناير 2023 .
- ^ داوز، رايان (15 ديسمبر 2022). "زيادة ردود الفعل العنيفة تجاه ArtStation بعد استجابة احتجاجية فنية من قبل الذكاء الاصطناعي". أخبار الذكاء الاصطناعي . مؤرشف من الأصل في 3 يناير 2023. تم الاسترجاع في 3 يناير 2023 .
- ^ ab Corden, Jez (8 أكتوبر 2023). "كان إنشاء صورة Bing Dall-E 3 رائعًا لبضعة أيام، ولكن الآن قامت Microsoft بإجراء استئصال جزئي للمخ كما كان متوقعًا". Windows Central . مؤرشف من الأصل في 10 أكتوبر 2023 . تم الاسترجاع في 11 أكتوبر 2023 .
- ^ ab Allan, Darren (9 أكتوبر 2023). "Microsoft reins in Bing AI's Image Creator – and the results don't make much sense". TechRadar . مؤرشف من الأصل في 10 أكتوبر 2023 . تم الاسترجاع في 11 أكتوبر 2023 .
- ^ سحر مور، سترايب (16 أبريل 2022). "كيف يمكن لـ DALL-E 2 حل تحديات الرؤية الحاسوبية الكبرى". VentureBeat . مؤرشف من الأصل في 24 مايو 2022. تم الاسترجاع 15 يونيو 2022 .
- ^ "jina-ai/dalle-flow". Jina AI. 17 يونيو 2022. مؤرشف من الأصل في 17 يونيو 2022. تم الاسترجاع 17 يونيو 2022 .
- ^ كارسون، إيرين (14 يونيو 2022). "كل ما تريد معرفته عن Dall-E Mini، منشئ الفن بالذكاء الاصطناعي المذهل". CNET . مؤرشف من الأصل في 15 يونيو 2022. تم الاسترجاع 15 يونيو 2022 .
- ^ شرودر، أودرا (9 يونيو 2022). "برنامج الذكاء الاصطناعي DALL-E mini يعرض بعض الصور الملعونة حقًا". Daily Dot . مؤرشف من الأصل في 10 يونيو 2022. تم الاسترجاع في 15 يونيو 2022 .
- ^ دياز، آنا (15 يونيو 2022). "الناس يستخدمون DALL-E mini لصنع ميمات بشعة — مثل بيكاتشو البج". بوليجون . مؤرشف من الأصل في 15 يونيو 2022. تم الاسترجاع 15 يونيو 2022 .
روابط خارجية
- راميش، أديتيا؛ بافلوف، ميخائيل؛ جو، غابرييل؛ جراي، سكوت؛ فوس، تشيلسي؛ رادفورد، أليك؛ تشين، مارك؛ سوتسكيفر، إيليا (26 فبراير 2021). "توليد النص إلى صورة باستخدام تقنية Zero-Shot". arXiv : 2102.12092 [cs.CV].. التقرير الأصلي عن DALL-E.
- بطاقة نظام DALL-E 3
- ورقة بحثية من DALL-E 3 من OpenAI
- موقع DALL-E 2
- موقع كرايون

_artificial_intelligence_icon.png/440px-Dall-e_3_(jan_'24)_artificial_intelligence_icon.png)