
مولد الصور GPT-4o
يُعد إنشاء الصور بواسطة GPT-4o ميزة جديدة ومتقدمة قامت OpenAI بدمجها بشكل أصلي في نموذج GPT-4o. هذا المولد للصور من ChatGPT، وهو أكثر تقدمًا من نموذج DALL·E 3، يُمكّن المستخدمين من إنشاء وتحرير الصور مباشرة داخل ChatGPT من خلال مطالبات اللغة الطبيعية والتنقيح الحواري. جرّب نموذج GPT-4o في مولد الصور Pollo AI الآن!
الميزات الرئيسية لتوليد الصور باستخدام GPT-4o
- صور عالية الدقة والتفاصيل : يتعامل مع المشاهد المعقدة التي تحتوي على عناصر متعددة مع الحفاظ على الوضوح والواقعية والعلاقات المكانية الدقيقة.
- دعم أنماط صور متعددة : ينتج صورًا واقعية وفنية ورسومًا متحركة مستوحاة من الأنمي بناءً على توجيهك الإبداعي.
- عرض دقيق للنصوص : يُنشئ نصًا واضحًا ومقروءًا للرسوم البيانية واللافتات والقصص المصورة وغيرها من العناصر المرئية التي تحتوي على نصوص كثيرة.
- تحرير الصور التفاعلي وتحويلها : يعمل على تحسين الصور المرفوعة من خلال تعديلات حوارية مع الحفاظ على التناسق عبر جولات متعددة.
- الوعي السياقي واستخدام المعرفة : يطبق المعرفة الواقعية والمراجع الثقافية لإنتاج صور متماسكة وذات معنى سياقي.
صور عالية الدقة والتفاصيل
يستطيع GPT-4o توليد صور تحتوي على العديد من العناصر المتميزة - ما يصل إلى 10-20 عنصرًا - مع الحفاظ على الوضوح والواقعية. تدعم هذه القدرة المشاهد المعقدة التي تتضمن شخصيات وعناصر وخلفيات متعددة، يتم عرض كل منها بتفاصيل مناسبة وعلاقات مكانية دقيقة.
| اِسْتَدْعَى | الصورة الناتجة |
| صورة مربعة تحتوي على شبكة من 4 صفوف و4 أعمدة تضم 16 عنصرًا على خلفية بيضاء. ابدأ من اليسار إلى اليمين، ومن الأعلى إلى الأسفل. إليك القائمة: | ![]() |
| أرني كأس نبيذ فيه قطرة صغيرة جداً من النبيذ الأحمر. | ![]() |
| نحتاج إلى دليل على وجود فيل غير مرئي موجود حاليًا. فكّر في ماهية الفيل ودوره في البيئة، ثم أظهر لنا ذلك، ربما في منتصف العملية - لكن الفيل نفسه لا يظهر على الإطلاق. | ![]() |
دعم أنماط صور متعددة
يدعم نموذج توليد الصور GPT-4o نطاقًا واسعًا ومتنوعًا من أنماط الصور، مما يجعله قابلاً للتكيف بدرجة عالية مع مختلف الاحتياجات الإبداعية والعملية. يتفوق هذا النموذج في إنتاج صور واقعية للغاية، أو أنماط فنية، أو رسومات كرتونية، وذلك حسب التوجيهات.
ربما ما يجعل ميزة توليد الصور في GPT-4o شائعة جدًا هو قدرتها على توليد أنماط الأنمي المعروفة، بما في ذلك ستوديو جيبلي ، وساوث بارك، وذا سيمبسونز، وغيرها.
| مدخل | استوديو جيبلي | ساوث بارك | عائلة سيمبسون |
![]() | ![]() | ![]() | ![]() |
عرض دقيق للنصوص
من أبرز قدرات نموذج GPT-4o في توليد الصور قدرته على عرض النصوص داخل الصور بوضوح ودقة، وهو تحدٍ معروف في نماذج توليد الصور السابقة. وهذا يتيح إنشاء الرسوم البيانية، واللافتات، أو أي صورة تتطلب نصًا مقروءًا.
| اِسْتَدْعَى | الصورة الناتجة |
قصيدة مغناطيسية على ثلاجة في منزل من منتصف القرن العشرين: السطر 1: "صورة" السطر الثاني: "تستحق" السطر 3: "ألف كلمة"، السطر 4: "لكن أحيانًا" فجوة كبيرة السطر 5: "في المكان المناسب" السطر 6: "يمكن رفعه" السطر 7: "معناه". "الرجل يحمل عبارة "قليل" في يده اليمنى وكلمة "كلمات" في يده اليسرى." | ![]() |
ارسم صورة لشريط مكون من أربعة أجزاء، مع بعض الحشو حول الحدود: يوجد حلزون صغير عند منضدة عرض سيارات فاخرة. انحنى البائع فوق المنضدة حتى يتمكن من رؤيته. لقطة مقرّبة للحلزون وهو يبدو جادًا للغاية. يقول: "أريد سيارتك الرياضية الأسرع... وأريدك أن ترسم حرف "S" كبيرًا على الأبواب وغطاء المحرك والسقف." البائع يحك رأسه. "همم... يمكننا فعل ذلك، ولكن لماذا حرف السين؟" ينتقل المشهد فجأة إلى سيارة حمراء سريعة تنطلق على الطريق السريع. السيارة الرياضية مغطاة بشعارات ضخمة على شكل حرف S. الناس على الرصيف يشيرون إليها ويضحكون: "يا إلهي! انظروا إلى تلك السيارة الرياضية وهي تنطلق!" | ![]() |
| رسم بياني يشرح تجربة نيوتن بالمنشور بتفصيل كبير | ![]() |
تحرير الصور التفاعلي وتحويلها
يمكن للمستخدمين تحميل الصور الموجودة وتوجيه GPT-4o لتعديلها أو تحويلها، مثل إزالة الانعكاسات أو تغيير الخلفيات أو تطبيق تغييرات أسلوبية، مما يجعلها مفيدة لمهام تحرير الصور العملية التي تتجاوز إنشاء الصور من الصفر.
يدعم توليد الصور GPT-4o أيضًا التفاعلات متعددة الأدوار، مما يعني أنه يمكن للمستخدمين تحسين الصور من خلال الحوار المستمر، وطلب التغييرات أو التحسينات لتتناسب بشكل أفضل مع رؤيتهم.
| جيل راوند | إدخال المستخدم | الصورة الناتجة |
| الجولة الأولى | ![]() أعطِ هذه القطة قبعة محقق ونظارة أحادية العدسة | ![]() |
| الجولة الثانية | حوّل هذا إلى لعبة فيديو من الفئة AAA مصنوعة بمحرك ألعاب بدقة 4K، وأضف واجهة مستخدم كطبقة علوية من لعبة تقمص أدوار غامضة، حيث يمكننا رؤية شريط الصحة وخريطة مصغرة في الأعلى، بالإضافة إلى التعاويذ في الأسفل، مع تناسق ورموز مميزة. | ![]() |
| الجولة الثالثة | تحديث الصورة إلى صورة أفقية بنسبة عرض إلى ارتفاع 16:9، وإضافة المزيد من التعاويذ في واجهة المستخدم، وتصغير الصورة بحيث نرى القطة من منظور الشخص الثالث وهي تتجول في مانهاتن ذات الطابع البخاري، مما يخلق تباينًا وإضاءةً جميلين كما في أفضل ألعاب AAA، بألوان باردة. | ![]() |
| الجولة الرابعة | قم بإنشاء واجهة عندما يفتح اللاعب القائمة ونرى ملف تعريف شخصية القط مع معداته وصفحة أخرى تعرض المهام النشطة (ويجب أن يكون ذلك منطقيًا فيما يتعلق ببناء عالم الكون الذي نصفه في الصورة). | ![]() |
الوعي السياقي واستخدام المعرفة
يستفيد GPT-4o من تدريبه المكثف على اللغة ومعرفة العالم لإنتاج صور ليست متماسكة بصريًا فحسب، بل ذات معنى سياقي أيضًا. فهو يفهم الإشارات إلى الأشياء والأنماط والعناصر الثقافية في العالم الحقيقي، ويمكنه دمجها بذكاء في الصور.
وهذا يُمكّن من إنشاء صور تتوافق مع مواضيع محددة أو فترات تاريخية أو حركات فنية، مما يعزز الصلة والعمق.
| جيل راوند | إدخال المستخدم | الصورة الناتجة |
| الجولة الأولى | ![]() ارسم تصميمًا لمركبة ذات عجلات مثلثة، مستخدمًا هذه الصور كمرجع. قم بتسمية العجلة الأمامية والعجلة الخلفية، وفي نهاية الرسم التخطيطي اكتب (بحروف صغيرة) مركبة ذات عجلات مثلثة. براءة اختراع إنجليزية. 2025. OpenAI. | ![]() |
| الجولة الثانية | والآن ضع هذا في صورة تم التقاطها في مدينة نيويورك. | ![]() |

كيفية استخدام GPT-4o على Pollo AI
حدد طراز GPT-4o
انتقل إلى مولد صور Pollo AI وحدد GPT-4o من قائمة النماذج.
أدخل صورتك وأرسلها
قم بتحميل صورتك، وأدخل النص المطلوب، ثم اضبط إعدادات التوليد.
ابدأ جيلك
انقر فوق "إنشاء" لبدء إنشاء الصور باستخدام GPT-4o.
استكشف المزيد من نماذج الصور المدعومة بالذكاء الاصطناعي من OpenAI
الأسئلة الشائعة
ما هو إنشاء صورة GPT-4o ؟
إنشاء صور GPT-4o ميزة متعددة الوسائط أصلية في نموذج GPT-4o ، تتيح للمستخدمين إنشاء الصور وتحريرها مباشرةً عبر أوامر اللغة الطبيعية في ChatGPT. يدعم إنشاء صور مفصلة وواقعية ومتنوعة أسلوبيًا، مع عرض نص دقيق مُدمج في الصور.
ما هي أنواع أنماط الصور التي يمكن لبرنامج GPT-4o إنشاؤها؟
يدعم GPT-4o مجموعة واسعة من الأنماط، بما في ذلك الأنماط الواقعية، والفنية (الألوان المائية، والرسم الزيتي، والرسومات التخطيطية)، والأنماط الفنية المُصممة (السايبربانك، والأنمي)، والرسوم البيانية ذات النصوص الواضحة، والصور عالية الدقة الجاهزة للإنتاج. ويمكنه تعديل النمط بناءً على إشارات بسيطة مثل "حيوي" أو "طبيعي" أو "سينمائي".
كيف يمكنني الوصول إلى إنشاء صورة GPT-4o؟
يتوفر إنشاء صور GPT-4o افتراضيًا لمستخدمي ChatGPT Plus وPro وTeam. غير متوفر حاليًا في النسخة المجانية نظرًا للإقبال الشديد. سيتمكن المطورون قريبًا من الوصول إليه عبر واجهة برمجة تطبيقات OpenAI.
إذا كنت تبحث عن طريقة سهلة وسلسة للوصول إلى GPT-4o، يمكنك تجربته على Pollo AI. إنه مولد صور وفيديوهات متكامل يعمل بالذكاء الاصطناعي، ويتيح لك استخدام أفضل نماذج الصور المدعومة بالذكاء الاصطناعي على منصة واحدة، بما في ذلك GPT-4o و Recraft و Flux و Imagen و Stable Diffusion وغيرها.
هل هناك أي قيود أو مشكلات معروفة مع إنشاء صورة GPT-4o؟
نعم، تتضمن بعض قيود إنشاء صور GPT-4o الهلوسة أو اختلاق المعلومات، وصعوبة إنشاء الرسوم البيانية الدقيقة، وتقديم النصوص متعددة اللغات، ودقة التحرير غير المتسقة، والمزيد.
هل يضيف GPT-4o أي بيانات وصفية للصور المولدة؟
نعم، يقوم GPT-4o تلقائيًا بتضمين علامات بيانات C2PA في الصور المولدة للإشارة إلى أصل الذكاء الاصطناعي، مما يعزز الشفافية ويساعد المنصات في تحديد المحتوى الذي تم إنشاؤه بواسطة الذكاء الاصطناعي.






















