2026-06-30 · تم التحديث في 2026-07-12
مولدات الصور بالذكاء الاصطناعي مفتوحة المصدر في 2026: أي نموذج هو الأفضل؟
قارن بين مولدات الصور مفتوحة المصدر بالذكاء الاصطناعي التي يستخدمها الناس فعليًا في 2026 — مثل Qwen-Image و Z-Image و Flux 2 و Ideogram 4 — بناءً على الترخيص، والأجهزة، وأفضل استخدام لكل منها.

آخر تحديث: July 12, 2026
تُعد مولدات الصور المغلقة مثل Nano Banana Pro و GPT Image 2 مريحة، لكنها تبقي عملك على خادم شخص آخر، وتقيس عمليات التوليد الخاصة بك، وتدفن شروط الترخيص في فقرة وافقت عليها دون قراءة. في عام 2026، تطورت النماذج مفتوحة المصدر لتصل إلى نقطة يمكن فيها لصانع يستخدم جهاز كمبيوتر محمول مزود بـ RTX 4090 إنتاج صورة عمودية بدقة 1088×1920 جيدة بما يكفي للتحريك — ومن ثم تسويقها تجاريًا دون طلب إذن أحد. يقارن هذا الدليل بين نماذج الصور الأربعة المفتوحة أو مفتوحة الوزن التي يلجأ إليها الناس بالفعل، ويخبرك أي منها تختار للمهمة المطلوبة.
الإجابة السريعة: ما هو مولد الصور مفتوح المصدر الذي يجب أن أستخدمه؟
الأمر يعتمد على المهمة، ولكن التقسيم العملي في منتصف عام 2026 هو كالتالي:
- أفضل قيمة + ترخيص مفتوح حقيقي: Qwen-Image أو Z-Image (Apache 2.0). استخدم هذه عند الحاجة إلى بيع المخرجات، أو طباعتها، أو ترخيصها، أو عندما تريد وجوهًا متسقة عبر مجموعة من الصور.
- الأفضل للتخطيط والنص والتحكم: Ideogram 4. استخدم هذا عندما تحتاج الصورة إلى كلمات مقروءة، أو تكوين محدد، أو إطار قصة مصورة ستقوم بتحريكه لاحقًا.
- الأفضل للتحرير والتنقيح الدقيق: Flux 2 (Klein). استخدم هذا لعمل img2img، وتدريب LoRA، والالتزام بالتعليمات في المطالبات الطويلة.
- الخيار السحابي الأكثر أمانًا إذا كنت لا تريد تثبيت أي شيء: Nano Banana Pro — لكنه مغلق، وليس مفتوح المصدر، لذا فهو لا ينتمي إلى مسار عمل محلي.
سبب أهمية Apache 2.0 أكثر من درجة المعيار: باستخدام Qwen و Z-Image، يمكنك تسويق المخرجات في منتج مدفوع، وتدريب المزيد عليه، وإعادة توزيعه. يقوم العديد من المنافسين "ذوي الأوزان المفتوحة" بتقييد الاستخدام التجاري في شروطهم، وهي مشكلة لا تكتشفها إلا عندما يسأل العميل عن مالك العمل الفني.
كيف يختلف هذا عن Midjourney أو GPT Image 2؟
التمييز الذي يغير سير عملك فعليًا هو مكان تشغيل النموذج وما يُسمح لك بفعله بالمخرجات، وليس رقم الجودة الرئيسي.
| النموذج | أين يعمل | الترخيص | يكلّف مالًا للتشغيل؟ |
|---|---|---|---|
| Qwen-Image / Z-Image | وحدة معالجة الرسومات لديك، عبر ComfyUI | Apache 2.0 | كهرباؤك فقط |
| Flux 2 (Klein) | وحدة معالجة الرسومات لديك، عبر ComfyUI | غير تجاري على بعض الأوزان؛ تحقق من الإصدار | كهرباء + بعض نقاط التفتيش المدفوعة |
| Ideogram 4 | API سحابي، بعض البناءات المحلية | تنطبق شروط الخدمة | ائتمانات API |
| Midjourney / GPT Image 2 | سحابة المورّد فقط | يمتلك المورّد حقوق المخرجات، خاضعة للسياسة | اشتراك شهري |
الصف الخاص بالمصادر المفتوحة هو الذي يكون فيه انقطاع التيار الكهربائي هو الشيء الوحيد الفاصل بينك وبين مزرعة العرض الخاصة بك. أما الصف السحابي فهو الذي يمكن أن يغير تحديث شروط الخدمة ما يُسمح لك بفعله بحملة الشهر الماضي.

Qwen-Image و Z-Image: الخيول العاملة بترخيص Apache 2.0
يتم اختيار هذين النموذجين على Flux للعمل التجاري تحديدًا لأنه، كما ذكر أحد صانعي r/StableDiffusion، باستخدام Apache 2.0 "يمكنك عمل أي شيء تقريبًا تريده". هذه ليست عبارة تسويقية — بل هي نص الترخيص.
ما هما جيدان فيه حقًا:
- اتساق الوجه. يحافظ Qwen-Image على وجه الشخص عبر أجيال متعددة أفضل من معظم النماذج المفتوحة، ولهذا يظهر في لوحات القصص المصورة القائمة على الشخصيات ومجموعات الإعلانات حيث يظهر نفس الشخص في كل إطار.
- التصوير الواقعي. الإجماع في r/StableDiffusion حول Z-Image واضح: "ربما الأفضل لتزييف الصور". إذا كنت بحاجة إلى صور تبدو كصور فوتوغرافية حقيقية وليست مجرد عروض AI، فإن Z-Image هو محطتك الأولى.
- القيمة. لا يكلف تشغيل واحد على GPU محلي سوى الطاقة، والنماذج صغيرة بما يكفي لتناسب الأجهزة الاستهلاكية.
العلة الصادقة: لا يوجد أي من النموذجين أفضل في عرض نص مقروء داخل الصورة، وليس لأي منهما التحكم الدقيق بالمطالبة مثل Ideogram. إذا كانت ملصقتك تحتاج إلى عنوان مكتوب بالكامل، فقم بتوليد الصورة هنا وأضف النص في محرر.
Ideogram 4: خيار التحكم وعرض النصوص
عندما تكون المهمة هي "ضع هذه الكلمات بالضبط على هذه اللافتة، بهذا التخطيط"، فإن Ideogram 4 هو النموذج الذي يلجأ إليه الناس، ويعكس حكم r/StableDiffusion — "الأفضل بلا منازع للتحكم" — مدى تكرار استخدامه كخطوة أولى في مسار عمل أكبر.
سير العمل الذي جعله مهيمنًا هذا الشهر هو الصورة أولاً، والتحريك ثانيًا. يقوم المبدع بإنشاء لوحات قصصية لكل فيديو AI كمسودة باللون الرمادي، ويختار من بين أربعة نماذج صور لتوليد الصورة الثابتة، وبعد ذلك فقط يحرك الإطار باستخدام نموذج فيديو. المنطق، وفقًا لـ "خيط لوحة القصص المصورة" على r/StableDiffusion: "أرخص مكان لإصلاح فيديو AI هو قبل أن يصبح فيديو". يقع Ideogram 4 في مرحلة الإصلاح الأرخص هذه لأن التحكم في التخطيط يسمح لك بتثبيت التكوين قبل وجود اللقطات.
استخدمه عندما:
- تحتاج إلى نص مقروء ومكتوب بشكل صحيح داخل الصورة.
- أنت تبني إطارات لوحات قصصية ستقوم بتحريكها لاحقًا.
- يهم التكوين وتوزيع الشبكة أكثر من الواقعية الفوتوغرافية.
Flux 2 (Klein): التحرير وتدريب LoRA
Flux 2 هو خيار التحرير و img2img، ووفقًا لمعايير DigitalOcean، يتفوق في الالتزام بالمطالبات للمطالبات الطويلة والمحددة. وهذا يجعله النموذج الذي تلجأ إليه عندما لديك بالفعل صورة وتريد تغيير جزء منها، أو عندما تريد تدريب LoRA على منتجك الخاص أو شخصيتك وإعادة نشره.

السبب وراء هيمنة Flux على محادثات LoRA هو النظام البيئي: المزيد من LoRAs المجتمعية، والمزيد من أدلة التدريب، والمزيد من عُقد ComfyUI المبنية حوله. إذا كان "تدريب نموذج صغير على صور منتجات علامتي التجارية" ضمن قائمتك، فابدأ بـ Flux وتقبل أن بعض الأوزان تحمل شروطًا غير تجارية يجب عليك قراءتها قبل التسويق.
ما هي مكونات الأجهزة التي أحتاجها لتشغيل هذه النماذج؟
هذا هو السؤال الذي يحدد ما إذا كان المصدر المفتوح قابلاً للتطبيق بالنسبة لك على الإطلاق. الخبر السار من الـ 30 يومًا الماضية من التجميعات المجتمعية هو أن الحد الأدنى قد انخفض.
| الإعداد | ما يمكنك تشغيله | VRAM التقريبي |
|---|---|---|
| حاسوب محمول RTX 4090، 16 جيجابايت | Qwen-Image، Z-Image، بالإضافة إلى تحريك فيديو LTX | 16 جيجابايت |
| سطح مكتب RTX 4090، 24 جيجابايت | كل النماذج الأربعة، Flux مع LoRAs، دفعات أكبر | 24 جيجابايت |
| ماك (Apple Silicon) | بناءات مكمّمة أصغر عبر off-grid-ai وما شابه | ذاكرة موحدة |
| استئجار GPU سحابي | كل شيء، يُفوتر بالساعة | متغير |
قام صانع في r/StableDiffusion بتوليد صورة عمودية كاملة بدقة 1088×1920 باستخدام Ideogram 4 وحركها محليًا باستخدام LTX 2.3 المقطر على جهاز كمبيوتر محمول مزود بـ 4090 وذاكرة VRAM تبلغ 16 GB، واصفًا إياه بأنه عمل "كان مستحيلاً قبل بضع سنوات". هذه هي الإشارة الحقيقية: المصدر المفتوح لم يعد مجرد هواية مقتصرة على سطح المكتب.
كيف أبدأ باستخدام ComfyUI؟
ComfyUI هو المركز الجاذبي للعمل المحلي الجاد في مجال الصور في عام 2026. يعتمد كل من InvokeAI واستوديو Pallaidium Blender عليه، ويتم تبادل معظم مسارات العمل كرسوم بيانية لعُقد ComfyUI. يبدو البدء البسيط كالتالي:
- تثبيت ComfyUI من إصدار GitHub الخاص به.
- تنزيل أوزان النموذج التي تحتاجها — Qwen-Image أو Z-Image لقاعدة Apache 2.0.
- وضع الأوزان في دليل نماذج ComfyUI.
- تحميل مسار عمل مجتمعي لذلك النموذج (يتم مشاركتها كملفات
.json). - العرض، والتكرار على المطالبة، والتصدير.
إذا كان تثبيت الأسلاك والعُقد يبدو أكثر مما ترغب فيه، فلا تزال المولدات السحابية موجودة — لكن المقايضة هي بالضبط ما ورد في الجدول أعلاه: الراحة مقابل حقوق المخرجات وتكلفة كل عملية توليد. للحصول على شرح أعمق للنموذج الذي بدأ موجة التوليد المحلي، يغطي دليلنا Stable Diffusion تفاصيل الإعداد.
ماذا أفعل بالصور بعد أن أقوم بتوليدها؟
نادراً ما تكون الصورة التي يتم توليدها مباشرة من ComfyUI جاهزة للويب. غالبًا ما تقوم النماذج المحلية بالتصدير بأبعاد غريبة أو كملفات PNG كبيرة، وعادةً ما تحتاج مجموعة البورتريه التي تم إنشاؤها باستخدام Qwen أو Z-Image إلى ثلاثة إصلاحات سريعة قبل أن يتم تسويقها.

الخطوات النهائية المهمة:
- زيادة الحجم (Upscale). تبدو الصورة التي دقتها 1024px ناعمة على شاشة Retina. يقوم أداة تكبير الصور بتكبيرها دون التلطخ الذي ينتجه التحجيم التربيعي، وبالنسبة لعمل الطباعة، يشرح الدليل الكامل لزيادة الحجم متى يجب اللجوء إلى Real-ESRGAN.
- التحويل إلى WebP. مرر ملف PNG عبر أداة تحويل الصيغ حتى يستقر الملف على موقعك بحجم ثلث البايتات. أصبح WebP آمنًا الآن لكل متصفح حالي، حيث توثق وثائق MDN ذلك في مرجع أنواع ملفات الصور.
- الضغط. قم بتشغيل الدفعة عبر أداة ضغط الصور قبل التحميل — وزن الصفحة هو أكبر رافعة لتحديد مدى سرعة تحميل معرض أعمالك بالصور المُولدة.
سبب أهمية ذلك: الصورة المولدة التي يتم تسويقها بحجم 6 MB تحمل ببطء، وتحتل مرتبة سيئة، وتضيع الساعات التي قضيتها في كتابة المطالبات. مسار العمل "التوليد ثم الإنهاء" هو المكان الذي تكمن فيه معظم الوفورات العملية للوقت.
ائتمانات الصور
- Close-up of a MacBook Pro with Adobe Illustrator open on a desk — photo by Luca Sammarco على Pexels
- From above of an artist drawing a creative sketch on a graphics tablet — photo by Michael Burrows على Pexels
- Detailed view of source code on a computer monitor — photo by Digital Buggu على Pexels
الأسئلة المتكررة
ما أفضل مولّد صور مفتوح المصدر في 2026؟
لا يوجد نموذج واحد هو الأفضل: يتفوّق Qwen-Image وZ-Image في الترخيص والقيمة، ويتفوّق Ideogram 4 في النص والتحكم بالتخطيط، ويتفوّق Flux 2 في التحرير وتدريب LoRA.
أي مولّد مفتوح المصدر له الترخيص الأكثر تساهلًا؟
يصدر Qwen-Image وZ-Image تحت Apache 2.0، ما يتيح بيع المخرجات والتدريب عليها وإعادة توزيعها دون إذن من أحد.
هل Flux 2 مجاني للاستخدام التجاري؟
ليس دائمًا — بعض أوزان Flux 2 (Klein) تحمل شروطًا غير تجارية، لذا تحقّق من ترخيص الإصدار المحدد قبل تسليم عمل مدفوع.
ما بطاقة الرسوميات المطلوبة لتشغيل هذه النماذج؟
بطاقة RTX 4090 للحاسوب المحمول بذاكرة 16 غيغابايت تشغّل Qwen-Image وZ-Image بأريحية، وبطاقة مكتبية بذاكرة 24 غيغابايت تستوعب النماذج الأربعة إضافة إلى LoRA الخاصة بـ Flux.
هل يمكن تشغيلها على جهاز Mac؟
نعم، تعمل النسخ المكمَّمة الأصغر على الذاكرة الموحّدة في Apple Silicon عبر أدوات مثل off-grid-ai، لكن بخيارات أقل مقارنة ببطاقة CUDA.
أي نموذج أستخدم للنص داخل الصورة؟
Ideogram 4 هو الخيار للنص المقروء والمكتوب إملائيًا بشكل صحيح، مع تحكم دقيق بالتخطيط.
ما الفرق بين Qwen-Image وIdeogram 4؟
Qwen-Image نموذج بترخيص Apache 2.0 مُحسَّن لاتساق الوجوه والواقعية الفوتوغرافية، بينما Ideogram 4 أقرب إلى السحابة ومُحسَّن لعرض النص والتحكم بالتكوين.
هل أحتاج إلى ComfyUI لتشغيل هذه النماذج؟
ليس شرطًا، لكن ComfyUI هو الواجهة القياسية التي بُنيت لأجلها معظم سير عمل المجتمع ونماذج LoRA، فهو أسهل نقطة انطلاق.
استخدم الأدوات المجانية أثناء متابعة الدليل.
تابع القراءة

2026-07-28
اتجاه شخصيات الأكشن بالذكاء الاصطناعي: تجهيز صورتك لـ بورتريه لعبة بجودة استوديو
يحوّل اتجاه شخصيات الأكشن بالذكاء الاصطناعي أي صورة إلى بورتريه لعبة قابل للتجميع. تعلّم ما يجعل المطالبة النصية تعمل، والخطوات الدقيقة للقص والخلفية والدقة التي تفصل بين الشكل المقنع والمزيف الواضح.

2026-07-26
دليل مولد الأنمي بالذكاء الاصطناعي: المطالبات، والأنماط، والتصديرات الآمنة
سير عمل عملي لمولد الأنمي بالذكاء الاصطناعي لإنشاء صور شخصية، وأفاتارات، وبانرات، ومنشورات اجتماعية. يتضمن قوالب المطالبات وفحوصات النمط وقواعد التصدير.

2026-07-26
الذكاء الاصطناعي لتحويل النص إلى صورة في 2026: كيف يعمل توليد المطالبات فعلياً
يحوّل الذكاء الاصطناعي لتحويل النص إلى صورة المطالبة المكتوبة إلى صورة نهائية. نوضح هنا كيف تتكامل النماذج والمطالبات والإعدادات وراء توليد الصور في عام 2026.