باختصار
- Qwen Image 3.0 هو نموذج Alibaba لتحويل النص إلى صورة وتحرير الصور، مصمم للتصاميم التي تحتوي على قدر كبير من المعلومات: الرسوم البيانية والملصقات ولوحات القصة ونماذج واجهات المستخدم والتصاميم متعددة اللوحات.
- يقبل مطالبات تصل إلى 4.5 ألف رمز ويدّعي عرض نصوص صغيرة بحجم يصل إلى نحو 10 بكسل عبر 12 لغة.
- في الاختبارات العملية، أبلى بلاءً حسنًا في المشاهد المفردة الكثيفة والملصقات المستقلة، لكن النصوص الواقعية الصغيرة (مثل نسب التغذية) ما زالت تخرج مشوّهة.
- يحرّر الصور باستخدام صورة إلى ثلاث صور مرجعية، ويأتي بأوزان مغلقة، لذا لا يمكنك تنزيله وتشغيله محليًا.
- يمكنك التوليد به مباشرةً على OpenArt دون الحاجة إلى حساب Alibaba Cloud.
ما هو Qwen Image 3.0؟
Qwen Image 3.0 هو نموذج لتوليد الصور وتحريرها بالذكاء الاصطناعي من Alibaba، صدر في يوليو 2026. يولّد الصور من موجه نصي ويحرر الصور الموجودة باستخدام صورة إلى ثلاث صور مرجعية إضافةً إلى تعليمات مكتوبة. صممته Alibaba للتعامل مع المرئيات الكثيفة الغنية بالمعلومات بدلاً من اللقطات الرئيسية النظيفة المفردة.
يُخرِج النموذج صورًا بأحجام تتراوح بين 512x512 و2048x2048 بكسل، بصيغة PNG. اطلب حجمًا محددًا، أو اتركه فارغًا وسيختار النموذج دقة بناءً على المطالبة. يمكن لطلب واحد أن يُرجع ما يصل إلى ست صور.
يأتي Qwen Image 3.0 بأوزان مغلقة. على عكس إصداري Qwen-Image 1.0 و2.0 السابقين، لا يمكنك تنزيل النموذج وتشغيله على أجهزتك الخاصة. يتم الوصول عبر خدمة مستضافة، بما في ذلك Qwen Image 3.0 نموذج على OpenArt.
فيمَ يُستخدم Qwen Image 3.0؟
تشير Alibaba والاختبارات العملية المبكرة إلى المجموعة نفسها من المهام:
- الرسوم البيانية ومنشورات العرض الدوار، حيث يجب أن تتموضع عدة نقاط بيانات أو لوحات في تصميم واحد متناسق.
- الملصقات ومفاهيم الحملات، خصوصًا تلك المبنية حول مشهد واحد معقد بدلاً من اقتصاص المنتج. أما للحصول على ملصق فردي أبسط، فإن صانع الملصقات بالذكاء الاصطناعي هي الأداة الأكثر مباشرة.
- نماذج واجهات المستخدم والمرئيات المتعلقة بالمنتجات، حيث تحتاج الصورة إلى تلميح واجهة أو شاشة.
- لوحات القصة وبطاقات المعرفة، حيث يجب أن يتوافق النص والصورة لوحةً بلوحة، وهو نوع المهمة نفسه الذي مولّد لوحات القصة بالذكاء الاصطناعي مقابض للمشاهد المكتوبة.
- التصاميم متعددة اللوحات والكثيفة بشكل عام، وهو نوع الطلب الذي عادةً ما يُقسَّم إلى عدة عمليات توليد منفصلة.
إنه أقل ملاءمة للقطة منتج واحدة نظيفة، أو لشعار يجب أن يبقى مطابقًا بكسلًا ببكسل، أو لأي شيء يتطلب أن تكون حفنة من الأرقام الصغيرة (الأسعار، النسب المئوية، الجرعات) صحيحة من المحاولة الأولى. المزيد عن السبب أدناه.
الميزات الرئيسية
تصف Alibaba نموذج Qwen Image 3.0 حول ثلاث ركائز، ومن الأفضل التعامل معها كادعاءات من المزوّد وليس سلوكًا مؤكدًا حتى تختبر موجهًا بنفسك:
- محتوى غني: مطالبات تصل إلى 4.5 ألف رمز، أي نحو أربعة أضعاف الحد في Qwen-Image 2.0. تتضمن أمثلة Alibaba الخاصة صحفًا ولوحات قصة وأوراق امتحانات، أي تخطيطات مكتظة بالتفاصيل.
- تفاصيل واقعية: نص يُعرض بحجم صغير يصل إلى نحو 10 بكسل، إضافةً إلى نسيج بصري دقيق مثل مسام الجلد وخصلات الشعر المنفردة.
- معرفة عميقة: عرض النص الأصلي عبر نحو 12 لغة، مع أمثلة رسمية بالصينية والإنجليزية واليابانية والكورية والإسبانية. تشير Alibaba أيضًا إلى مواقع ويب محاكاة وشاشات ألعاب وشيفرة برمجية مُعرَضة داخل صورة.
توضح وثائق Alibaba الخاصة حدودًا حقيقية إلى جانب تلك الادعاءات: قد تظهر أخطاء إملائية، خاصةً في النصوص الصغيرة أو غير الإنجليزية، ولا ينبغي التعامل مع النموذج كمصدر للحقيقة بشأن الأرقام داخل مخطط أو إنفوجرافيك دون مراجعة يدوية.
كيفية استخدام Qwen Image 3.0
على OpenArt، يستغرق التوليد باستخدام Qwen Image 3.0 أربع خطوات:
- افتح Qwen Image 3.0 صفحة النموذج واختر وضع التوليد أو التحرير.
- للتحرير، ارفع صورة إلى ثلاث صور مرجعية.
- اكتب مطالبة مفصّلة: صِف التخطيط، والنص الدقيق الذي تريد عرضه، ولوحة الألوان، والأسلوب، بدلًا من وصف من سطر واحد.
- راجع الناتج بالحجم الكامل، وكبّر أي نص صغير أو أرقام، وحسّن المطالبة لأي شيء ظهر بشكل خاطئ.
الموجه المصمم لما يتقنه النموذج فعليًا، أي مشهد كثيف واحد بتعليمات واضحة، يميل إلى التفوق على الموجه الذي يطلب عدة أصول منفصلة دفعةً واحدة. مثال:
ورشة صانع ساعات مزدحمة عند الغسق، بضوء مصباح مكتبي دافئ، وعشرات التروس والأدوات الصغيرة المتناثرة على منضدة خشبية، وساعة جيب نصف مجمّعة في المقدمة، وذرات غبار مرئية في شعاع الضوء، بتفاصيل واقعية على كل سطح.
ما يمكن توقعه: كيف يؤدي عمليًا
ادعاءات Alibaba شيء، والتوليد العملي شيء آخر. في جولة من الاختبارات العملية، طُلب من Qwen Image 3.0 إنشاء إعلان لمشروب رياضي يحمل ملصق تغذية مكتظًا، وشريحة اجتماعية من ثلاث صور، وإنفوجرافيك، وتصميمًا اجتماعيًا بسيطًا، وبعض المشاهد المفردة الكثيفة بالمعلومات.
لم يصمد ادعاء النص بحجم 10 بكسل على ملصق القيمة الغذائية. فقد ظهرت بعض النسب المئوية وكمية البروتين مشوشة، ما يعني أن أي محتوى بنص دقيق صغير مثل الأسعار والجرعات وحقائق التغذية لا يزال يحتاج إلى مراجعة يدوية قبل النشر. أما الطباعة البارزة بحجم الملصقات فقد أبلت بلاءً أفضل بكثير؛ إذ خرج ملصق قهوة مستقل بنص عنوان واضح ومقروء.
كما لم يُعِد طلب العرض الدوار ثلاثة ملفات منفصلة. فقد دمج Qwen اللوحات الثلاث كلها في صورة واحدة، لذا تطلّب الحصول على أصول فردية اقتصاص النتيجة لاحقًا، مع بعض فقدان الدقة في كل لوحة.
أدى تحرير شعار مرفوع إلى تغييرات غير مطلوبة (أضاف طوقًا وشعرًا خشنًا لعلامة كلب سكوتي) إلى أن نصّت المطالبة صراحةً على إبقاء الشعار دون تغيير والحفاظ على نسبة العرض إلى الارتفاع. وبمجرد توضيح هذه القيود، بقيت التعديلات ضمن الأصل المطلوب. أما لأعمال العلامات التجارية المتكررة حيث يجب أن يبقى الشعار دون مساس عبر عمليات توليد كثيرة، فإن مجموعة العلامة التجارية بالذكاء الاصطناعي يفرض هذا الاتساق تلقائيًا بدلاً من الاعتماد على صياغة الموجه في كل مرة.
المجال الذي أدى فيه Qwen Image 3.0 أفضل أداء كان المشهد المفرد الكثيف: ورشة صانع ساعات مزدحمة ومكتبة عائمة بنسبة 21:9 كلاهما احتفظ بالتفاصيل الدقيقة عبر الإطار بأكمله دون أن يتحول إلى ضوضاء بصرية. إذا كان الطلب يتمحور حول تكوين واحد معقّد بدلًا من عدة أصول منسّقة، فهذا هو المجال الذي يقدّم فيه هذا النموذج أفضل أعماله.
بلغ حساب مجاني حد الاستخدام بعد نحو أربع إلى خمس عمليات توليد في هذه الجولة من الاختبارات. تعامل مع ذلك كتجربة حساب واحد وليس كحصة موثّقة، إذ لا تنشر Qwen رقمًا ثابتًا للطبقة المجانية.
الأسئلة الشائعة
فيمَ يُستخدم Qwen Image 3.0؟
بشكل أساسي المرئيات الكثيفة الغنية بالمعلومات: الرسوم البيانية ومنشورات العرض الدوار والملصقات ونماذج واجهات المستخدم ولوحات القصة والتصاميم متعددة اللوحات. كما يحرر الصور الموجودة باستخدام صورة إلى ثلاث صور مرجعية.
هل استخدام Qwen Image 3.0 مجاني؟
لا تنشر Alibaba مخصصًا ثابتًا للفئة المجانية، وقد بلغ أحد الحسابات المختبرة حده بعد نحو أربع إلى خمس عمليات توليد. على OpenArt، تحصل الحسابات الجديدة على 40 رصيدًا مجانيًا لتجربته وتجربة نماذج أخرى، دون الحاجة إلى بطاقة ائتمان.
هل يمكنني تشغيل Qwen Image 3.0 محليًا؟
لا. يأتي بأوزان مغلقة، على عكس إصداري Qwen-Image 1.0 و2.0 المفتوحين. تصل إليه عبر خدمة مستضافة بدلًا من أوزان قابلة للتنزيل.
ما الفرق بين Qwen Image 3.0 وQwen-Image 2.0؟
التغيير الأبرز هو طول المطالبة: يدعم الإصدار 3.0 نحو 4.5 ألف رمز مقابل حد 1000 رمز في الإصدار 2.0، وهو ما يهم للتخطيطات الكثيفة متعددة التعليمات. تروّج Alibaba أيضًا لتحسين عرض النصوص الصغيرة ودعم لغوي أوسع، رغم أن النصوص الواقعية الصغيرة ما زالت تستفيد من مراجعة يدوية.
هل يدعم Qwen Image 3.0 لغات أخرى غير الإنجليزية؟
تغطي أمثلة Alibaba الرسمية الصينية والإنجليزية واليابانية والكورية والإسبانية، مع ادعاء عرض النص الأصلي عبر نحو 12 لغة في المجمل.
ماذا لو كان مشروعي يحتاج إلى كثير من النصوص الصغيرة والدقيقة جدًا؟
توقع الحاجة إلى مراجعة يدوية. ففي الاختبار، خرج النص الكثيف لملصقات القيمة الغذائية والنسب المئوية مشوشًا رغم ادعاء Alibaba بحجم 10 بكسل، لذا فإن أي محتوى يتضمن أسعارًا أو جرعات أو نصوصًا دقيقة أخرى يستحق التحقق منه سطرًا بسطر قبل النشر. ولهذه المهمة تحديدًا، فإن أداة تصميم غنية بالنصوص مثل ChatGPT Image 2.0 قد يحتاج النموذج إلى عمل إصلاحي أقل؛ أما للصور المرجعية المتعددة التي يجب أن تبقى متسقة، Nano Banana Pro هو الخيار الآخر المتاح على حساب OpenArt نفسه.
قراءات ذات صلة
هل تريد الموازنة بين Qwen Image 3.0 والخيارات الأخرى أولًا؟ ملخص OpenArt لأفضل أفضل مولّدات الصور بالذكاء الاصطناعي في 2026 يغطي مجموعة أوسع من النماذج جنبًا إلى جنب.
جرّب Qwen Image 3.0 على OpenArt
يمكنك التوليد باستخدام Qwen Image 3.0 مباشرةً على OpenArt، إلى جانب نماذج الصور والفيديو الأخرى، دون إعداد حساب منفصل على Alibaba Cloud.