في خطوة تُظهر قدرة Apple على المساهمة في مجال الذكاء الاصطناعي، أطلقت الشركة العملاقة نموذجًا جديدًا مفتوح المصدر لتحرير الصور يُسمى “تحرير الصور الموجه بواسطة نموذج MLLM (MGIE)”، والذي يعتمد على نماذج اللغة الكبيرة متعددة الوسائط (MLLMs) لفهم وتفسير الأوامر المستندة إلى النصوص لتعديل الصور بشكل ملائم. تقدم هذه الخطوة لآبل فرصة للعب دور أكبر في مجال الذكاء الاصطناعي، حيث تعتبر Apple واحدة من أقل الشركات التي نشاهد لها تواجدًا قويًا في هذا المجال.
تعتمد تقنية MGIE على قدرة النماذج اللغوية الكبيرة متعددة الوسائط على فهم الأوامر البسيطة أو الغامضة وتحويلها إلى تعليمات أكثر تفصيلًا ووضوحًا يمكن للمحررات الصور استيعابها ومتابعتها. وهذا يعني أن المستخدمين الذين يرغبون في تحرير صورهم بناءً على النصوص يمكنهم الآن القيام بذلك بسهولة أكبر، دون الحاجة إلى مهارات متقدمة في تحرير الصور.
وفيما يتعلق بمجال الاستخدامات، يمكن لنموذج MGIE أن يقوم بتحرير الصور بطرق متعددة، بما في ذلك تغيير حجم الصورة، قصها، تدويرها، وتحسين جودتها العامة من خلال تعديلات على السطوع والتباين وتوازن الألوان. بالإضافة إلى ذلك، يمكن للنموذج تحرير أجزاء محددة من الصورة، مما يتيح إمكانية تعديل محتوى الصورة بشكل دقيق وموجه، مثل تغيير لون الشعر أو إزالة العناصر غير المرغوب فيها من الخلفية.
يُعد طرح النموذج MGIE عبر منصة GitHub خطوة هامة في تعزيز الشفافية والتشجيع على التعاون في مجال الذكاء الاصطناعي، حيث يمكن للمطورين والباحثين الآن الوصول إلى النموذج وتحسينه أو استخدامه في مشاريعهم الخاصة. ومن المثير للاهتمام أيضًا أن هناك عرض توضيحي للنموذج متاح حاليًا على Hugging Face Spaces، مما يسمح للمستخدمين بتجربة النموذج وتقييم فعاليته بشكل مباشر.
من المهم أيضًا أن نلاحظ أن Apple لم تعلن بعد ما إذا كانت تخطط لدمج هذا النموذج في منتجاتها القائمة أو إطلاق تطبيق مستقل له. ومع ذلك، يمكن أن يكون استخدام ما تعلمته الشركة من هذا المشروع في تطوير ميزات جديدة أو أدوات محسنة لتحرير الصور في أجهزتها المستقبلية أحد السيناريوهات المحتملة.
بشكل عام، تمثل هذه الخطوة خطوة إيجابية نحو تطوير تقنيات تحرير الصور بطرق أكثر ذكاءً وسهولة، مما يساهم في توفير تجارب مستخدم محسنة وأكثر فعالية في مجال التصوير الرقمي.








