نموذج Gemini 2.0 Flash أصبح قادراً على إزالة العلامات المائية من الصور

أطلقت جوجل أحدث الميزات “التجريبية” لنموذج الذكاء الاصطناعي Gemini 2.0 Flash لمزيد من المطورين في جميع المناطق، والذي يتضمن بعض القدرات المثيرة للقلق، بما في ذلك إزالة العلامات المائية من الصور.

كما وأصبح نموذج الذكاء الاصطناعي خفيف الوزن والمُدمج على الجهاز من الشركة مُجهزًا الآن بميزة إنشاء صور أصلية، لا تقتصر على إنتاج صور من خلال مطالبة نصية فحسب، بل تتيح لك تحرير الصور بطريقة حوارية.

وخلال عطلة نهاية الأسبوع، اكتشف المستخدمون أنه يُمكنه أيضًا إزالة العلامات المائية بدقة، وفقًا لتقارير TechCrunch.

وتُمكّن أدوات مثل Watermark Remover.io بالفعل من إزالة العلامات من شركات مثل Shutterstock، وقد طوّر فريق بحثي في ​​جوجل خوارزمية لإزالة العلامات المائية في عام 2017 لتسليط الضوء على الحاجة إلى حماية أكثر أمانًا.

في المقابل، ترفض بعض أدوات الذكاء الاصطناعي مثل GPT-4o من OpenAI طلبات إزالتها.

مع ذلك، يبدو أن برنامج Gemini 2.0 Flash أفضل من الخيارات الأخرى في إزالة العلامات المائية المعقدة، مثل طوابع Getty Images، وملء الصورة.

ويضيف النموذج بعد إزالة العلامة المائية علامة SynthID، مستبدلًا علامة حقوق الطبع والنشر بعلامة “مُحررة باستخدام الذكاء الاصطناعي”.

ولكن من الممكن أيضًا إزالة علامات الذكاء الاصطناعي هذه باستخدام الذكاء الاصطناعي نفسه، باستخدام أداة مسح الكائنات من سامسونج.

لاحظ المستخدمون أيضًا أن برنامج Gemini 2.0 Flash يمكنه، على ما يبدو، إضافة صور واضحة لأشخاص حقيقيين مثل إيلون ماسك إلى الصور، وهو أمر لا يسمح به نموذج Gemini الكامل.

تتوفر أحدث ميزات الصور في Flash للمطورين فقط من خلال AI Studio في الوقت الحالي – لذا فإن افتقاره الواضح للحواجز الأمنية ليس متاحًا للجميع لاستخدامه (أو إساءة استخدامه).

مقالات قد تعجبك

ميزة جديدة في تطبيق Find My Device لعرض مواقع الأصدقاء
جوجل تتخلى رسمياً عن مساعدها التقليدي لصالح Gemini
جوجل تسمح لـ ChatGPT بأن يكون المساعد الرقمي الافتراضي على أندرويد
ما هو إيثريوم Ethereum 2.0 وما علاقته بالتعدين؟
كيفية حفظ كلمات المرور على جوجل كروم وحساب جوجل

شركة OpenAI تطلق نموذج الذكاء الاصطناعي GPT-4o Mini

أطلقت شركة OpenAI نموذجًا أخف وأرخص للمطورين يُسمّى GPT-4o Mini، بسعر أقل بكثير من النماذج كاملة الحجم، ويُقال إنه أكثر قدرة من GPT-3.5.

ويؤدي إنشاء التطبيقات باستخدام نماذج OpenAI إلى تكبّد فاتورة ضخمة، الأمر الذي دفع للمطورين الذين ليس لديهم القدرة على تحمل تكاليف هذا الأمر اختيار نماذج أرخص مثل Google Gemini 1.5 Flash أو Anthropic’s Claude 3 Haiku.

والآن سيتمكن مستخدمو ChatGPT في الخطط المجانية و Plus و Team استخدام GPT-4o Mini بدلاً من GPT-3.5 Turbo، مع إمكانية وصول مستخدمي Enterprise لهذا النموذج في الأسبوع المقبل.

وهذا يعني أن GPT-3.5 لن يكون متاحاً لمستخدمي ChatGPT بعد الآن، ولكنه سيظل متاحًا للمطورين عبر واجهة برمجة التطبيقات إذا كانوا يفضلون عدم التبديل إلى GPT-4o Mini.

وقالت الشركة إنّ GPT-3.5 سيتم إيقافها عن واجهة برمجة التطبيقات (API) في وقت ما، لكنهم غير متأكدين من الموعد المحدد لذلك.

سيدعم النموذج الجديد خفيف الوزن أيضًا النص والصور في واجهة برمجة التطبيقات (API)، وتقول الشركة إنها ستتعامل قريبًا مع جميع المدخلات والمخرجات متعددة الوسائط مثل الفيديو والصوت.

مع كل هذه الإمكانات، قد يبدو هذا بمثابة مساعدين افتراضيين أكثر قدرة يمكنهم فهم خط سير رحلتك وإنشاء الاقتراحات، ومع ذلك فإن هذا النموذج مخصص لمهام بسيطة.

حقق هذا النموذج الجديد درجة 82 بالمائة في اختبار فهم اللغة متعدد المهام (MMLU)، وهو اختبار قياسي يتكون من حوالي 16000 سؤال متعدد الاختيارات عبر 57 موضوعًا أكاديميًا.

عندما تم تقديم MMLU لأول مرة في عام 2020، كانت معظم النماذج سيئة جدًا في استخدامه، وكان هذا هو الهدف نظرًا لأن النماذج أصبحت متقدمة جدًا بالنسبة للاختبارات المعيارية السابقة.

سجل GPT-3.5 سبعين بالمائة في هذا المعيار، و GPT-4o عند 88.7 بالمائة، وتدعي جوجل Google أن نموذجها Gemini Ultra حصل على أعلى درجة على الإطلاق بنسبة 90 بالمائة.

بالنسبة للمطورين المتعطشين لبناء تطبيقات الذكاء الاصطناعي بتكلفة رخيصة، فإن إطلاق GPT-4o Mini يمنحهم أداة أخرى لإضافتها إلى مخزونهم.

حيث سمحت شركة OpenAI لشركة Ramp الناشئة في مجال التكنولوجيا المالية باختبار النموذج، باستخدام GPT-4o Mini لبناء أداة تستخرج بيانات النفقات من الإيصالات.

لذلك، بدلاً من المرور عبر مربعات النص، يمكن للمستخدم تحميل صورة للإيصال الخاص به ويقوم النموذج بفرز كل شيء له.

كما قام برنامج Superhuman للبريد الإلكتروني أيضًا باختبار GPT-4o Mini واستخدمه لإنشاء ميزة الاقتراح التلقائي للردود على البريد الإلكتروني.

مقالات قد تعجبك

ميزة في هواتف Galaxy Z Fold 6 و Z Flip 6 لتحويل الخربشات الرسومية إلى صور واقعية
إنستغرام تسمح بإضافة عدة مسارات صوتية إلى مقاطع Reels
آبل ستساعد في استعادة الصور المحذوفة والتالفة في آيفون وآيباد
كيفية البقاء آمنًا على شبكات الواي فاي العامة: نصائح أساسية باستخدام VPN
كيفية استخدام ميزة المشاركة مع الأجهزة القريبة AirDrop في ويندوز 11

شركة OpenAI ستضيف علامة مائية مخصصة للصور المنشأة بواسطة DALL-E3

أعلنت شركة OpenAI أنها ستضيف علامات مائية مخصصة للصور المنشأة بواسطة نموذج الذكاء الاصطناعي الخاص بها DALL-E3.

وقالت الشركة إن هذه العلامات المائية ستُضاف إلى البيانات الوصفية للصور وذلك بالتزامن مع قيام المزيد من الشركات الكبرى بتقديم مثل هكذا علامات.

وستظهر هذه العلامات في الصور التي تم إنشاؤها على موقع ChatGPT وواجهة برمجة التطبيقات (API) لنموذج DALL-E3.

سيحصل مستخدمو الهاتف المحمول على العلامات المائية بحلول 12 فبراير/شباط الحالي، وستتضمن مكون البيانات الوصفية غير المرئي، ورمز CR المرئي، والذي سيظهر في الزاوية العلوية اليسرى من كل صورة.

كما وسيتمكن المستخدمون من التحقق من مصدر الصورة أو بشكل أدق أداة الذكاء الاصطناعي التي تم استخدامها لصنع الصورة- لأي صورة تم إنشاؤها بواسطة منصات OpenAI من خلال مواقع الويب مثل Content Credentials Verify.

وستقتصر هذه العلامات في الوقت الحالي على الصور الثابتة فقط، ولن تشمل مقاطع الفيديو أو النصوص.

وأكدت الشركة أن إضافة البيانات الوصفية للعلامة المائية إلى الصور لن يؤثر كثيراً على سرعة وجودة إنشاء الصورة.

وتعمل مجموعة C2PA، وهي مجموعة تتكون من شركات مثل Adobe وMicrosoft، على الدفع باتجاه استخدام العلامة المائية لبيانات اعتماد المحتوى لتحديد مصدر المحتوى، وإظهار ما إذا كان قد تم إنشاؤه بواسطة البشر أو باستخدام الذكاء الاصطناعي.

ويعد تحديد المحتوى الناتج عن الذكاء الاصطناعي أحد التوجيهات الرئيسية في الأمر التنفيذي لإدارة بايدن بشأن الذكاء الاصطناعي، إلا أن العلامة المائية ليست طريقة مؤكدة لوقف المعلومات الخاطئة.

حيث أشارت شركة OpenAI إلى أن البيانات الوصفية لـ C2PA ‘يمكن إزالتها بسهولة إما عن طريق الخطأ أو بشكل مقصود، خاصة وأن معظم منصات الوسائط الاجتماعية غالبًا ما تزيل البيانات الوصفية من المحتوى الذي تم تحميله، كما يؤدي التقاط لقطة شاشة للصورة نفسها إلى حذف البيانات التعريفية.

مقالات قد تعجبك

يوتيوبر يختبر مدى قوى نظارة آبل الجديدة Vision Pro
تأثيرات وسال الدردشة عبر الإنترنت في مختلف مجالات الحياة
روبوت الدردشة Bard الخاص بجوجل أصبح قادراً على إنشاء الصور
كيفية تعيين نظام التشغيل الافتراضي على كمبيوتر يعمل بنظامي تشغيل
كيفية الحصول على رابط لصورة أو مقطع فيديو على إنستغرام