شركة OpenAI تطلق الإصدار الجديد من نموذج توليد الصور الخاص بها Images 2.0

أطلقت شركة OpenAI رسمياً نموذج توليد الصور ChatGPT Images 2.0، وذلك بعد حوالي العام تقريباً على إطلاق الإصدار الأول منه.

ووصفت الشركة النظام الجديد بأنه “نقلة نوعية” لنماذج توليد الصور، لا سيما فيما يتعلق بقدرة الأداة على اتباع التعليمات بدقة، وعرض النصوص الكثيفة، ووضع العناصر وربطها في المشهد.

ولأول مرة، طورت OpenAI نموذج صور يتمتع بقدرات استدلالية، مما يمنح النظام القدرة على القيام بأمور مثل البحث في الإنترنت والتحقق من مخرجاته.

ووفقًا للشركة، من شأن هذه القدرات أن تُترجم إلى أداة أكثر موثوقية عندما تكون الدقة والاتساق والتماسك البصري أمورًا أساسية.

وأعلنت OpenAI أنها بذلت جهودًا كبيرة لتحسين أداء Images 2.0 في فهم وعرض النصوص غير اللاتينية، مع تحقيق “مكاسب ملحوظة” في قدرة النموذج على التعامل مع اللغات اليابانية والكورية والصينية والهندية والبنغالية.

وفي الوقت نفسه، تدّعي الشركة أن النموذج الجديد أكثر دقة في محاكاة الخصائص المميزة للغات البصرية المختلفة.

وتؤكد OpenAI أن هذا يجعل Images 2.0 أكثر فائدة في مهام مثل تصميم نماذج الألعاب ورسم القصص المصورة.

إلى جانب هذه الميزات، يتميز النموذج الجديد بمرونة أكبر فيما يتعلق بنسب العرض إلى الارتفاع، مما يسمح له بإنشاء صور بعرض يصل إلى 3:1 وارتفاع يصل إلى 1:3.

كما يمكنه إنتاج تصاميم بدقة تصل إلى 2K، بل ويمكنه توليد ما يصل إلى ثمانية مخرجات في عملية واحدة.

وسيتوفر نموذج Images 2.0 ابتداءً من اليوم لجميع مستخدمي ChatGPT، بما في ذلك المشتركين في الباقة المجانية وباقة Go.

ويحصل مشتركو باقتي Plus وPro على إمكانية الوصول إلى مخرجات أكثر تطورًا. كما تُتيح OpenAI النموذج عبر خدمة API وتطبيق Codex البرمجي، الذي تم تحديثه الأسبوع الماضي ليُوفر ميزة توليد الصور المدمجة.

والجدير بالذكر أن Images 2.0 تأتي بعد أيام قليلة من دخول Anthropic سوق التصميم المرئي بمساعد التصميم الخاص بها.

مقالات قد تعجبك

إنتل تكشف عن معالجاتها الجديد من سلسلة Core Series 3
سامسونج تطلق رسمياً تشكيلة تلفزيونات Micro RGB لعام 2026 بأحجام متنوعة
ميزة جديدة في يوتيوب لإخفاء مقاطع الفيديو القصيرة Shorts من الصفحة الرئيسية
جوجل ستضيف ميزة الذكاء الشخصي إلى نموذج توليد الصور Nano Banana 2

مايكروسوفت تكشف عن أول نموذج لها لتوليد الصور من الوصف النصي

أعلنت شركة مايكروسوفت Microsoft عن أول نموذج ذكاء اصطناعي لها لتحويل النص إلى صورة، تحت اسم MAI-Image-1، والذي تم تصميمه وتطويره داخليًا بالكامل.

ووصفت الشركة العملاقة هذا المولّد الجديد بأنه “الخطوة التالية في رحلتنا”، وذلك بعد إعلانها الأخير عن أول نماذج ذكاء اصطناعي داخلية من Microsoft.

وذكرت مايكروسوفت أنها استعانت بآراء محترفين في المجال الإبداعي لتجنب “المخرجات المتكررة أو ذات الطابع النمطي العام”.

وأكّدت الشركة أن MAI-Image-1 يتفوق في إنتاج صور فوتوغرافية واقعية مثل البرق والمناظر الطبيعية وغيرها، كما أنه قادر على معالجة الطلبات وتوليد الصور بسرعة تفوق “النماذج الأكبر والأبطأ”.

وقد حصل النموذج بالفعل على مركز ضمن أفضل 10 نماذج في موقع LMArena، وهو منصة تقييم لنماذج الذكاء الاصطناعي حيث يقارن المستخدمون بين المخرجات ويصوتون لأفضلها.

ينضم MAI-Image-1 إلى منتجات مايكروسوفت الأخرى للذكاء الاصطناعي، وهي مُولّد الصوت MAI-Voice-1 AI وروبوت المحادثة MAI-1-preview.

كانت مايكروسوفت من أوائل الممولين لـ OpenAI، إلا أن العلاقة بينهما ازدادت تعقيدًا، حيث بدأت مايكروسوفت مؤخرًا باستخدام نماذج الذكاء الاصطناعي من Anthropic لبعض ميزات Microsoft 365، وتستثمر بشكل كبير في تدريب نماذج الذكاء الاصطناعي الخاصة بها مثل MAI-Image-1.

مقالات قد تعجبك

تطبيق Sora يتجاوز حاجز المليون تحميل خلال أقل من خمسة أيام من إطلاقه
كروم ستقوم تلقائياً بتعطيل إشعارات المواقع غير المهمة
مايكروسوفت ستطلق تطبيق OneDrive على ويندوز
تطبيق Copilot سيتمكن من إنشاء مستندات أوفيس والربط مع Gmail

واتساب يختبر ميزة جديدة لإنشاء صور شخصية تخيلية بالذكاء الاصطناعي

يعمل تطبيق واتساب Whatsapp على ميزة جديدة تسمح للمستخدمين بإنشاء صور رمزية لهم لاستخدامها في أي بيئة متخيلة، وذلك بالاعتماد على الذكاء الاصطناعي.

الميزة قيد التطوير، وتمّ رصدها في الإصدار التجريبي الجديد رقم 2.24.14.7 من واتساب على نظام Android بواسطة موقع WABetaInfo، وستستخدم على ما يبدو مجموعة من الصور التي يقدمها المستخدم، والمطالبات النصية، ونموذج Meta AI Llama لإنشاء الصور.

وتكشف لقطة الشاشة التي تمت مشاركتها بواسطة WABetaInfo أنه يمكن للمستخدمين تخيل أنفسهم في أي مكان من الغابة إلى الفضاء الخارجي.

تبدو الأمثلة متطابقة إلى حد ما مع تلك الصور التي تنتجها مولدات الذكاء الاصطناعي، خاصة في تطبيقات مثل Lensa AI أو ميزة الصور الشخصية Dreams في Snapchat.

وسيحتاج المستخدم لاستخدام هذه الخاصية إلى التقاط عدة صور شخصية للمستخدم، ومن ثم سيتم استخدامها بعد ذلك لتدريب Meta AI على إنتاج صور تشبه المستخدم في أي مكان.

سيتمكن مستخدمو WhatsApp بعد ذلك من إنشاء الصور المرغوبة من خلال كتابة “تخيلني” مع وصف الإعداد في دردشة Meta AI، أو في محادثات WhatsApp الأخرى عن طريق كتابة المطالبة: “…. Meta AI imagine me@”.

يقال إن الميزة ستكون اختيارية، وستتطلب من المستخدمين تمكينها يدويًا في إعدادات WhatsApp قبل استخدامها، كما يمكن حذف الصور المرجعية في أي وقت عبر إعدادات Meta AI.

وليس هناك إطار زمني محدد لتوفير هذه الميزة رسمياً لجميع المستخدمين.

مقالات قد تعجبك

الكشف عن أول حاسوب محمول قابل للطي أفقياً يسمى Acemagic X1
منصة Figma تزيل ميزة Make Designs لتصميم التطبيقات بالاعتماد على الذكاء الاصطناعي
عودة خدمات Xbox Live بعد انقطاعها لساعات
كيفية الاتصال بشبكة واي فاي مخفية على نظام التشغيل ويندوز
كيفية البقاء آمنًا على شبكات الواي فاي العامة: نصائح أساسية باستخدام VPN

خدمة إنشاء الصور DALL-E تحصل على ميزات جديدة

أعلنت شركة OpenAI عن إضافة بعض الميزات إلى خدمة إنشاء الصور بالذكاء الاصطناعي DALL-E على بعض الميزات الجديدة.

أولاً أضافت الشركة أدوات لتحرير الصور عند استخدام DALL-E داخل ChatGPT، سواء على الويب أو على الهاتف المحمول.

ثانيًا ستقدم الخدمة اقتراحات أنماط محددة مسبقًا للمساعدة في إلهام إنشاء الصور.

يُذكر أن خدمة DALL-E في جيلها الثالث حالياً، ويبدو أن التحديثات الأخيرة مثل هذه تهدف إلى جعلها أسهل استخداماً.

كما أصبحت DALL-E3 متكاملة مع ChatGPT، مما يعفي المستخدم من كتابة مطالبة صورة وصفية مفصلة، فقط أخبر ChatGPT بما تريد وسيقوم هو بالباقي.

في الآونة الأخيرة، قامت OpenAI أيضًا ببعض الأعمال لمعالجة مشكلة أكثر إلحاحًا تتعلق بإنشاء صور الذكاء الاصطناعي: المصداقية.

في وقت سابق من هذا العام، بدأت خدمة DALL-E 3 في إضافة علامات مائية وبيانات وصفية مرئية للإشارة إلى الصورة التي تم إنشاؤها بواسطة الذكاء الاصطناعي.

مقالات قد تعجبك

هواتف آيفون 12 أصبحت تدعم تقنية الشحن Qi2
سعر ومواصفات هاتف Realme C65 الاقتصادي
ياهو تعلن عن استحواذها على منصة الأخبار المعتمدة على الذكاء الاصطناعي Artifact
متى ستتوقف مايكروسوفت عن دعم ويندوز 10؟
متى يجب التفكير بشراء آيفون جديد؟

المساعد الذكي Copilot داخل Microsoft 365 يحصل على ترقية  GPT-4 Turbo

أعلنت شركة مايكروسوفت Microsoft عن بدء توفير خدمة GPT-4 Turbo لمشتركي الأعمال (Business) في مساعد Copilot الذي يعمل بالذكاء الاصطناعي.

الأمر الذي سيفتح الوصول إلى أحدث طراز من OpenAI داخل تطبيق Copilot للهاتف المحمول وعلى الويب، وفي ويندوز Windows ومتصفح Edge.

وستكون الخدمة متاحة ضمن اشتراك مخصص داخل Microsoft 365 يبلغ 30 دولارًا لكل مستخدم شهريًا.

في حين أنّ المستخدمين المشتركين في Copilot Pro يتمتعون بالفعل بإمكانية الوصول إلى GPT-4 Turbo، فإن الشركات التي تستخدم مساعد Copilot في Microsoft 365 ستتمتع الآن بإمكانية الوصول وبدون حدود على عدد الدردشات يوميًا.

سيكون GPT-4 Turbo متاحًا في Copilot لـ Microsoft 365 وسيتضمن أحدث المعلومات من الويب، ويمكن استخدامه في تسهيل الأعمال مثل مثل الاستعلام عن رسائل البريد الإلكتروني والمستندات والاجتماعات والمزيد.

كما ويتضمن هذا الاشتراك دعمًا لما يصل إلى 300 صفحة نصية في موجه واحد، مما يجعله أكثر قدرة على تحليل المستندات.

كما وتعمل مايكروسوفت أيضًا على تحسين إمكانات إنشاء الصور في المصمّم Microsoft Designer لمشتركي الأعمال في Copilot لـ Microsoft 365.

وسيتمكن المشتركون من إنشاء 100 صورة يوميًا في وقت لاحق من هذا الشهر بدلاً من 15 صورة يوميًا قبل ذلك.

ستستخدم هذه الميزة نموذج DALL-E3 الخاص بـ OpenAI، وتقول مايكروسوفت إن طلبات إنشاء الصور ستكون سريعة لتقليل أوقات الانتظار لإنشاء الصور.

مقالات قد تعجبك

هواتف آيفون 12 أصبحت تدعم تقنية الشحن Qi2
سعر ومواصفات هاتف Realme C65 الاقتصادي
ياهو تعلن عن استحواذها على منصة الأخبار المعتمدة على الذكاء الاصطناعي Artifact
متى ستتوقف مايكروسوفت عن دعم ويندوز 10؟
متى يجب التفكير بشراء آيفون جديد؟

شركة Stability AI تكشف عن نموذج جديد لإنشاء الصور من المطالبات النصية

أعلنت شركة Stability AI عن أحدث نموذج لإنشاء الصور من خلال المطالبات النصية والذي يحمل الاسم Stable Cascade.

وتعد الشركة بأن يكون هذا النموذج أسرع وأقوى من سابقه الرائد Stable Diffusion، والذي يعد حجر الأساس للعديد من أدوات الذكاء الاصطناعي الأخرى المَعنية بتحويل النصوص إلى صور.

ويمكن لـ Stable Cascade إنشاء صور وإعطاء أشكال مختلفة للصورة الواحدة التي تم إنشاءها، أو محاولة زيادة دقة الصورة الموجودة.

تشتمل الميزات الأخرى إمكانية الرسم، وتحرير جزء معين فقط من الصورة، بالإضافة إلى ميزة Canny Edge، والتي تمكّن المستخدمين من إنشاء صورة جديدة فقط باستخدام حواف الصورة الموجودة مسبقاً.

النموذج الجديد متاح على GitHub للباحثين ولكن ليس للاستخدام التجاري، ويجلب المزيد من الخيارات الجديدة.

وعلى عكس نموذج Stable Diffusion الرائد فإن Stable Cascade ليس نموذجًا لغويًا واحدًا كبيرًا، إنما ثلاثة نماذج.

كما يتم في هذا النموذج تقسيم الطلبات إلى أجزاء أصغر والتي تتطلب ذاكرة أقل، وساعات أقل من التدريب عبر وحدات معالجة الرسومات، كما أنه أسرع.

حيث استغرق إنشاء الصورة في إحدى التجارب حوالي 10 ثوانٍ مقارنة بـ 22 ثانية لنموذج SDXL المستخدم حاليًا.

مقالات قد تعجبك

روبوت ChatGPT سيمتلك ذاكرة لتذكر معلومات المستخدم
إنفيديا تطلق تطبيق Chat with RTX لإنشاء بوتات دردشة مُخصصة
سامسونج تضيف ميزات ذكاء اصطناعي إلى سماعاتها اللاسلكية Buds2 و Buds2 Pro
ما هو التعلم الآلي Machine Learning؟
كيفية جعل محرك أقراص USB قابلاً للقراءة على أجهزة ماك وويندوز

جوجل تسمح بإنشاء صور اعتماداً على مطالبات نصية مباشرة من بحث جوجل

أعلنت شركة جوجل أن تجربة البحث التوليدية (SGE) من جوجل Google ستتيح للمستخدمين إنشاء صور مباشرة من خلال أوامر نصية.

ويتوجّب على المستخدم الاشتراك في SGE من خلال برنامج Search Labs من Google، ثم يمكن للمستخدمين كتابة الأوامر النصية للصورة المرغوبة في شريط بحث Google.

بعد ذلك سيتم إنشاء بعض الصور بناءً على هذه المطالبات، والتي يمكن الاختيار من بينها.

يتم تشغيل الأداة بواسطة عائلة Imagen من نماذج الذكاء الاصطناعي.

وأوضحت جوجل من خلال صورة متحركة كيف يمكن استخدام الأداة لإنشاء صور بناءً على المطالبة “ارسم صورة لكابيبارا يرتدي قبعة الطهاة ويطبخ وجبة الإفطار”.

مصدر الصورة: جوجل

كما هو موضح في الصورة المتحركة التالية فإنه يمكن أيضًا تحسين الاستعلامات التي ينتهي الأمر بـ Google إلى استخدامها لإنشاء كل صورة.

ولن تتمكن الأداة من إنشاء صور تنتهك سياسة الاستخدام المحظورة للشركة للذكاء الاصطناعي التوليدي.

كما أنّ كل صورة يتم إنشاؤها باستخدام SGE ستحتوي على علامات بيانات وصفية، وعلامة مائية مدمجة للإشارة إلى أنها تم إنشاؤها بواسطة الذكاء الاصطناعي.

كما لن تسمح جوجل بإنشاء صور تصور وجوهًا واقعية أو أي مطالبات تتضمن أفرادًا بارزين.

تضيف Google أيضًا القدرة على إنشاء مسودات مكتوبة مباشرة من شريط البحث باستخدام SGE.

وقامت الشركة ومنذ إطلاق SGE في شهر مايو/أيار بتحسينه بشكل متزايد.

مقالات قد تعجبك

أدوبي تكشف عن مشورع لفستان تفاعلي يمكنه تغيير شكله
أدوبي تختبر ميزة جديدة لزيادة دقة مقاطع الفيديو والصور المتحركة القديمة
مايكروسوفت تُغلق ثغرة لتنشيط ويندوز 11 بشكل مجاني
لماذا يسخن شاحن الهاتف؟ وهل هذا مقلق؟
هل يؤذي المغناطيس الهاتف أو جهاز الكمبيوتر؟

مايكروسوفت تضيف ميزة لإنشاء الصور بالاعتماد على الذكاء الاصطناعي لمتصفح Edge

أعلنت شركة مايكروسوفت Microsoft عن إضافة منشئ الصور المدعوم بالذكاء الاصطناعي DALL-E لمتصفح Edge الخاص بها.

وستكون هذه الميزة متاحة على متصفح سطح المكتب لجميع مستخدمي Edge في جميع أنحاء العالم قريباً.

وكانت الشركة قد أعلنت عن هذه الميزة الشهر الماضي، ولكن تم وقتها دمجها في روبوت الدردشة Bing chatbot، ولكن هذه الخطوة ستجعلها متاحة لجمهور أوسع بكثير.

فالميزة أصبحت متاحة في الشريط الجانبي لمتصفح Edge، ولكن سيتعين إضافته يدويًا إلى الشريط الجانبي قبل أن يتم استخدامه، على الأقل في الوقت الحالي.

للقيام بذلك افتح الشريط الجانبي، وانقر فوق الزر ‘+’، ثم قم بتبديل المفتاح بجوار Image Creator.

إن استخدام منشئ الصور بسيط جداً، حيث كل ما على المستخدم أن يكتب نصياً ما يريد ليقوم الذكاء الاصطناعي بإنشاء العديد من الصور التي تتطابق مع الطلب، بعد ذلك يستطيع المستخدم تنزيل ما يعجبه، واستخدامه كيفما يشاء.

وقالت الشركة إن الميزة الجديدة مفيدة لإنشاء صور مناسبة لمنشورات وسائل التواصل الاجتماعي أو عروض شرائح ومستندات.

كانت هذه المهمة ممكنة بطرق متنوعة من قبل، مثل استخدام OpenAI’s DALL-E، أو موقع منشئ صور Bing من Microsoft، أو منشئ الصور المدمج في Bing Chat، أو أحد مولدات الصور العديدة الأخرى.

إلا أن وضعه في الشريط الجانبي لمتصفح Edge يجعل استخدامه أكثر سهولة وأسرع.

ولم تذكر الشركة أية معلومات حول عدد الصور التي يمكن للمستخدمين توليدها باستخدام هذه الأداة، كما لم تكشف عن موعد إتاحتها للجميع.

ضمن سياق آخر أضافت الشركة أيضًا ميزات أخرى إلى Edge، مثل أداة Drop التي تتيح إرسال الملفات والمحتويات الأخرى إلى نفسك، وإنشاء دفتر ملاحظات شخصي يتزامن عبر الأجهزة.

مقالات قد تعجبك

جوجل تفرض سياسة جديدة على تطبيقات أندرويد لتسهيل حذف حساب المستخدم
ميزة تجريبية في متصفح Edge لحظر تشغيل الوسائط ذاتية التشغيل
مايكروسوفت تخطط لإضافة مساعد الذكاء الاصطناعي Copilot إلى برنامج OneNote
كيفية التحقق من مواصفات جهاز الكمبيوتر
كيفية تحميل ملف ويندوز 11 بصيغة ISO بشكل قانوني