نموذج Gemini 2.0 Flash أصبح قادراً على إزالة العلامات المائية من الصور

أطلقت جوجل أحدث الميزات “التجريبية” لنموذج الذكاء الاصطناعي Gemini 2.0 Flash لمزيد من المطورين في جميع المناطق، والذي يتضمن بعض القدرات المثيرة للقلق، بما في ذلك إزالة العلامات المائية من الصور.

كما وأصبح نموذج الذكاء الاصطناعي خفيف الوزن والمُدمج على الجهاز من الشركة مُجهزًا الآن بميزة إنشاء صور أصلية، لا تقتصر على إنتاج صور من خلال مطالبة نصية فحسب، بل تتيح لك تحرير الصور بطريقة حوارية.

وخلال عطلة نهاية الأسبوع، اكتشف المستخدمون أنه يُمكنه أيضًا إزالة العلامات المائية بدقة، وفقًا لتقارير TechCrunch.

وتُمكّن أدوات مثل Watermark Remover.io بالفعل من إزالة العلامات من شركات مثل Shutterstock، وقد طوّر فريق بحثي في ​​جوجل خوارزمية لإزالة العلامات المائية في عام 2017 لتسليط الضوء على الحاجة إلى حماية أكثر أمانًا.

في المقابل، ترفض بعض أدوات الذكاء الاصطناعي مثل GPT-4o من OpenAI طلبات إزالتها.

مع ذلك، يبدو أن برنامج Gemini 2.0 Flash أفضل من الخيارات الأخرى في إزالة العلامات المائية المعقدة، مثل طوابع Getty Images، وملء الصورة.

ويضيف النموذج بعد إزالة العلامة المائية علامة SynthID، مستبدلًا علامة حقوق الطبع والنشر بعلامة “مُحررة باستخدام الذكاء الاصطناعي”.

ولكن من الممكن أيضًا إزالة علامات الذكاء الاصطناعي هذه باستخدام الذكاء الاصطناعي نفسه، باستخدام أداة مسح الكائنات من سامسونج.

لاحظ المستخدمون أيضًا أن برنامج Gemini 2.0 Flash يمكنه، على ما يبدو، إضافة صور واضحة لأشخاص حقيقيين مثل إيلون ماسك إلى الصور، وهو أمر لا يسمح به نموذج Gemini الكامل.

تتوفر أحدث ميزات الصور في Flash للمطورين فقط من خلال AI Studio في الوقت الحالي – لذا فإن افتقاره الواضح للحواجز الأمنية ليس متاحًا للجميع لاستخدامه (أو إساءة استخدامه).

مقالات قد تعجبك

ميزة جديدة في تطبيق Find My Device لعرض مواقع الأصدقاء
جوجل تتخلى رسمياً عن مساعدها التقليدي لصالح Gemini
جوجل تسمح لـ ChatGPT بأن يكون المساعد الرقمي الافتراضي على أندرويد
ما هو إيثريوم Ethereum 2.0 وما علاقته بالتعدين؟
كيفية حفظ كلمات المرور على جوجل كروم وحساب جوجل

جوجل توسع تجربة AI Overviews في بحث جوجل

أعلنت شركة جوجل أن خدمة AI Overviews أصبحت تعتمد الآن على نموذج Gemini 2.0 في الولايات المتحدة، الأمر الذي سيساعد في حل الأسئلة الصعبة المتعلقة بالترميز والرياضيات المتقدمة والاستعلامات المتعددة الوسائط وتقديم إجابات أسرع وأعلى جودة.

كما تفتخر بأن أكثر من مليار شخص “يستخدمون” خدمة AI Overviews، وهو أمر غير صادق على أقل تقدير، لأن هذه ليست خدمة تختارها – بل يمكنك الحصول عليها متى شاءت جوجل.

لذا فإن هؤلاء “المستخدمين” ليس لديهم حق الاختيار، ولكن الخبر السار هو أن المزيد من الأشخاص لن يكون لديهم أي خيار بعد الآن، حيث تتوسع خدمة AI Overviews الآن لتشمل المراهقين والأشخاص الذين لم يسجلوا الدخول إلى حساباتهم على جوجل.

كما أطلقت الشركة وضع الذكاء الاصطناعي كتجربة في البحث (في الوقت الحالي)، بحيث يمكن في الواقع الاشتراك في هذا الوضع من مختبرات البحث.

إنه يوسع ما يمكن أن تفعله ميزة AI Overviews من خلال “استدلال أكثر تقدمًا والتفكير وقدرات متعددة الوسائط”.

يستخدم وضع الذكاء الاصطناعي إصدارًا مخصصًا من Gemini 2.0 وهو “مفيد بشكل خاص للأسئلة التي تحتاج إلى مزيد من الاستكشاف والمقارنات والاستدلال”، كما تقول Google دون فهم حقيقي لما يعنيه “الاستدلال” أو “التفكير”.

النقطة المهمة هنا هي أنه “يمكنك طرح أسئلة ذات تفاصيل دقيقة ربما كانت تتطلب عمليات بحث متعددة في السابق”، ثم ستحتاج إلى التحقق من جميع الإجابات باستخدام عمليات بحث متعددة إذا كنت تريد الدقة قبل كل شيء.

تجمع هذه التجربة بين “إمكانات النماذج المتقدمة” و”أفضل أنظمة المعلومات في فئتها” من Google، أياً كان معنى أي من هذه الكلمات.

يمكنك الوصول إلى محتوى ويب عالي الجودة، والاستفادة أيضًا من “مصادر جديدة في الوقت الفعلي مثل Knowledge Graph”. هناك أيضًا بيانات تسوق لمليارات المنتجات لأنها موجودة بالطبع.

ستبدأ Google في دعوة مشتركي Google One AI Premium ليكونوا أول من يجرب وضع الذكاء الاصطناعي.

مقالات قد تعجبك

ريلمي تعرض تصميماً مفهومياً لهاتف ذكي يمكن ربط عدسة خارجية معه
آبل تكشف رسمياً عن جهاز iPad Air (2025) بمقاسين 11 و 13 بوصة
شاومي تعرض تصميماً مستقبلياً لعدسة خارجية يمكن توصيلها مع الهاتف
كيفية إيجاد مكان حفظ لقطات الشاشة في نظامي التشغيل ويندوز 10 و 11
كيفية تسجيل الشاشة على ويندوز 11

متصفح كروم على آيفون يحصل على ميزة جديدة للبحث عن أي شيء في الشاشة

أعلنت شركة جوجل Google عن طرح ميزة جديدة تسمح لمستخدمي آيفون iPhone بالبحث عن أي شيء يظهر على شاشة الهاتف بسرعة.

وذلك من خلال ميزة البحث عبر الشاشة باستخدام Lens على نظام التشغيل iOS على تطبيق Google ومتصفح Chrome، وتوفر تجربة مماثلة لميزة Circle to Search على نظام Android، الغير مدعومة على أجهزة iPhone.

ستسمح إيماءات Lens الجديدة لمستخدمي iPhone البحث عن أي شيء في تطبيق Google أو Chrome من خلال رسمه أو تمييزه أو النقر عليه.

تعمل الميزة على كل من النصوص والصور ومقاطع الفيديو، دون الحاجة إلى التقاط لقطة شاشة أو فتح علامة تبويب جديدة.

إحدى حالات الاستخدام الواضحة هي العثور على نتائج التسوق بناءً على صور المنتجات التي تفضلها، ولكن يمكن لـ Lens أيضًا تحديد الكلمات والعبارات؛ تحديد المواقع والنباتات والحيوانات؛ وتنفيذ أي طلب تقريبًا يستطيع بحث Google تنفيذه.

لاستخدام إيماءات Lens الجديدة، يحتاج مستخدمو iPhone إلى فتح قائمة النقاط الثلاث داخل تطبيقات Google أو Chrome وتحديد “Search Screen with Google Lens”.

يمكن للمستخدم بعد ذلك استخدام “أي إيماءة تبدو طبيعية” لتسليط الضوء على ما تريد البحث عنه، حيث تقول الشركة إنها ستضيف رمز Lens الجديد للوصول السريع إلى الميزة إلى شريط العناوين “في الأشهر المقبلة”.

كما كشفت الشركة عن توسيع ميزة AI Overviews أيضًا لتشمل المزيد من نتائج بحث Lens، لتُظهر ملخصات وعناوين URL معززة بالذكاء الاصطناعي عند استخدام أداة بحث الصور.

مقالات قد تعجبك

فيس بوك سيبدأ بحذف تسجيلات البث المباشر بعد مرور 30 يوم من البث المباشر
روكستار تجري محادثات مع مطوري ألعاب لجعل 6 GTA منصة إبداعية
هواوي تطلق هاتفها Mate XT Ultimate المتميز بتصميم ثلاثي الطي للأسواق العالمية
كيفية اختيار وشراء وحدة معالجة مركزية CPU (معالج) جديد
ما هي نقطة اتصال الهاتف المحمول Mobile Hotspot؟

مساعد جوجل الذكي Gemini AI بإمكانه الآن استدعاء المحادثات السابقة

أصبح المساعد الذكي من جوجل Gemini AI قادراً على استدعاء المحادثات السابقة من تلقاء نفسه لتقديم استجابات أكثر صلة إذا كان لدى المستخدم اشتراك في Gemini Advanced عبر Google One AI Premium.

ومن خلال هذا التحديث فلن يضطر المستخدم بعد الآن إلى تلخيص الدردشات السابقة أو البحث عن سلسلة محادثات سابقة لالتقاط محادثة ما، حيث سيكون لدى Gemini بالفعل السياق الذي يحتاجه.

كما ويمكن للمستخدم أيضًا أن يطلب من Gemini تلخيص المحادثات السابقة والبناء على المشاريع الحالية.

لقد طرحت Google بالفعل على نطاق واسع قدرة Gemini على “تذكر” تفضيلات المستخدم، ولكن هذا التحديث الأخير يأخذ الأمور خطوة إلى الأمام من خلال السماح لبرنامج الدردشة الآلية بالإشارة إلى المناقشات من الماضي.

يمكنك مراجعة سجل دردشة Gemini وحذفه وإدارته في أي وقت عن طريق تحديد صورة ملفك الشخصي في الزاوية اليمنى العليا من تطبيق Gemini ثم تحديد “نشاط تطبيقات Gemini”.

يتم الآن طرح ميزة الاستدعاء الخاصة بـ Gemini للمشتركين في خطة Google One AI Premium. ويمكن تجربة الميزة الجديدة باللغة الإنجليزية على موقع ويب Gemini أو تطبيق الهاتف المحمول.

وتقول جوجل إنها تخطط لجلب الميزة إلى المزيد من اللغات، بالإضافة إلى عملاء Google Workspace Business وEnterprise في “الأسابيع المقبلة”.

يمكن لـ ChatGPT أيضًا تذكر التفاصيل والتفضيلات من المحادثات السابقة.

مقالات قد تعجبك

آبل تعيد تفعيل ميزات Apple Intelligence في آخر تحديث لأنظمة iOS و iPad
أدوبي تتيح أداة لإنشاء الفيديو عن طريق الوصف النصي أو الصور عبر تطبيق Firefly
سام ألتمان يكشف عن خطط شركة OpenAI في مجال الذكاء الاصطناعي
كيفية اختيار وشراء وحدة معالجة مركزية CPU (معالج) جديد
ما هي نقطة اتصال الهاتف المحمول Mobile Hotspot؟

جوجل تزيّف إعلان يظهر استخدام Gemini في كتابة وصف موقع ويب

يبدو أنّ جوجل Google قامت بتزييف مخرجات الذكاء الاصطناعي في مجموعة تجارية ليتم تشغيلها خلال إعلانات Super Bowl في الولايات المتحدة الأمريكية.

حيث يُظهر الإعلان مالك نشاط تجاري يستخدم الذكاء الاصطناعي Gemini لكتابة وصف لموقع الويب، ولكن النص الذي تم تصويره على أنه تم إنشاؤه بواسطة الذكاء الاصطناعي كان متاحًا على موقع الويب الخاص بالشركة منذ أغسطس 2020 على الأقل، كما هو موضح في صفحة الويب المؤرشفة.

وكما هو معروف فإن جوجل لم تطلق Gemini حتى عام 2023، مما يعني أن Gemini لم يكن بإمكانها إنشاء وصف موقع الويب كما هو موضح في الإعلان.

يعد الإعلان التجاري المعني جزءًا من سلسلة إعلانات Super Bowl التي توضح كيفية استخدام الشركات الصغيرة في جميع أنحاء الولايات المتحدة لـ Gemini AI في Google Workspace.

في هذا الإعلان تحديدًا، تعرض Google سوق Wisconsin Cheese Mart باستخدام Gemini لكتابة وصف موقع الويب لقائمة Gouda الخاصة بها.

وكان إعلان جوجل Google التجاري يخضع بالفعل للتدقيق لأنه أظهر أن Gemini ينتج معلومات غير صحيحة، حيث أشار إلى أنّ Gouda تمثل “50 إلى 60 بالمائة من استهلاك الجبن في العالم” – وهذا غير صحيح.

وقامت Google لاحقًا بتحرير الإعلان التجاري للحصول على الإحصائيات الصحيحة، بينما قام صاحب العمل أيضًا بإزالتها من موقعه على الويب.

مقالات قد تعجبك

آبل قد تكشف عن هاتف iPhone SE جديد الأسبوع المقبل
سامسونج تكشف عن إصدار Enterprise من هاتفيها الرائدين Galaxy S25 و S25 Ultra
مايكروسوفت تطرح أكبر تحديث للواجهة الرقمية للآلات الموسيقية MIDI على ويندوز 11
كيفية إيقاف تشغيل اهتزاز وصوت لوحة المفاتيح على أندرويد
كيفية معرفة تطبيقات أندرويد التي تستهلك مساحة الجهاز وأيهم الأكثر

جوجل تفكر في إضافة إعلانات إلى مساعد الذكاء الاصطناعي الخاص بها Gemini

قال الرئيس التنفيذي لشركة جوجل، ساندر بيتشاي، في مكالمة هاتفية مع مستثمري شركة Alphabet بعد ظهر اليوم، أن الشركة تفكر في إضافة بعض الإعلانات في مساعدها للذكاء الاصطناعي Google Gemini AI في المستقبل.

في الوقت الحالي، يمكن للجميع الوصول إلى Gemini مجانًا أو الدفع مقابل الاشتراك لاستخدام الميزات المتقدمة، ولكن يبدو أن الإعلانات قد تكون جزءًا من المنتج في مرحلة ما.

خلال المكالمة، سأل أحد المحللين في Wells Fargo بيتشاي عن الطريقة التي يجب أن يفكر بها الناس في “فرصة تحقيق الدخل المستقبلية لـ Gemini” وما إذا كانت الشركة ترى “مكونًا إعلانيًا” محتملاً.

وقال بيتشاي: “فيما يتعلق بتحقيق الدخل، ركزنا في الوقت الحالي على الطبقة المجانية والاشتراكات. ولكن كما رأيت مع مرور الوقت مع Google، فإننا نرغب دائمًا في الريادة في تجربة المستخدم ولدينا أفكار جيدة جدًا لمفاهيم الإعلانات المدمجة مع المحتوى. لكنك ستشاهدنا نتقدم في تجربة المستخدم”.

وبناءً على كلام بيتشاي فقد لا نرى هذه الإعلانات في Gemini قبل عام من الآن، ولكن أعمال Google بشكل عام مبنية على الإعلانات، ويبدو أننا يجب أن نتوقع وصولها إلى Gemini في مرحلة ما.

وكانت جوجل قد أعلنت أيضًا أنها تخطط لإنفاق 75 مليار دولار هذا العام على النفقات الرأسمالية لمساعدتها على مواكبة سباق الذكاء الاصطناعي.

مقالات قد تعجبك

إنفيديا تقول إن وحدات معالجة الرسوميات من سلسلة RTX 50 هي الأسرع لتدريب نماذج DeepSeek
مايكروسوفت تختبر ميزة لربط هواتف آيفون في نظام التشغيل ويندوز 11
جوجل ستوقف عملية مزامنة البيانات في متصفح كروم إذا كان قديماً
كيفية إيقاف تشغيل اهتزاز وصوت لوحة المفاتيح على أندرويد
كيفية معرفة تطبيقات أندرويد التي تستهلك مساحة الجهاز وأيهم الأكثر

جوجل تبدأ بطرح الإصدار التجريبي العام الأول من أندرويد 16

بدأت شركة جوجل في طرح الإصدار التجريبي العام الأول من أندرويد Android 16 بدءاً من يوم أمس، ويتضمن ميزات جديدة مثل ميزة إشعارات شاشة القفل الديناميكية لمشاركة الرحلات وطلبات توصيل الطعام.

كما وسيفرض الإصدار التجريبي الجديد أيضًا على التطبيقات إمكانية تغيير حجمها، للتأكّد من تشغيلها بملء الشاشة على الأجهزة اللوحية والأجهزة القابلة للطي بشكل مناسب.

ومن المتوقع أن يكون هذا هو الإصدار الأول من بين أربعة إصدارات تجريبية عامة قبل الإصدار الكامل لنظام Android 16 في الربع الثاني.

إن ميزة التحديثات المباشرة عبارة عن إشعارات ديناميكية متغيرة تساعد المستخدمين على مراقبة الأنشطة الجارية المهمة والوصول إليها بسرعة من خلال شاشة القفل ويتم تحديثها في الوقت الفعلي.

وهي مشابهة جداً لميزة الأنشطة المباشرة التي أضافتها آبل Apple إلى هواتف iPhone الخاصة بها في عام 2022.

كما وأضافت سامسونج أيضًا ميزة مماثلة في واجهة المستخدم One UI 7، والتي تم عرضها في هواتف Galaxy S25 في حدث Unpacked والذي سمّته الشركة Now Bar.

ومع ذلك في حين أنّ إصدارات آبل Apple وسامسونج Samsung تدعم مجموعة من أنواع التطبيقات والإشعارات، بما في ذلك النتائج الرياضية الحية، إلا أن الميزة الجديدة في Android 16 تقتصر حتى الآن على أجهزة تتبع التقدم.

حيث نوّهت جوجل إلى أن الميزة تُستخدم فقط لمشاركة الرحلات وتوصيل الطعام وتطبيقات الملاحة.

وستظهر هذه الإشعارات الديناميكية المباشرة في أندرويد 16 في الجزء العلوي من حزمة الإشعارات العادية، فيما يظهر شريط Now Bar الخاص بشركة Samsung كإشعار عائم في الجزء السفلي من شاشة القفل، وأما إشعارات آبل فتظهر حول فتحة الكاميرا Dynamic Island.

كما أعلنت الشركة أيضاً عن تقييد قدرة المطورين على قفل حجم واتجاه نوافذ التطبيقات الخاصة بهم، بهدف التأكّد من أنّ التطبيقات “تعمل بسلاسة” على الأجهزة “بغض النظر عن حجم الشاشة وعامل الشكل”.

باختصار: هذا للتأكد من أن التطبيقات تفتح بملء الشاشة على الأجهزة الأكبر حجمًا مثل الأجهزة اللوحية والأجهزة القابلة للطي، ويمكن تغيير حجمها بحرية للقيام بمهام متعددة.

تتضمن الإضافات الأخرى إلى الإصدار التجريبي العام دعم برنامج ترميز الفيديو الاحترافي المتقدم (APV)، واكتشاف المشهد لتمكين الوضع الليلي في تطبيقات الكاميرا، ودعم أفضل لعرض النص الرأسي.

وأكدت جوجل أيضًا أنها تعمل على إضافة المزيد من ملحقات Gemini، بعد أن أطلقت بالأمس قدرة مساعد الذكاء الاصطناعي الخاص بها على العمل عبر تطبيقات متعددة في موجه واحد.

يتم طرح الإصدار التجريبي من Android 16 على هواتف Google Pixel منذ Pixel 6، بالإضافة إلى Pixel Tablet.

تعمل Google على تغيير إيقاع التحديث الخاص بها هذا العام، حيث من المتوقع أن يتم إصدار Android 16 بالكامل في وقت ما في الربع الثاني، بعد الإصدار التجريبي النهائي في أبريل، في وقت أبكر بكثير من نافذة الإصدار المعتادة في الربع الثالث.

مقالات قد تعجبك

سامسونج تكشف رسمياً عن هاتفها الرائد Galaxy S25 Ultra
سعر ومواصفات هاتفي Galaxy S25 و +Galaxy S25 من سامسونج
سامسونج تؤكد رسمياً أنها ستصدر هاتف نحيف جداً من سلسلة Galaxy S25
ما هي قيمة البيانات الشخصية للمعلنين والشركات؟
كيفية تسجيل الشاشة على ويندوز 11

جوجل تختبر نموذج استدلالي جديد للذكاء الاصطناعي Gemini 2.0 Flash Thinking

طرحت شركة جوجل نموذجًا جديدًا للذكاء الاصطناعي وصفته الشركة بأنه “استدلالي” وقادر على الإجابة على الأسئلة المعقدة مع تقديم ملخص لأفكارها.

ويسمى هذا النموذج Gemini 2.0 Flash Thinking ويتم اختباره تجريبيًا الآن ومن المرجح أن يتنافس مع نموذج الاستدلال o1 الخاص بـ OpenAI.

وقال جيف دين كبير العلماء في DeepMind، إن النموذج “تم تدريبه على استخدام الأفكار لتقوية تفكيره”، ويستفيد أيضًا من السرعة التي تأتي مع نموذج Gemini Flash 2.0 الأسرع.

يوضح العرض التوضيحي الذي شاركه دين كيف يقوم برنامج Gemini 2.0 Flash Thinking بالإجابة على مشكلة فيزيائية من خلال “التفكير” من خلال سلسلة من الخطوات قبل تقديم الحل.

وهذا ليس بالضرورة “استدلالاً” في الطريقة التي يؤدي بها البشر ذلك، ولكنه يعني أن الآلة تقوم بتقسيم التعليمات إلى مهام أصغر يمكن أن تؤدي إلى نتائج أقوى.

مثال آخر، نشره لوغان كيلباتريك، رئيس منتج Google، يوضح النموذج وهو يفكر في طريقه لحل مشكلة تتضمن عناصر مرئية ونصية.

كان هناك عدد لا بأس به من التحديثات الملحوظة في مجال الذكاء الاصطناعي في الآونة الأخيرة، حيث كشفت جوجل عن نموذج Gemini 2.0 الذي تمت ترقيته في وقت سابق من هذا الشهر كجزء من دفع الشركة نحو الذكاء الاصطناعي “الوكيل”.

وفي الوقت نفسه، أتاحت OpenAI النسخة الكاملة من نموذج الاستدلال o1 الخاص بها لمشتركي ChatGPT.

مقالات قد تعجبك

بوكو تكشف عن هاتفين جديدين: Poco M7 Pro 5G و Poco C75 5G
آبل توقف تطوير خدمة اشتراك الأجهزة لهواتف آيفون
سوني تعزّز شراكتها مع AMD لدمج تقنيات الذكاء الاصطناعي في ألعاب بلاي ستيشن
إنستغرام ستسمح لمستخدميها بتجميع لحظاتهم المفضلة في 2024
هل وسائل القفل الحيوية (البصمة والوجه) قوية؟

جوجل تكشف عن أداة إنشاء صور جديدة تسمى Whisk

أعلنت شركة جوجل Google عن أداة جديدة للذكاء الاصطناعي تسمى Whisk تتيح إنشاء صور باستخدام صور أخرى كمطالبات بدلاً من المطالبة بمطالبة نصية طويلة.

باستخدام Whisk، يمكن للمستخدم تقديم صور للأداة لاقتراح ما تريده كموضوع ومشهد ونمط الصورة التي يتم إنشاؤها بواسطة الذكاء الاصطناعي.

كما يمكن للمستخدم أيضاً إضافة أوامر نصية، ويمكن أيضاً النقر فوق رمز النرد لجعل جوجل Google يضيف صور بشكل عشوائي للمطالبات.

يمكنك أيضًا إدخال بعض النص في مربع نص في نهاية العملية إذا كنت تريد إضافة تفاصيل إضافية حول الصورة التي تبحث عنها، ولكن هذا ليس مطلوبًا.

سيقوم Whisk بعد ذلك بإنشاء صور ومطالبة نصية لكل صورة، وبعد ذلك يستطيع المستخدم إضافة الصور الناتجة إلى المفضلة أو تنزيلها حتى.

أما إذا النتيجة كانت غير مرضية فيمكن تحسينها عن طريق إدخال المزيد من النص في مربع النص أو النقر فوق الصورة وتحرير المطالبة النصية.

وفي منشور بالمدونة، تؤكد Google على أن Whisk مصمم ليكون “للاستكشاف البصري السريع، وليس لإجراء تعديلات مثالية للبكسل”. تقول الشركة أيضًا أن Whisk قد “يفوت العلامة”، ولهذا السبب يتيح لك تعديل المطالبات الأساسية، ويستغرق إنشاء الصور بضع ثوانٍ فقط.

تقول Google إن Whisk تستخدم الإصدار “الأحدث” من نموذج توليد الصور Imagen 3، الذي أعلنت عنه يوم أمس.

في سياق متصل أعلنت جوجل عن تقديم الإصدار الثاني من نموذج Veo، وهو الإصدار التالي من نموذج توليد الفيديو الخاص بها، والذي تقول الشركة إنه يفهم “اللغة الفريدة للتصوير السينمائي” ويهلوس بشكل أقل من باقي النماذج

يأتي Veo 2 أولاً إلى VideoFX من Google، والذي يمكنك الحصول عليه في قائمة انتظار Google Labs، وسيتم توسيعه ليشمل “منتجات أخرى” على YouTube Shorts في وقت ما من العام المقبل.

مقالات قد تعجبك

برنامج Phone Link لن يعرض الإشعارات التي تتضمن معلومات حساسة
أدوبي تكشف عن ميزة جديدة لإزالة الانعكاسات في الصور الملقتطة عبر النوافذ
واتساب تكشف عن ميزات جديدة للمكالمات الصوتية والمرئية
ما هي آلة Wayback Machine؟ ولماذا هي مهمة؟
هل وسائل القفل الحيوية (البصمة والوجه) قوية؟

جوجل تطلق نموذج جديد لتوليد الفيديو يحمل اسم Veo

أطلقت Google نموذجها الجديد لتوليد الفيديو المدعوم بالذكاء الاصطناعي، “فيو” (Veo)، ضمن معاينة خاصة للشركات، مما يتيح لها دمج هذا النموذج المتقدم في عمليات إنشاء المحتوى. تم الكشف عن فيو لأول مرة في مايو، بعد ثلاثة أشهر من استعراض OpenAI لنموذجها المنافس “سورا” (Sora)، إلا أن Google سبقتها إلى السوق بإطلاق فيو عبر منصة Vertex AI.

ما الذي يميز فيو Veo؟

فيو قادر على إنشاء مقاطع فيديو عالية الجودة بدقة 1080p بمجموعة متنوعة من الأساليب السينمائية والبصرية بناءً على النصوص أو الصور المدخلة. عند الإعلان عنه لأول مرة، كانت المقاطع التي يُنتجها تمتد إلى “أكثر من دقيقة”، لكن Google لم تحدد قيود الطول في الإصدار الحالي. المقاطع الجديدة التي كشفت عنها Google تُظهر مدى صعوبة تمييز الفيديوهات المولدة بالذكاء الاصطناعي عن تلك الحقيقية.

إضافات مميزة في Google Cloud

إلى جانب فيو، أعلنت Google أن أحدث إصدار من مولد الصور “Imagen 3” سيكون متاحًا لجميع عملاء Google Cloud بدءًا من الأسبوع المقبل. يتميز Imagen 3 بإمكانيات مثل تعديل الصور بناءً على النصوص وإضافة العلامات التجارية أو العناصر المخصصة.

الحماية والشفافية

تؤكد Google أن فيو وImagen 3 يتضمنان أدوات أمان مدمجة لمنع إنتاج محتوى ضار أو انتهاك حقوق النشر. بالإضافة إلى ذلك، يتم تضمين تقنية SynthID الرقمية من DeepMind في جميع المحتويات المنتجة، مما يُقلل من مخاطر التضليل وسوء الاستخدام. تُشابه هذه التقنية نظام “أدلة المحتوى” الخاص بـ Adobe.

منافسة متزايدة وتأخر OpenAI

مع إطلاق Google لنموذج الفيديو الخاص بها، يبدو أن OpenAI تتأخر عن المنافسة. وحتى الآن، لم يتم الوفاء بوعد إطلاق “سورا” قبل نهاية عام 2024. في ظل انتشار المحتوى المولّد بالذكاء الاصطناعي في الحملات الإعلانية مثل حملة كوكاكولا الأخيرة، لا تملك الشركات الوقت للانتظار. وفقًا لـ Google، فإن 86% من المؤسسات التي تستخدم الذكاء الاصطناعي التوليدي تشهد زيادة في الإيرادات.

ختامًا

بإطلاق فيو، وضعت Google بصمة جديدة في عالم الذكاء الاصطناعي، وفتحت آفاقًا واسعة للشركات لإنتاج محتوى عالي الجودة بسرعة وكفاءة. الوقت وحده سيكشف ما إذا كانت OpenAI ستتمكن من اللحاق بهذه الوتيرة المتسارعة.