أطلقت شركة جوجل ميزة تعديل الصور من خلال وصف التعديل المطلوب على أجهزة بيكسل Pixel 10، والآن توسع الشركة هذه الميزة لتصبح متاحة الآن على هواتف أندرويد الأخرى.
حيث أعلنت جوجل أن إمكانيات التحرير التفاعلي المدعومة بنظام Gemini متاحة الآن لمستخدمي أندرويد المؤهلين في الولايات المتحدة ابتداءً من اليوم، ويمكن الوصول إليها بالنقر على “مساعدتي في التعديل” في محرر صور جوجل.
سيسمح هذا التحديث لعدد أكبر من مستخدمي صور جوجل وصف تعديلاتهم صوتيًا أو نصيًا بدلًا من استخدام أدوات التطبيق أو أشرطة تمرير التعديلات يدويًا.
الهدف هو جعل تحرير الصور أسرع وأسهل استخدامًا، مما يغني المستخدمين عن استخدام مجموعة متنوعة من أدوات التطبيق المحددة وفهم كيفية عملها معًا.
وتوفر الميزة أيضًا تعديلات مقترحة يمكن للمستخدمين اختيارها، وتعمل مع أوامر مبهمة مثل “تحسينها” أو “استعادة هذه الصورة القديمة”.
من الواضح أن استخدام أوصاف قصيرة وقليلة التفاصيل سيقلل من التحكم في النتائج المحررة، ولكن فعالية طلب تعديلات دقيقة من Gemini تبدو جذابة.
أطلقت شركة جوجل في فعالية “Made On Youtube” التي أُقيمت يوم الثلاثاء في نيويورك مجموعة من الميزات الجديدة المعتمدة على الذكاء الاصطناعي والموجهة لمنشئي المحتوى، يركّز الكثير منها على الأعمال التي تُنفذ خلف الكواليس لإنتاج الفيديو.
وعلى خلاف الأدوات السابقة، مثل مولّد الموسيقى الخلفية بالذكاء الاصطناعي أو الأدوات التي تُنتج صورًا وفيديوهات بالذكاء الاصطناعي، فإن الأدوات الجديدة تندرج في الغالب ضمن ميزات استراتيجية المحتوى، وتساعد المنشئين في الوصول إلى جماهير جديدة (وبشكل أكثر فاعلية أمام جمهورهم الحالي).
من بين الأدوات الجديدة أداة “Ask Studio“، وهي روبوت دردشة بالذكاء الاصطناعي يمكن للمنشئين استخدامها لطرح أسئلة تحليلية حول أداء محتواهم. يصفها “أمجد حنيف”، نائب رئيس إدارة المنتجات، بأنها “شريك إبداعي”:
وتجيب الأداة عن أسئلة مثل كيف يتفاعل الجمهور مع الفيديو؟ ما هي اللحظات الأكثر جذبًا فيه؟، وتسحب الأداة البيانات من جميع أنحاء قناة يوتيوب، بما في ذلك الفيديوهات الطويلة والمقاطع القصيرة، وهي في جوهرها أداة تحليل أسرع وأكثر مباشرة مدمجة في المنصة.
ويمكن للمنشئين أن يطلبوا من الأداة تلخيص التعليقات وتوليف مشاعر المشاهدين، وطلب اقتراحات بناءً على البيانات: إذا أبلغ يوتيوب عن انخفاض في عدد المشاهدين في جزء معين، فإن “Ask Studio” ستقدم نصائح لتحسين ذلك الجزء في المرة القادمة.
كما ويمكن للمنشئين أيضًا أن يطلبوا أشياء مثل “أفكار لفيديوهات من تعليقات الفيديو الأخير”، ويتبعون ذلك بطلبات لاقتراحات العناوين.
ولكن لا تستطيع الأداة حالياً مقارنة قناة بأخرى (مثل الاستفسارات من نوع “ما الفيديوهات التي تؤدي أداءً جيدًا لدى منافسيّ؟”).
كما تم إطلاق ميزة جديدة لاختبار الصور المصغرة والعناوين (A/B)، بناءً على إصدار اختبار الصور المصغرة الذي أُعلن عنه العام الماضي.
مع هذا التحديث، يُمكن للمُنشئين مُزاوجة الصور المصغرة والعناوين وإجراء اختبارات لتحديد أيهما الأفضل أداءً؛ والتركيبة الفائزة هي التركيبة التي تُحقق أعلى وقت مشاهدة.
كما توسع يوتيوب أيضًا بعض أدوات الذكاء الاصطناعي الموجّهة للمشاهدين، مثل الدبلجة، ففي السابق، كان لدى المنشئين إمكانية الوصول إلى ميزة الدبلجة التلقائية، أما الآن فستقوم الميزة أيضًا بمزامنة حركة شفاه اليوتيوبر لتتطابق مع اللغة المدبلجة.
المحتوى الذي يستخدم ميزة الدبلجة بالذكاء الاصطناعي من يوتيوب سيحمل شارة أسفل العنوان وفي وصف الفيديو تشير إلى أنه تم دبلجته تلقائيًا، لكن لن يتمكن المنشئون من مراجعة أو تعديل الأجزاء التي تُرجمت بشكل خاطئ بعد رفع الفيديو.
بدأت واجهة المستخدم One UI 8 بالوصول إلى هواتف سلسلة Samsung Galaxy S25 بدءاً من يوم أمس، لذلك إذا كنت تملك واحداً من هذه الهواتف فما عليك سوى انتظار إشعار تحديث One UI 8 عبر الهواء.
تجدر الإشارة إلى أن طرح التحديث يتم على مراحل ولن يحدث في وقت واحد في جميع الأسواق والأجهزة، لذا لا يزال يتعين على البعض التحلي بالصبر.
كما قدمت سامسونج قائمة رسمية بالأجهزة التي ستحصل على التحديث “لاحقًا هذا العام” وهي على الشكل التالي:
سلسلة Galaxy S
سلسلة جالاكسي Galaxy S24.
جالاكسي S24 إصدار المعجبين (Galaxy S24 FE).
سلسلة جالاكسي Galaxy S23.
جالاكسي S23 إصدار المعجبين (Galaxy S23 FE)
سلسلة جالاكسي إس 22 (Galaxy S22 series)
جالاكسي S21 إصدار المعجبين (Galaxy S21 FE)
سلسلة Galaxy Z القابلة للطي
جالاكسي Z فولد 6 (Galaxy Z Fold6)
جالاكسي Z فليب 6 (Galaxy Z Flip6)
جالاكسي Z فولد 5 (Galaxy Z Fold5)
جالاكسي Z فليب 5 (Galaxy Z Flip5)
جالاكسي Z فولد 4 (Galaxy Z Fold4)
جالاكسي Z فليب 4 (Galaxy Z Flip4)
سلسلة Galaxy Tab اللوحية
سلسلة جالاكسي تاب S10 (Galaxy Tab S10 series)
جالاكسي تاب S10 إصدار المعجبين (Galaxy Tab S10 FE)
جالاكسي تاب S10 لايت (Galaxy Tab S10 Lite)
سلسلة جالاكسي تاب S9 (Galaxy Tab S9 series)
جالاكسي تاب S9 إصدار المعجبين (Galaxy Tab S9 FE)
سلسلة جالاكسي تاب S8 (Galaxy Tab S8 series)
سلسلة Galaxy A
جالاكسي A73 الجيل الخامس (Galaxy A73 5G)
جالاكسي A56 الجيل الخامس (Galaxy A56 5G)
جالاكسي A55 الجيل الخامس (Galaxy A55 5G)
جالاكسي A54 الجيل الخامس (Galaxy A54 5G)
جالاكسي A53 الجيل الخامس (Galaxy A53 5G)
جالاكسي A36 الجيل الخامس (Galaxy A36 5G)
جالاكسي A35 الجيل الخامس (Galaxy A35 5G)
جالاكسي A34 الجيل الخامس (Galaxy A34 5G)
جالاكسي A26 الجيل الخامس (Galaxy A26 5G)
جالاكسي A25 الجيل الخامس (Galaxy A25 5G)
جالاكسي A17 الجيل الخامس (Galaxy A17 5G)
جالاكسي Galaxy A17.
جالاكسي A16 الجيل الخامس (Galaxy A16 5G)
جالاكسي Galaxy A16.
جالاكسي A15 الجيل الخامس (Galaxy A15 5G)
جالاكسي Galaxy A07.
جالاكسي A06 الجيل الخامس (Galaxy A06 5G)
جالاكسي Galaxy A06.
جالاكسي A33 الجيل الخامس (Galaxy A33 5G).
ولا تضمن سامسونج وصول جميع ميزات One UI 8 إلى جميع الأجهزة المؤهلة، كما أن بعض الميزات لن تكون متاحة لجميع الأسواق. القائمة المذكورة هي كما يلي:
تُسلّط سامسونج الضوء على قدرات واجهة One UI 8 على التعرّف على سياق المستخدم وتقديم اقتراحات استباقية تُناسب روتينه اليومي.
تشمل بعض الميزات الجديدة شريط Now Bar، الذي يُظهر نشاط التطبيقات في الوقت الفعلي، وخاصةً حالة مُشغّل الوسائط، مع المزيد من التكاملات مع جهات خارجية في الطريق.
ثم هناك أيضًا واجهة Now Brief، وهي واجهة تُقدّم تحديثات يومية مُخصّصة حول أمور مثل حركة المرور والتذكيرات، بالإضافة إلى مُدخلات من Samsung Moments.
كما تُقدّم Now Brief اقتراحات مثل الموسيقى والفيديو بناءً على اهتماماتك.
وبالطبع، تُواصل سامسونج تعاونها الوثيق مع جوجل، وتُضيف ميزتي Gemini Live وCircle to Search.
بالطبع، مع الدفعة الإضافية نحو الذكاء الاصطناعي، تأتي مخاوف إضافية بشأن الخصوصية، والتي تُعالجها سامسونج بأفضل ما يُمكن.
حيث ضمّنت نظام Knox Enhanced Encrypted Protection (KEEP) ضمن التحديث الجديد، والذي، من بين أمور أخرى، يُشغّل التطبيقات في بيئة Sandbox معزولة خاصة بها ويحمي معلوماتك الحساسة منها.
وهناك أيضًا Knox Matrix، الذي يُسجّل خروج الأجهزة الخطرة تلقائيًا من حساب سامسونج الخاص بك.
كما يَعِد One UI 8 بتلبية مختلف أشكال الأجهزة، وخاصةً الأجهزة القابلة للطي، بشكل أفضل، فهناك عرض جديد لنتائج الذكاء الاصطناعي يعرض نتائج الذكاء الاصطناعي في عرض عائم أو عرض مُقسّم.
كما يمكن سحب وإفلات المحتوى المُولّد بالذكاء الاصطناعي، مثل النصوص والصور، من عرض نتائج الذكاء الاصطناعي إلى تطبيقات أخرى، مثل العرض العائم أو العرض المُقسّم.
الميزة هي أن هذه الهواتف ستكون الأولى التي تدعم إجراء مكالمات واتساب الصوتية والمرئية عبر الأقمار الصناعية.
وستبدأ الميزة بالعمل بدءاً من 28 أغسطس، كما هو موضح في منشور X أدناه.
#Pixel10 has you covered on and off the grid 📍 Pixel devices will be the first to offer voice and video calls on @WhatsApp over a satellite network starting 8/28¹ 🌍 pic.twitter.com/6yDSDMskkK
أعلنت شركة جوجل عن إضافة وضع الذكاء الاصطناعي (AI Mode) إلى خدمة البحث في 180 دولة ومنطقة، مما يسمح لميزة البحث المدعومة بالذكاء الاصطناعي بالتوسع خارج الولايات المتحدة والمملكة المتحدة والهند.
هذا التوسع يعني أنّ المزيد من الأشخاص يمكنهم البحث عن مواضيع باستخدام واجهة تشبه روبوتات الدردشة، على الرغم من أنها لا تزال متوفرة باللغة الإنجليزية فقط.
إلى جانب التوسع العالمي، كشفت شركة جوجل عن تطويرها قدرات جديدة لإدارة العملاء في وضع الذكاء الاصطناعي، بدءًا من حجوزات المطاعم.
الآن، إذا كنت مشتركًا في خدمة Google AI Ultra، يمكنك سؤال وضع الذكاء الاصطناعي عن حجوزات المطاعم، مع تضمين تفاصيل مثل التاريخ والوقت
والموقع وعدد أفراد المجموعة ونوع الطعام الذي ترغب في تناوله. بعد ذلك، سيبحث وضع الذكاء الاصطناعي في منصات الحجز ومواقع الويب للعثور على مطعم متوفر يُلبي احتياجاتك.
يُمكن بعد ذلك الاختيار من قائمة المطاعم وفتحات الحجز، وسيربطك وضع الذكاء الاصطناعي مباشرةً بصفحة الحجز حتى تتمكن من إنهاء حجزك.
وقالت جوجل إنها تعمل مع OpenTable وResy وTock وTicketmaster وStubHub وSeatGeek وBooksy ومنصات أخرى لتشغيل هذه الميزة، بحيث يمكن للمشتركين تجربتها من خلال تفعيل تجربة “قدرات الوكيل في وضع الذكاء الاصطناعي” في المختبرات.
بالإضافة إلى ذلك، تعمل جوجل على جعل ردود وضع الذكاء الاصطناعي أكثر تخصيصًا للمستخدمين في الولايات المتحدة الذين اختاروا تجربة وضع الذكاء الاصطناعي في المختبرات.
هذه الميزة متاحة فقط للمواضيع المتعلقة بتناول الطعام في الوقت الحالي، وستسمح لوضع الذكاء الاصطناعي بالاستفادة من المحادثات السابقة والإشارة إلى الأماكن التي بحثت عنها أو نقرت عليها سابقًا لتوليد نتائج أكثر صلة.
هذا يعني أنه عندما تطلب من وضع الذكاء الاصطناعي توصيات لمكان غداء، فقد يأخذ في الاعتبار أنك بحثت سابقًا عن مطاعم إيطالية، أو أنك تفضل الطعام النباتي، عند تقديم رده.
تتيح جوجل أيضًا للمستخدمين في الولايات المتحدة مشاركة نتائج بحثهم باستخدام وضع الذكاء الاصطناعي عبر رابط.
يمكن الآن النقر على زر “مشاركة” جديد لنسخ رابط الدردشة ولصقه في رسالة، مما يتيح لأصدقائك أو عائلتك متابعة البحث من حيث توقفت. وتشير جوجل إلى أنه يمكنك عرض الروابط المشتركة وحذفها في أي وقت.
أعلنت شركة جوجل عن ميزة جديدة لتطبيق صور جوجل تسمح بما يُعرف بالتحرير التفاعلي للصور، والتي طال الحديث عنها في الأيام الأخيرة.
وهي ميزة تسمح بتعديل الصور من خلال وصف التعديل المرغوب نصياً أو صوتياً ليقوم الذكاء الاصطناعي بإجراء التعديل الموصوف.
وستتوفر هذه الميزة لأول مرة في سلسلة هواتف بيكسلPixel 10 في الولايات المتحدة.
من الواضح أن هذه الميزة مدعومة من نموذج جيميني من جوجل، ولأنه تجربة مفتوحة، لستَ مضطرًا لتحديد الأدوات التي تريد استخدامها، فقط تحدث كالمعتاد، وسيتولى الذكاء الاصطناعي الباقي.
من الأمثلة التي توفرها جوجل: “إزالة السيارات من الخلفية”، “استعادة هذه الصورة القديمة”، “إزالة الانعكاسات وإصلاح الألوان الباهتة”، أو حتى “تحسينها”.
كما تقدم بعض الاقتراحات في حال لم تكن متأكدًا مما تريد، بحيث يمكن إضافة تعليمات متابعة بعد كل تعديل لضبط الإعدادات حسب رغبتك. يمكنك أيضًا تغيير الخلفية، وإضافة عناصر – لا حدود للإمكانيات، فقط اطلب.
كما سيدعم تطبيق Google Photos تقنية C2PA، ما يتيح الاطلاع على معلومات حول كيفية التقاط صورة أو تعديلها بناءً على بيانات C2PA مباشرةً في تطبيق Google Photos، أولاً على سلسلة Pixel 10، وسيتم طرحها تدريجيًا على أجهزة Android وiOS “خلال الأسابيع المقبلة”.
كشفت شركة جوجل في حدثها الأخير عن هاتفها القابل للطي المنتظر والذي سمّته Pixel 10 Pro Fold.
يأتي الجهاز بشاشة OLED قابلة للطي مقاس 8 بوصات بدقة 2076×2156 بكسل، مع سطوع أقصى يبلغ 3000 شمعة، وشاشة OLED خارجية مقاس 6.4 بوصات بدقة 1080×2364 بكسل، مع معدل تحديث 120 هرتز، وسطوع أقصى يبلغ 3000 شمعة، ومعالج Tensor G5 مثل باقي الأجهزة.
يأتي الجهاز مزودًا بشريحة Titan M2، وذاكرة وصول عشوائي LPDDR5X بسعة 16 جيجابايت، وذاكرة تخزين UFS 4.0 بسعة 256 جيجابايت/512 جيجابايت/1 تيرابايت.
من ناحية التصوير يتضمن الهاتف كاميرا رئيسية بدقة 48 ميجابكسل، وكاميرا واسعة الزاوية بدقة 10.5 ميجابكسل مع مجال رؤية 127 درجة، وكاميرا مقربة بدقة 10.8 ميجابكسل مع تقريب بصري 5x، وكاميرتين للسيلفي (واحدة مدمجة في كل شاشة) – كلتاهما بدقة 10 ميجابكسل مع مجال رؤية 87 درجة.
يتميز الجهاز ببطارية بسعة 5015 مللي أمبير/ساعة مع دعم الشحن السلكي بقوة 30 واط والشحن اللاسلكي Qi2 بقوة 15 واط.
ويمكن شحن البطارية سلكياً من صفر إلى 50% في 30 دقيقة، ويعمل هاتف Pixel 10 Pro Fold بنظام Android 16 منذ إصداره، وسيحصل على سبع سنوات من تحديثات Android الرئيسية، وتصحيحات الأمان، وتحديثات Pixel Drops.
الهاتف مقاوم للغبار والماء بمعيار IP68، بسمك 10.8 مم عند طيه، و5.2 مم عند فتحه، ويزن 258 غرامًا.
أما الألوان المتوافرة فهي: اللون الرمادي واللون الأخضر.
يحتوي الهاتف على مستشعر بصمة جانبي مدمج في زر التشغيل، ومكبرات صوت ستيريو، وثلاثة ميكروفونات، ويدعم شبكات Wi-Fi 7، وBluetooth 6، وNFC، وUWB، وشريحتي SIM بفتحة مادية واحدة وفتحة eSIM واحدة.
سيتوفر الهاتف في 9 أكتوبر/تشرين الأول، بسعر 1,799 دولارًا أمريكيًا لسعة تخزين 256 جيجابايت، و 1,919 دولار أمريكي لسعة 1 تيرابايت.
أخيراً وكمقارنة مع الإصدار السابق Google Pixel 9 Pro Fold فإن هذا الهاتف يأتي بشاشة غطاء أكبر قليلاً، وشريحة أفضل، ومساحة تخزين أسرع (وأكبر)، وبطارية أكبر يتم شحنها بشكل أسرع سلكياً ولاسلكياً.
كشفت شركة جوجل في حدثها الأخير عن هاتفيها المنتظرين Pixel 10 Pro و Pixel 10 Pro XL واللذان يتضمنان العديد من الميزات الجديدة أبرزها شريحة جديدة كليًا، وبطاريات أكبر، وشحن مغناطيسي.
ويتطابق الهاتفان تصميمياً مع سابقيهما، ولكنهما متوفران الآن بألوان: أزرق رمادي و أسود وأبيض وأخضر.
يتميز هاتف Pixel 10 Pro بشاشة OLED LTPO مقاس 6.3 بوصة ودقة 1280 × 2856، بينما يأتي Pixel 10 Pro XL بشاشة قطرية مقاس 6.8 بوصة ودقة 1344 × 2992 بيكسل .
كما يوفر كلا الهاتفين معدل تحديث يتراوح بين 1 و120 هرتز.
يبلغ أقصى سطوع للشاشة في كلا الهاتفين 3300 شمعة، كما أنها محمية بطبقة Gorilla Glass Victus 2. كما يحتويان على كاميرا أمامية بدقة 42 ميجابكسل وماسح بصمات أصابع بالموجات فوق الصوتية مدمج في الشاشة.
الإضافة الجديدة الأهم هي شريحة Tensor G5، وهي أول شريحة من جوجل تُصنّعها شركة TSMC (بدلاً من سامسونج)، وتزعم أنها تُحسّن الكفاءة، مما يُفترض أن يُقرّب هواتف Pixel أخيرًا من شريحة Snapdragon الرائدة في نظام أندرويد.
وتتميز هذه الشريحة بمعالج مُحدّث، أسرع بنسبة 34% من Tensor G4، بينما من المتوقع أن تعمل مهام الذكاء الاصطناعي أسرع بنسبة 60%.
الشريحة الجديدة هي أيضًا أول من يعمل على أحدث طرازات جوجل Gemini Nano، وهي مُزودة بشريحة أمان Titan M2. تأتي سلسلة Pixel 10 Pro بذاكرة وصول عشوائي (RAM) بسعة 16 جيجابايت كمعيار أساسي.
وكما هو معروف فإن هواتف بيكسل Pixel تشتهر بكاميراتها، ولكن سلسلة Pixel 10 Pro الجديدة تُعيد استخدام إعدادات الهواتف السابقة.
الكاميرا الرئيسية بدقة 50 ميجابكسل (مستشعر 1/1.3 بوصة) والكاميرا فائقة الاتساع بدقة 48 ميجابكسل (مستشعر 1/2.55 بوصة) من العام الماضي، مُضافًا إليها عدسة مقربة بدقة 48 ميجابكسل (1/2.55 بوصة).
توفر العدسة المقربة تقريب بصري 5x وتقريب هجين يصل إلى 100x. يمكنك أيضًا تسجيل مقاطع فيديو بدقة تصل إلى 8K (والتي تُسمى في الواقع 4K) وبمعدل 30 إطارًا في الثانية.
يتميز هاتف Pixel 10 Pro ببطارية بسعة 4870 مللي أمبير/ساعة مع شحن بقدرة 30 واط، بينما يتميز هاتف Pixel 10 Pro XL ببطارية بسعة 5200 مللي أمبير/ساعة مع سرعة شحن 45 واط.
ولكن هذا ليس كل شيء، إذ يدعم هاتف Pixel الجديد أيضًا الشحن اللاسلكي Qi 2 بسرعة 15 واط في Pixel 10 Pro و25 واط في Pixel 10 Pro XL، بفضل Pixelsnap، النسخة الجديدة من MagSafe من Google.
من ناحية البرمجيات، تأتي سلسلة Pixel 10 مزودةً بنظام Android 16 وواجهة المستخدم الجديدة Material 3 Expressive من Google، ويدعم ذلك 7 سنوات من تحديثات نظام التشغيل والأمان وتحديثات Pixel Drop.
كلا هاتفي بيكسل الجديدين حاصلان على تصنيف IP68، ويأتيان مع تقنيات Wi-Fi 7، والنطاق العريض للغاية، وبلوتوث 6.
يبدأ سعر هاتف Pixel 10 Pro بسعة تخزين 128 جيجابايت من 999 دولارًا أمريكيًا، فيما يبدأ سعر هاتف Pixel 10 Pro XL بسعة تخزين 256 جيجابايت من 1199 دولارًا أمريكيًا، وسيصل الجهاز في 28 آب الحالي.
أعلنت شركة جوجل أن تطبيق مستندات جوجل سيتمكن الآن من إنشاء نسخة صوتية من المستندات باستخدام الذكاء الاصطناعي.
وفي منشورٍ للإعلان عن إطلاق الميزة، ذكرت جوجل أنه يُمكنك تخصيص إخراج الصوت المُعزّز بالذكاء الاصطناعي في جيميني بأصوات وسرعات تشغيل مُختلفة.
هذه الميزة ليست مُخصصة لمُنشئي المستندات فحسب، إذ تُشير جوجل إلى أنه يُمكن للقراء الوصول إلى الصوت المُولّد بالذكاء الاصطناعي في مستند مُشترك من خلال اختيار القائمة المُنسدلة “الأدوات” واختيار “الصوت” > “الاستماع إلى هذه العلامة”.
كما يُمكن للمؤلفين إضافة زر صوت قابل للتخصيص مباشرةً في المستند باختيار “إدراج” > “الصوت”، والذي يُمكن للقراء النقر عليه لبدء الاستماع.
وكانت شركة جوجل قد أعلنت في شهر نيسان/أبريل الماضي عن خططها لتحويل المستندات إلى بودكاستات ذكاء اصطناعي، ولكن هذه الميزة تبدو أكثر فائدة إذا كنت ترغب فقط في الاستماع إلى ما كتبته.
حاليًا، يمكن للمستخدم فقط إنشاء نسخ صوتية من المستندات باللغة الإنجليزية وعلى أجهزة الكمبيوتر.
وتُتيح جوجل إمكانية الاستماع الصوتي في مستندات Google لمستخدمي Workspace الذين لديهم باقات Business أو Enterprise أو Education، بالإضافة إلى المشتركين في باقات AI Pro وUltra.
أطلقت جوجل ديب مايند DeepMind إصدارًا جديدًا من نموذج “العالم” المُدمج بالذكاء الاصطناعي، يُسمى Genie 3، القادر على توليد بيئات ثلاثية الأبعاد يُمكن للمستخدمين ووكلاء الذكاء الاصطناعي التفاعل معها آنيًا.
كما تَعِد الشركة المستخدمين بالتفاعل مع العوالم لفترة أطول بكثير من ذي قبل، وبأن النموذج سيتذكر مواقع الأشياء عند إبعاد النظر عنها.
وتعتبر نماذج العالم هي نوع من أنظمة الذكاء الاصطناعي التي تُحاكي البيئات لأغراض مثل التعليم والترفيه، أو للمساعدة في تدريب الروبوتات أو وكلاء الذكاء الاصطناعي.
باستخدام نماذج العالم، تُعطيها مُحفزًا، فتُنشئ مساحة يُمكنك التحرك فيها كما في ألعاب الفيديو، ولكن بدلًا من إنشاء العالم يدويًا باستخدام أصول ثلاثية الأبعاد، يتم توليده بالكامل باستخدام الذكاء الاصطناعي.
يبدو أن جيني 3 سيكون خطوةً مهمةً للأمام، حيث سيتمكن المستخدمون من إنشاء عوالم باستخدام موجه يدعم “بضع دقائق” من التفاعل المستمر، وهو ما يزيد عن 10-20 ثانية من التفاعل الممكن في جيني 2.
وقالت جوجل إن جيني 3 يمكنه الاحتفاظ بالمساحات في الذاكرة البصرية لمدة دقيقة تقريبًا، مما يعني أنه إذا ابتعدتَ عن شيء ما في عالم ما ثم عدت إليه، فستجد أشياءً مثل الطلاء على الحائط أو الكتابة على السبورة في نفس المكان، وستتمتع العوالم أيضًا بدقة 720 بكسل وستعمل بمعدل 24 إطارًا في الثانية.
وأضافت DeepMind أيضًا ما تُسميه “أحداثًا عالمية قابلة للتوجيه” إلى Genie 3. باستخدام مُوجِّه، ستتمكن من القيام بأشياء مثل تغيير أحوال الطقس في عالم ما أو إضافة شخصيات جديدة.
وسيتم إطلاق هذا النموذج كـ”معاينة بحثية محدودة” متاحة “لمجموعة صغيرة من الأكاديميين والمبدعين” ليتمكن مطوروه من فهم المخاطر بشكل أفضل وكيفية الحد منها بشكل مناسب، وفقًا لجوجل.
وهناك أيضًا العديد من القيود، مثل الطرق المحدودة التي يُمكن للمستخدمين من خلالها التفاعل مع العوالم المُولّدة، وأن النص المقروء “غالبًا ما يُولّد فقط عند تقديمه في وصف العالم المُدخل”، وقالت جوجل إنها “تستكشف” كيفية توفير Genie 3 “لمختبرين إضافيين” لاحقًا.