تعلن Google عن نماذج قادرة على مواصلة المحادثة أثناء تنفيذ مهام في الخلفية. وتفرض هذه السلاسة جعل الانتقال من الكلام إلى الفعل أكثر وضوحًا.
يمكن للمحادثة أن تستمر بينما يجري تنفيذ بحث أو عملية في موضع آخر. وهذه إحدى القدرات التي أبرزتها Google لنموذج Gemini 3.8 Live ونسخته Extended Thinking، اللذين عُرضا في 15 سبتمبر 2026.
التحدث والتنفيذ في آنٍ واحد
وبحسب Google، تستطيع النماذج تشغيل أدوات في الخلفية مع الحفاظ على التبادل. كما تعالج نسخة Live سياقًا بصريًا في زمن شبه فعلي، وتنتقل بين سبع وتسعين لغة مدعومة. أما Extended Thinking فتستهدف المهام التي تتطلب استدلالًا أكثر تعقيدًا.
وهذه القدرات معلنة من جانب المزوّد. ويجب تقييم فعاليتها في وضع بعينه على أساس ذلك الوضع، بدل استنتاجها من عرض توضيحي أو من تصنيف.
اللحظة التي يصبح فيها الكلام ملزِمًا
ففي الاستقبال أو التدريب أو مرافقة زائر، قد يبدو الصوت الذي لا يوقف كل جملة ليستشير أداة أكثر طبيعية. غير أن هذه الاستمرارية تطرح صعوبة في التصميم: إذ يجب أن يعرف المستخدم هل الوكيل يشرح أم يبحث أم يُعدّ أم ينفّذ عملية.
وفي الدار، يُعدّ تأكيد موعد وتعديل معلومة واقتراح خيار أفعالًا مختلفة. وينبغي لواجهة صوتية أن تسمّيها بوضوح وأن تتيح تأكيدًا مناسبًا عندما يلزم القرار العميل أو الشركة.
ولا يقتصر الاختبار المفيد إذن على جودة الصوت. بل يتناول أيضًا المقاطعات والالتباسات وتولّي الإنسان زمام الأمر من جديد: ماذا يحدث إذا غيّر الشخص رأيه بينما بدأت مهمة بالفعل؟
وقد تحسّن السلاسة التجربة إذا أبقت المسؤوليات ظاهرة. ويجب على الخدمة أن تحتفظ بسجل مفهوم لما طُلب وما أُذن به وما نُفّذ فعلًا. فنجاح المحادثة لا يكفي وحده دليلًا على صحة الإجراء.

Cette publication est également disponible en :
