كيف تختبر تطبيقك المبنيّ بالذكاء الاصطناعي حين لم يسبق لك اختبار برمجيات من قبل

دليل عملي لاختبار تطبيق مبنيّ بالذكاء الاصطناعي حين لا تملك خلفية في ضمان الجودة. أين تنقر، وماذا تكسر عمداً، وكيف تعرف متى يصبح جيّداً بما يكفي للمشاركة.

بنيت تطبيقاً بالذكاء الاصطناعي. وهو يعمل على المسار السعيد — تكتب اسمك، تنقر الزرّ، ترى شاشة النجاح. والآن ماذا؟ هل هو جاهز لإرساله إلى مستخدميك التجريبيين الثلاثة؟ إلى فريقك؟ إلى عملائك؟

إن لم تكن لديك خلفية برمجية، فإن الاختبار يبدو واحداً من تلك الأشياء التي يفعلها “المطوّرون الحقيقيون” — بأطر عمل وتأكيدات ومسارات تكامل مستمرّ. والخبر السار: ليس هذا ما يكونه معظم الاختبار فعلاً. معظم الاختبار، خاصةً حين تطلق شيئاً صغيراً وجديداً، هو شخص واحد ينقر هنا وهناك بنيّة. تستطيع فعل ذلك. هذا المقال عن فعله عمداً، كي تجد الأخطاء قبل أن يجدها مستخدموك.

الهدف ليس اختبار تطبيقك المبنيّ بالذكاء الاصطناعي كمحترف. بل اختباره كصديق مرتاب يريده فعلاً أن ينجح.

حيلة القائمتَين

قبل أن تنقر أي شيء، اجلس عشر دقائق مع مستند فارغ واكتب قائمتَين.

القائمة (أ) — المسارات السعيدة. ما الثلاثة أو الأربعة أشياء التي يُفترض بالمستخدم أن يفعلها بهذا التطبيق؟ بالنسبة إلى منتج SaaS نموذجي، قد تكون: التسجيل، وإنشاء أول مشروع، ودعوة زميل واحد، وتصدير نتيجة. وبالنسبة إلى تطبيق على هيئة دليل: البحث، والتصفية، والنقر على إدراج، وحفظه. ثلاثة أو أربعة مسارات حقيقية، بلغة بسيطة.

القائمة (ب) — المسارات غير السعيدة. ماذا لو فعل المستخدم شيئاً صحيحاً تقريباً لكن ليس تماماً؟ كتب بريده الإلكتروني بخطأ مطبعي. ضغط زرّ الرجوع في منتصف المسار. فتح علامتَي تبويب وعدّل الشيء نفسه في كليهما. أرسل نموذجاً فارغاً. لصق محتويات مستند Word — بتنسيقه وكل شيء — في حقل نصّي. أغلق الحاسوب المحمول وأعاد فتحه بعد عشر دقائق. حاول دعوة زميل بعنوان بريد موجود بالفعل في النظام.

قائمة المسار السعيد هي ما حسّنت منصّتك لبناء التطبيقات بالذكاء الاصطناعي من أجله. هي ما اختبره الذكاء الاصطناعي ذهنياً وهو يكتب الشيفرة. أما قائمة المسار غير السعيد فهي حيث تعيش الأخطاء، لأن لا أحد تقريباً — لا الذكاء الاصطناعي، ولا أنت حين كنت تكتب الطلبات — كان يفكّر في تلك الحالات.

حين تختبر فعلاً، اعبر القائمة (أ) أولاً لتأكيد أن الأساسيات تعمل. ثم اقضِ القسم الأكبر من وقتك على القائمة (ب). القائمة (ب) هي حيث تكمن القيمة. والقائمة (ب) أيضاً هي حيث تكتشف ما الذي تريده فعلاً من التطبيق حين تسوء الأمور، وهو ما يفرض غالباً محادثة توضيحية مع منصّة بناء التطبيقات (“حين يكون النموذج نصف ممتلئ، هل ينبغي أن يحذّر أم يحفظ تلقائياً؟”).

ثلاثة أشياء تكسرها عمداً

حالما تكون لديك قائمتاك، إليك ثلاث فئات تلتقط غالبية الأخطاء الحقيقية في التطبيقات المبنيّة بالذكاء الاصطناعي.

المدخلات الفارغة والغريبة. أرسل النموذج دون أي شيء مملوء. أرسله بحقل واحد مملوء. أرسل اسماً طوله 500 حرف. أرسل اسماً فيه رموز تعبيرية. الصق رابطاً في حقل يتوقّع اسماً. جرّب حقل البريد بـ”test”، وبـ”test@”، وبـ”test@example”، وبالعنوان “a@b.co” — هل يقبل عناوين البريد القصيرة المشروعة؟ كثيراً ما تضيف منصّات بناء التطبيقات بالذكاء الاصطناعي تحقّقاً، لكن التحقّق قد يكون خاطئاً في أي اتجاه — صارم أكثر من اللازم (يرفض مستخدمين حقيقيين) أو متساهل أكثر من اللازم (يقبل بيانات فاسدة).

التحرّك للوراء وللجانب. تعمل معظم التطبيقات على ما يرام إن عبرتها كمجموعة سياحية مطيعة. وتنهار لحظةَ أن يستكشف أحدهم. انقر زرّ الرجوع. انقر التقدّم مجدّداً. أعد تحميل الصفحة في منتصف مسار. افتح الصفحة نفسها في علامتَي تبويب وعدّل في كليهما. سجّل الخروج وعد للدخول. إن كان لديك زرّ “تراجع”، انقره ثلاث مرّات متتالية. هذه ليست حالات حدّية. هذه هي الطريقة التي يستخدم بها الناس الحقيقيون البرمجيات.

البيانات بعد ذلك. ابنِ الشيء الذي يبنيه تطبيقك. مشروع، أو منشور، أو سجلّ، أياً كان. ثم عُد غداً. هل لا يزال موجوداً؟ هل نجا التنسيق؟ إن عدّلته، هل يُحفظ التعديل؟ إن حذفته، هل اختفى فعلاً، أم يعود حين تعيد التحميل؟ كثيراً ما تتقن منصّات بناء التطبيقات بالذكاء الاصطناعي مسار “الإنشاء” وتنسى أن كل ما تنشئه يحتاج إلى أن يَثبت وأن يكون قابلاً للتعديل لاحقاً.

كيف يبدو “جيّد بما يكفي”

لن تختبر أبداً تطبيقك المبنيّ بالذكاء الاصطناعي إلى حدّ الكمال. البرمجيات متشابكة أكثر من اللازم ووقتك أثمن من أن يُهدر. السؤال ليس “هل هو مثالي” — بل “هل هو جيّد بما يكفي للمجموعة التالية من الناس التي سأضعه أمامها”.

إليك تدرّجاً تقريبياً يمكنك استعارته.

جيّد بما يكفي للعرض التوضيحي: المسار السعيد يعمل دون انهيار. الأزرار تذهب إلى حيث ينبغي. يمكنك عرض تسجيل شاشة دون قصّ أي شيء.

جيّد بما يكفي للمستخدمين الودودين: المسارات غير السعيدة لا تفقد بيانات. النماذج تخبرك بما هو خاطئ بدل أن تفشل بصمت. إعادة تحميل الصفحة لا تكسر الأشياء. ثلاثة أصدقاء يستطيعون استخدامه دون مراسلتك طلباً للمساعدة.

جيّد بما يكفي للمستخدمين الدافعين: التطبيق يتعامل مع مستخدمين لم تلتقِ بهم قطّ. بمتصفّحاتهم، وبياناتهم، وعاداتهم. لديك طريقة لرؤية متى تُكسر الأمور (تتبّع أخطاء أساسي يكفي — لست بحاجة إلى لوحة فاخرة). تستطيع الإصلاح وإعادة النشر دون كسر من يستخدمونه بالفعل.

يطلق معظم الصُنّاع عند مستوى “المستخدمين الودودين” ثم يرتقون مع ورود الملاحظات. وهذا صحيح. الخطأ هو محاولة القفز من “جيّد بما يكفي للعرض التوضيحي” مباشرةً إلى “جيّد بما يكفي للمستخدمين الدافعين” دون الخطوة الوسطى. المستخدمون الودودون يجدون أشياء كان سيجدها المستخدمون الحقيقيون — لكنهم لا يغضبون منها. استثمر هذه الفجوة.

متى تطلب من الذكاء الاصطناعي أن يختبر نيابةً عنك

تستطيع منصّتك لبناء التطبيقات بالذكاء الاصطناعي المساعدة في الاختبار، لكن عليك أن تكون محدّداً بشأن ما تريده. “أضف اختبارات” نصّ سيّئ. سيولّد شيفرة تبدو كاختبارات وتنجح على الأرجح، دون أن تتحقّق فعلاً من أي شيء يهمّك. معظم تلك الاختبارات المولّدة تلقائياً تؤكّد أن 1+1 لا يزال 2.

نصّ أفضل: “حاولت للتوّ إرسال نموذج التسجيل بحقل بريد فارغ فانهار. اعثر على المكان الذي يُعالَج فيه ذلك وأضف تحقّقاً يعرض خطأً ودوداً بدلاً منه.” خطأ محدّد، وإصلاح محدّد، ونتيجة محدّدة. الذكاء الاصطناعي بارع في هذا. وهو سيّئ في “تأكّد أن تطبيقي خالٍ من الأخطاء” لأن هذا ليس مهمّة — بل أمنية.

الشيء الآخر الذي تبرع فيه منصّات بناء التطبيقات هو إعادة تمثيل خطئك. إن وصفت ما فعلته، وما توقّعته، وما حدث، فيمكن للمنصّة عادةً أن تتتبّع الشيفرة وتقترح إصلاحاً. والانضباط الذي تحتاجه هو انضباط كتابة تلك الأشياء الثلاثة بوضوح. معظم تقارير الأخطاء عند المبتدئين هي نسخة من “إنه لا يعمل”. ومعظم تقارير الأخطاء القابلة للإصلاح هي “نقرت X، توقّعت Y، حصلت على Z”.

الاختبار قراءة، لا مجرّد نقر

شيء أخير. لست مضطراً إلى أن تفهم كل سطر من الشيفرة في تطبيقك المبنيّ بالذكاء الاصطناعي كي تختبره جيداً. لكن ينبغي أن تتصفّحه على الأقل. افتح الملف الذي غيّره الذكاء الاصطناعي للتوّ. اقرأ الدالّة التي أضافها. لست بحاجة إلى معرفة ما تعنيه كل كلمة مفتاحية — بل إلى معرفة ما إن كانت الدالّة تبدو أنها تفعل ما طلبته.

كثير من الأخطاء المبنيّة بالذكاء الاصطناعي ليست “الشيفرة معطّلة”. بل هي “الشيفرة تفعل شيئاً مختلفاً قليلاً عمّا أردته”. حقل يُحفظ في المكان الخطأ. زرّ يحدّث شيئاً واحداً لكن لا يحدّث الشيء المرتبط به. زرّ “حذف” يُخفي بدل أن يحذف. لا يمكنك التقاط تلك دون قراءة ما بُني فعلاً.

عامِل الشيفرة كشيء يمكنك تدقيقه، لا كشيء عليك كتابته. هذا هو الفرق بين تطبيق مبنيّ بالذكاء الاصطناعي تثق به وآخر تأمل فقط أن يعمل.

النسخة المبسّطة

إن لم تتذكّر شيئاً آخر: اكتب القائمتَين، اكسر الأشياء عمداً، وقرّر أي مستوى “جيّد بما يكفي” تطلق عنده. معظم الأخطاء في تطبيق مبنيّ بالذكاء الاصطناعي ليست خفيّة. بل هي جالسة على قائمة المسار غير السعيد التي لم يكلّف أحد نفسه عناء كتابتها.

إن أردت واجباً صغيراً: اختر تطبيقاً واحداً بنيته وجرّب أربعة أشياء — أرسل نموذجاً فارغاً، اضغط إعادة التحميل في منتصف المسار، عدّل سجلاً وتفقّده غداً، واطلب من صديق أن يستخدمه دون أن تراقبه. أياً كان ما يُكسر فهو قائمة أخطائك الحقيقية. وكل ما عداه تسويف.