أبحث عن تجاربكم حول التقييم باستخدام الذكاء الاصطناعي التوليدي (GenAI):
كيف نجعله داعماً للتعلّم دون أن يلغِي دور الطالب؟
أسئلة سريعة:
كيف تصممون مهام تقييم تسمح بـ GenAI لكن تُظهر جهد الطالب وتفكيره؟
هل تعتمدون تسليمات مرحلية (فكرة/مخطط/مسودات/نهائي)؟ هل نجحت؟
ما الذي تطلبونه كدليل على التعلم؟ (سجل prompts، تبرير الخيارات، مقارنة مسودات…)
هل لديكم Rubric أو “قواعد صفية” واضحة للاستخدام العادل؟
شاركوني ما نجح وما لم ينجح، وأي نموذج سياسة قصيرة أو rubric سيكون مفيداً جداً.
أنا سمحت بـ GenAI لكن ربطته بأدلة تعلم بسيطة: prompt log مختصر + تبرير قرارين (ليش قبلت/رفضت اقتراحات) + سطر انعكاس. الـ rubric عندي صار خفيف (4 معايير فقط) ويركّز على التفكير والتحقق أكثر من شكل المنتج.
هذا طرح عملي وناضج جدًا، لأنه لا يكتفي بالسماح باستخدام GenAI أو منعه، بل يعيد توجيه التقييم نحو ما ينبغي أن نهتم به فعلًا: كيف يفكّر الطالب، وكيف يقرّر، وكيف يتحقق. أعجبني كثيرًا أنكِ أبقيتِ أدلة التعلّم بسيطة وخفيفة؛ لأن القيمة ليست في كثرة التوثيق، بل في نوعه. أحيانًا سطر انعكاس واحد صادق يكشف من الوعي أكثر مما تكشفه صفحات طويلة. كما أن اشتراط تبرير قرارين: لماذا قَبِل الطالب اقتراحًا، ولماذا رفض آخر فكرة ذكية جدًا، لأنها تنقل الطالب من موقع المستخدم السلبي للأداة إلى موقع المفكّر الذي يزن ويختار. وهنا بالضبط يظهر التعلّم الحقيقي. والـ rubric الخفيف يبدو مناسبًا جدًا لهذا التوجه؛ لأنه لا يشتّت الانتباه بتفاصيل كثيرة، بل يركّز على الجوانب الجوهرية: التفكير، والتحقق، والبصمة الشخصية. هذا النوع من التقييم في رأيي لا يلاحق المنتج بقدر ما يكشف العقل الذي صنعه، وهذه نقطة بالغة الأهمية في زمن الذكاء الاصطناعي.
أنا متحمس لـ GenAI لكن أخاف من فجوة الوصول والمهارات. لذلك عندي قاعدة: مسموح استخدامه بشرط التوثيق، وإلا لا “ميزة” إضافية. الـ rubrics أستخدمها فقط للمهام الكبرى، واليوميات أفضل فيها تغذية راجعة وصفية وإعادة محاولة.
أشارككم تجربة مختصرة من الصف: تصميم المهام مع GenAI دون إلغاء دور الطالب أحوّل التقييم إلى “تقييم للقرار والتفكير”: الطالب يستخدم GenAI مسموح، لكن المطلوب أن يقدّم منتجاً + تفسيراً (لماذا اختار هذا؟ ماذا عدّل؟ ما الذي رفضه؟). التسليمات المرحلية نعم: (فكرة → مخطط → مسودة 1 → نهائي). نجحت لأنها تكشف تطوّر العمل وتقلّل “النص الجاهز”، وتسمح بتغذية راجعة سريعة بين المراحل. دليل التعلّم الذي أطلبه ليس سجلاً طويلاً، فقط: 3–5 prompts مختارة قراران مبرران: اقتراح من GenAI قبلته وآخر رفضته ولماذا سطر واحد: كيف تحققت من معلومة/مصدر أو حسّنت الدقة قواعد استخدام عادلة + Rubric خفيف عندي سياسة قصيرة: GenAI مسموح للتخطيط والتحسين، لكن أي استخدام يجب توثيقه، والطالب مسؤول عن صحة المحتوى. والـ rubric عندي 4 معايير: الفهم، جودة التبرير، التحقق والدقة، وبصمة الطالب (ما الذي أضافه فعلاً).
أنا سمحت بـ GenAI لكن قيّمت التفكير لا “الناتج النهائي”. اعتمدت تسليمات مرحلية (فكرة → مخطط → مسودة → نهائي) ونجحت لأنها تُظهر تطوّر العمل. كدليل على التعلم أطلب فقط: 3 prompts مختارة + قرارين مبررين (قبل/رفض ولماذا) + سطر تحقق من معلومة. والـ rubric عندي خفيف (4 معايير): الفهم، جودة الفكرة/التبرير، الدقة والتحقق، وبصمة الطالب.
ممارسة جميلة جدًا، وفيها قدر واضح من الوعي بالتحدّي الحقيقي الذي فرضه الذكاء الاصطناعي على التقييم. أكثر ما أعجبني هو أنكِ لم تربطي الحكم التربوي بلمعان الناتج النهائي، بل أعدتِ التقييم إلى مكانه الصحيح: التفكير، واتخاذ القرار، ومسار بناء العمل. هذا في رأيي هو التحوّل الأهم. كما أن التسليمات المرحلية هنا تبدو قوية جدًا؛ لأنها لا تكشف فقط تطوّر المنتج، بل تكشف أيضًا تطوّر الفهم. وهذا يمنح المعلم صورة أصدق عن تعلم الطالب، ويجعل من الصعب أن يختبئ الجهد الحقيقي خلف مخرجات جاهزة ومصقولة ظاهريًا. وأرى أن ما طلبتِه كدليل على التعلم ذكي ومتوازن أيضًا: ليس مرهقًا للطالب، لكنه كافٍ لإظهار الوعي، والاختيار، والمسؤولية. وكذلك الـ rubric الخفيف يبدو مناسبًا جدًا لهذا النوع من المهام، لأنه يركّز على ما هو جوهري من دون أن يغرق التقييم في تفصيلات بيروقراطية.
أشارككم ما نجح معي بشكل عملي وبسيط: تصميم المهام: أسمح بـ GenAI لكن أربط الدرجة بـ تفكير الطالب لا بجمال النص. المطلوب دائماً “المنتج + تفسير قصير”: ماذا استخدمت من الأداة؟ ماذا عدّلت بيدك؟ ولماذا؟ التسليمات المرحلية: نعم (فكرة → مخطط → مسودة → نهائي) وكانت فعّالة جداً لأنها تُظهر التطور وتقلل “المخرجات الجاهزة”. أدلة التعلم: لا أطلب سجلات طويلة؛ فقط 3–5 prompts مختارة + تبرير قرارين (قبل/رفض) + سطر تحقق من معلومة/مصدر. قواعد عادلة + Rubric خفيف: سياسة قصيرة: مسموح GenAI للتخطيط والتحسين، لكن التوثيق إلزامي والطالب مسؤول عن الدقة. وRubric من 4 معايير: الفهم، التبرير، التحقق، وبصمة الطالب. ما لم ينجح: تقييم المنتج النهائي وحده—لأنه يخلط بين “جودة الأداة” و“جودة التعلم”.
هذا طرح ذكي جداً لأنه ينقل التقييم من “هل النص جميل؟” إلى “هل الطالب يفهم ويقرر ويتحقق؟” وربط الدرجة بـ التفسير القصير (ماذا استخدمت؟ ماذا عدّلت؟ ولماذا؟) هو بالضبط ما يحافظ على دور الطالب ويقلل الاعتماد الأعمى على GenAI. والأجمل أن الأدلة التي تطلبينها خفيفة لكنها كاشفة: 3–5 prompts + قراران مبرران + سطر تحقق… هذا عملي ولا يرهق لا الطالب ولا المعلم، ومع ذلك يفضح الفهم الحقيقي. ربما إضافة صغيرة تقوّي النموذج أكثر: جعل “التحقق” ليس مجرد سطر، بل مثال واحد (معلومة تحقق منها وكيف عرف أنها صحيحة). بهذه الطريقة يصبح التحقق مهارة مُمارسة لا مجرد إعلان. وخلاصة “ما لم ينجح” مهمة جداً: تقييم المنتج النهائي وحده فعلاً يقيّم جودة الأداة بقدر ما يقيّم جودة التعلم—ونموذجك يتفادى هذا الفخ بذكاء.
طرحك عملي جدًا ومتزن، والأجمل فيه أنه لا يتعامل مع الذكاء الاصطناعي بمنطق المنع أو الانبهار، بل بمنطق إعادة تصميم التعلّم نفسه. أعجبني جدًا تحويل مركز الثقل من “جمال المنتج” إلى تفكير الطالب وراء المنتج، لأن هذا هو السؤال التربوي الحقيقي اليوم: ليس ماذا سلّم الطالب فقط، بل كيف فكّر، وكيف اختار، وكيف عدّل، وكيف تحقّق. كما أن فكرة “المنتج + تفسير قصير” ذكية جدًا؛ لأنها تحفظ مساحة استخدام الأداة، لكن من دون أن تسمح لها بابتلاع صوت الطالب أو مسؤوليته. وكذلك التسليمات المرحلية تبدو هنا أكثر من مجرد تنظيم للعمل؛ إنها في الحقيقة طريقة لكشف مسار التعلّم، وهذا ما نفتقده كثيرًا حين نحاكم الطلاب فقط على النسخة النهائية.