اختبرنا ChatGPT وGemini وClaude بالعربية: من يفهم لغتنا فعلًا؟
وضعنا النماذج الثلاثة أمام مهام عربية يومية واحدة: إيميل رسمي، وتلخيص، وتصحيح لغوي. النتائج لم تكن متساوية أبدًا.
اختبرنا ChatGPT وGemini وClaude على ثلاث مهام عربية يومية بنفس البرومبت. Claude قدّم أكثر لغة طبيعية وأقرب إلى الكاتب العربي، وChatGPT جاء قويًا لكنه يميل إلى الإطناب والحشو، بينما تعثّر Gemini في نبرة الترجمة الحرفية رغم سرعته في التلخيص. التصحيح اللغوي كان الاختبار الأصعب على الثلاثة، وكشف أخطاء في الهمزات وعلامات الترقيم لدى الجميع.
أبرز النقاط
- اختبار موحّد: نفس البرومبت الحرفي للنماذج الثلاثة في 3 مهام يومية
- Claude كتب أكثر إيميل يشبه ما يكتبه موظف عربي حقيقي
- ChatGPT قوي لغويًا لكنه أطنب وأضاف عبارات مجاملة لم نطلبها
- Gemini الأسرع في التلخيص لكن صياغته تفضح أصلها الإنجليزي
- التصحيح اللغوي أسقط الثلاثة في أخطاء الهمزات بدرجات متفاوتة
لماذا يهمّك
ملايين المستخدمين العرب يكتبون يوميًا عبر روبوت المحادثة: رسائل عمل، وتقارير، ومنشورات. لكن معظم المقارنات المنشورة بين النماذج تجري بالإنجليزية، ثم تُعمَّم نتائجها علينا كأن اللغة تفصيل ثانوي.
الفرق بين نموذج يكتب عربية طبيعية وآخر يكتب ترجمة مقنّعة قد يعني الفرق بين إيميل يحترمه عميلك وإيميل يفضح أنك لم تكتبه بنفسك. هذا الاختبار يوفّر عليك التجربة والخطأ.
3 مهام وبرومبت واحد وقواعد صارمة
صمّمنا الاختبار ليكون عادلًا قدر الإمكان. أعطينا النماذج الثلاثة نفس البرومبت (التعليمة النصية التي توجّه النموذج) حرفيًا، بلا أي تعديل، وفي محادثات جديدة تمامًا.
المهام الثلاث كانت:
- إيميل رسمي: رسالة اعتذار لعميل عن تأخر تسليم مشروع أسبوعًا، مع اقتراح موعد جديد.
- تلخيص: اختصار مقال عربي من نحو 900 كلمة إلى 5 نقاط رئيسية.
- تصحيح لغوي: نص فيه 12 خطأ متعمّدًا في الهمزات والتاء المربوطة وعلامات الترقيم وتراكيب شائعة.
لم نستخدم أي تعليمات إضافية عن الأسلوب، لنرى السلوك الافتراضي لكل نموذج كما يراه المستخدم العادي.
الإيميل الرسمي: من يكتب مثل موظف عربي حقيقي؟
Claude قدّم أفضل نتيجة في تجربتنا. الرسالة جاءت مباشرة، بتحية مناسبة، واعتذار واضح بلا مبالغة، وموعد بديل محدد. النبرة تشبه ما يكتبه موظف عربي متمرّس فعلًا.
ChatGPT كتب رسالة صحيحة لغويًا لكنها أطول من اللازم. أضاف عبارات مجاملة متكررة مثل "نثمّن ثقتكم الغالية" و"حرصًا منا على أعلى معايير الجودة" رغم أننا لم نطلبها. القارئ العربي يشمّ رائحة الذكاء الاصطناعي في هذا الحشو فورًا.
Gemini جاءت رسالته الأقرب إلى الترجمة. بدأ بعبارة "نأمل أن تصلكم هذه الرسالة وأنتم بخير"، وهي نقل حرفي للافتتاحية الإنجليزية المعروفة. التركيب سليم نحويًا، لكن الأسلوب لا يشبه ما نكتبه نحن.
التلخيص: السرعة وحدها لا تكفي
هنا انقلبت الموازين جزئيًا. Gemini كان الأسرع، والتقط النقاط الخمس الرئيسية بدقة جيدة، لكنه صاغ بعضها بجمل مبنية للمجهول ثقيلة مثل "تم التأكيد على أهمية".
ChatGPT قدّم تلخيصًا دقيقًا ومرتبًا، لكنه أعاد صياغة نقطة واحدة بطريقة أضافت معنى لم يرد في النص الأصلي. هذه بذرة الهلوسة (اختلاق النموذج لمعلومات غير موجودة)، وهي أخطر ما في مهام التلخيص.
Claude التزم بالنص الأصلي بأمانة أعلى، ولم يضف شيئًا من عنده، لكنه أطال في نقطتين حتى صارتا فقرتين صغيرتين بدل نقطة خاطفة. اختصرناه ببرومبت ثانٍ فاستجاب جيدًا.
التصحيح اللغوي: الاختبار الذي أسقط الجميع
زرعنا في النص 12 خطأ: همزات وصل وقطع، وتاء مربوطة مكان الهاء، و"إنشاء الله" بدل "إن شاء الله"، وأخطاء ترقيم، وتركيب "قمنا بإرسال" الذي نطلب استبداله بالفعل المباشر.
النتائج في تجربتنا:
- Claude: صحّح 10 أخطاء من 12، وفاته خطأ في همزة قطع وخطأ ترقيم. الأهم أنه شرح كل تصحيح بوضوح.
- ChatGPT: صحّح 9 أخطاء، لكنه "صحّح" أيضًا جملتين سليمتين وغيّر أسلوبهما دون داعٍ، وهذا مزعج لمن يريد تصحيحًا لا إعادة كتابة.
- Gemini: صحّح 8 أخطاء، وترك "إنشاء الله" كما هي، وهو خطأ شائع كان اكتشافه هو مربط الاختبار.
الخلاصة هنا واضحة: لا تعتمد على أي نموذج وحده في تدقيق نص سيُنشر باسمك.
نقاط ضعف لن تجدها في صفحات الإعلانات
بعد عشرات المحاولات الإضافية خارج الاختبار الأساسي، تكرّرت أنماط ضعف محددة لدى كل نموذج.
- ChatGPT: الإطناب والمجاملات الزائدة، وميل إلى قالب واحد يتكرر في كل إيميل مهما غيّرت الطلب.
- Gemini: أسلوب الترجمة الحرفية، وأحيانًا يُدخل كلمة إنجليزية وسط النص العربي بلا سبب.
- Claude: الحذر الزائد، فيطيل الشرح والتحفظات حين تكفي إجابة قصيرة، ويحتاج برومبت واضحًا ليختصر.
القاسم المشترك: الثلاثة يتحسّنون كثيرًا مع هندسة البرومبت الجيدة. جملة واحدة مثل "اكتب بعربية طبيعية مباشرة بلا مجاملات زائدة" غيّرت جودة المخرجات بوضوح عند الجميع.
أيّها تختار؟ الجواب يعتمد على مهمتك
لا يوجد فائز مطلق، لكن توجد توصيات عملية بناءً على ما رأيناه:
- للمراسلات الرسمية والكتابة الطبيعية: Claude، بفارق ملموس في نبرة اللغة.
- للتلخيص السريع والمهام المتنوعة: Gemini أو ChatGPT، مع مراجعة الصياغة قبل الاستخدام.
- للتصحيح اللغوي: Claude أولًا، لكن مع مراجعة بشرية إلزامية دائمًا.
وتذكّر أن هذه النماذج تتحدّث بإصدارات جديدة كل بضعة أشهر، وأداؤها العربي يتغير مع كل إصدار. ما رصدناه اليوم قد يختلف بعد نصف عام، لذلك أعد اختبار أداتك المفضلة دوريًا على مهامك أنت، لا على مهام غيرك.
الخلاصة
العربية لم تعد لغة منسية لدى النماذج اللغوية الكبيرة، لكنها ليست لغة أولى بعد. Claude تصدّر اختبارنا في طبيعية اللغة والتصحيح، وChatGPT قدّم قوة لغوية يفسدها الحشو، وGemini أسرع من أسلوبه.
النصيحة العملية: اختر النموذج حسب المهمة، واكتب برومبت واضحًا يحدد الأسلوب، ولا تنشر نصًا عربيًا ولّده الذكاء الاصطناعي قبل قراءته بعين بشرية. النماذج تكتب لك، لكن اسمك أنت على النص.
أسئلة شائعة
أي نموذج ذكاء اصطناعي هو الأفضل للكتابة بالعربية؟
هل يمكن الاعتماد على ChatGPT أو Claude في تدقيق نص عربي قبل نشره؟
لماذا تبدو نصوص الذكاء الاصطناعي العربية كأنها مترجمة عن الإنجليزية؟
كيف أكتب برومبت يحسّن جودة العربية في هذه النماذج؟
ما معنى الهلوسة في تلخيص النصوص وكيف أكتشفها؟
هل تتحسّن هذه النماذج في العربية مع الوقت؟
النقاش (0)
لا توجد تعليقات بعد. كن أول من يشارك برأيه.
كل ما يهمّك في الذكاء الاصطناعي، في 60 ثانية يوميًا
نرصد المئات من المصادر ونرسل لك الخلاصة فقط. بلا حشو، وبلا رسائل مزعجة.