WPML

سجّل Private Translation Cloud (PTC) من WPML درجة 90.0 من أصل 100 في تقييم جودة الترجمة الداخلي الخاص بـ WPML. وسجّل DeepL — الذي يُعتبر على نطاق واسع أقوى محرك ترجمة AI سائد — 77.7. يتفوق PTC على DeepL بفارق 12.3 نقطة إجمالاً، ويفوز في كل بُعد من أبعاد الجودة التسعة التي قيّمها اللغويون لدينا، ويحقق انخفاضاً يقارب 18× في الأخطاء لكل صفحة.

لمحة سريعة

المقياس DeepL شعار PTC PTC
متوسط درجة جودة الترجمة (0–100) 77.7 90.0
متوسط المشكلات لكل صفحة مترجمة 1.27 0.07
أبعاد الجودة التي تفوق فيها PTC على DeepL 9 من 9
اللغات المختبرة التي تفوق فيها PTC على DeepL 6 من 6 (العربية، الإنجليزية، الفرنسية، الألمانية، الإيطالية، الإسبانية)

لماذا أجرينا هذه الدراسة

بناءً على ملاحظات عملائنا، يُعتبر DeepL على نطاق واسع المعيار لجودة ترجمة AI في نظام WordPress البيئي. وعندما يسأل العملاء عما إذا كان بإمكانهم نشر محتوى مترجم بواسطة الذكاء الاصطناعي دون مراجعة بشرية، يكون DeepL عادةً هو نقطة المقارنة الضمنية.

بنت WPML محرك ترجمة AI الخاص بها — Private Translation Cloud (PTC) — لأن «جيد بما فيه الكفاية» لم يكن كذلك. يُعد PTC المحرك الافتراضي داخل وضع ترجم كل شيء في WPML، ويُشغّل الجزء الأكبر من الترجمة التلقائية عبر أكثر من 1.5 مليون موقع يعمل بإضافة WPML.

أردنا إجابة قابلة للقياس على سؤال يطرحه علينا العملاء المحتملون كل أسبوع: كيف يُقارن PTC فعلياً بـ DeepL؟ هذه الدراسة هي تلك الإجابة. الأرقام المذكورة أعلاه هي العنوان الرئيسي؛ وتشرح بقية هذه المقالة كيف تم إنتاجها وما تعنيه بالنسبة لموقع مباشر حقيقي.

ما قمنا بقياسه وكيفية ذلك

قمنا بتقييم جودة الترجمة باستخدام نظام يعتمد على MQM (مقاييس الجودة متعددة الأبعاد)، وهو نفس الإطار الذي يستخدمه فريق اللغويات في WPML للمراجعات المستمرة لمواقع عملاء PTC. يتم تقييم كل صفحة مترجمة عبر تسعة أبعاد:

  • القواعد النحوية — هل كانت هناك أخطاء نحوية؟
  • المعنى — هل تم الحفاظ على معنى النص المصدر؟
  • الطبيعية — هل يبدو النص طبيعياً واصطلاحياً لمتحدث أصلي؟
  • النبرة — هل تم التقاط نبرة النص المصدر؟
  • الرسمية — هل استُخدم المستوى اللغوي الصحيح، سواء في مخاطبة القارئ أو في صيغ المخاطبة النحوية؟
  • المصطلحات — هل استُخدمت المصطلحات الصحيحة؟
  • الاتساق — هل طُبقت المصطلحات بشكل متسق عبر الصفحة؟
  • استخدام الأحرف الكبيرة — هل تم اتباع اصطلاحات اللغة الهدف؟
  • أقلمة الأرقام، والوحدات، والتواريخ — هل تم اتباع اصطلاحات اللغة الهدف؟

يتم تقييم كل بُعد من 1–10 بواسطة لغوي بشري متحدث أصلي للغة الهدف. الدرجة النهائية لكل صفحة هي المتوسط عبر الأبعاد التسعة، مضروباً في عشرة — مما ينتج عنه مقياس من 1–100 يتوافق مع نطاقات جودة واضحة:

الدرجة ما تعنيه
90–100 جيد جداً إلى مثالي — جاهز للنشر دون مراجعة
80–89 جيد — جاهز للنشر في معظم السياقات
70–79 مقبول إلى متوسط — قابل للاستخدام ولكن الأخطاء واضحة
60–69 متوسط — يحتاج إلى تعديلات قبل النشر
50–59 أخطاء واضحة لغير المتحدثين الأصليين
أقل من 50 عيوب كبيرة لدرجة تتطلب إعادة العمل

للتوضيح: يبلغ المتوسط المنشور لـ الترجمة البشرية العامة حوالي 76. وتضع درجة 77.7 محرك DeepL فوق هذا الخط بقليل. بينما تضع درجة 90.0 محرك PTC تماماً عند حدود نطاق «جيد جداً — جاهز للنشر دون مراجعة».

حجم العينة والاختيار

لتقييم DeepL، أخذنا 800 موقع عشوائي تمت ترجمتها باستخدام DeepL في الأشهر الـ 12 الماضية، وصنفناها حسب عمر الموقع، وحجم المحتوى، ونشاط الترجمة، وأخذنا عينات عبر هذه التصنيفات. ثم قام اللغويون لدينا بمراجعة الصفحات الرئيسية للمواقع المختارة يدوياً — 227 صفحة ويب في المجموع، تم تقييمها باللغات العربية، والإنجليزية، والفرنسية، والألمانية، والإيطالية، والإسبانية.

تأتي درجة PTC من عينة منفصلة: 73 مراجعة لمواقع مباشرة، تم تقييمها بواسطة نفس اللغويين باستخدام نفس منهجية MQM الموضحة أعلاه. عينة PTC أصغر من عينة DeepL لأن كل قياس لـ PTC يعكس إصداراً محدداً من PTC، والمحرك مستمر في التطور — انظر قسم لم ننتهِ بعد أدناه.

لكل لغة: يفوز PTC في كل زوج لغوي

الدرجات الإجمالية مثيرة للاهتمام؛ لكن الصورة التفصيلية لكل لغة هي ما يخبر فريق المحتوى متعدد اللغات بما يمكن توقعه.

درجات جودة الترجمة (TQ) حسب اللغة

مخطط صندوقي يقارن درجات جودة الترجمة لـ PTC و DeepL عبر اللغات العربية، والألمانية، والإنجليزية، والإسبانية، والفرنسية، والإيطالية. يُظهر PTC درجات متوسطة أعلى باستمرار وتوزيعات درجات أكثر إحكاماً عبر جميع اللغات.
درجات جودة الترجمة حسب اللغة — PTC مقابل DeepL عبر اللغات العربية، والألمانية، والإنجليزية، والإسبانية، والفرنسية، والإيطالية

يسجل PTC درجات أعلى من DeepL في كل زوج لغوي اختبرناه. الفجوة الأكبر هي في اللغة العربية (+22.4 نقطة)، حيث كان أداء DeepL تاريخياً ضعيفاً وحيث يظهر استثمار WPML في جودة اللغات التي تُكتب من اليمين إلى اليسار (RTL) بوضوح. تأتي الألمانية (+11.5) و الفرنسية (+9.9) في المرتبة التالية. الفجوة الأضيق هي في الإنجليزية (+6.0 نقاط) — وحتى هناك، ينقل PTC الصفحة من نطاق «مقبول، ولكنه غير مثالي بوضوح» إلى نطاق الجاهزية للنشر.

التباين مهم أيضاً. يحتوي توزيع DeepL على ذيل سفلي طويل في اللغة العربية، مع تسجيل صفحات فردية درجات أقل بكثير من المتوسط — وهي صفحات قد يعتبرها المستخدم الألماني أو الفرنسي معطلة. توزيعات PTC أكثر إحكاماً وتتركز في مستوى أعلى، لذلك يمكن لفريق المحتوى التخطيط بناءً على نطاق جودة متوقع بدلاً من وضع ميزانية للقيم المتطرفة.

يتفوق PTC أيضاً على DeepL في كل بُعد من أبعاد الجودة التسعة التي نقيّمها: القواعد النحوية، والمعنى، والطبيعية، والنبرة، والرسمية، والمصطلحات، والاتساق، واستخدام الأحرف الكبيرة، واصطلاحات الأقلمة. المكاسب الأكبر هي في الأبعاد الأكثر أهمية لإنسان يقرأ صفحة على موقع ويب حقيقي — المصطلحات (+1.5)، و القواعد النحوية (+1.4)، و الطبيعية (+1.4)، و أقلمة الأرقام/الوحدات/التواريخ (+1.4). لا يوجد بُعد يواكب فيه DeepL، ولا يوجد بُعد يتقدم فيه PTC بصعوبة فقط.

معدل الأخطاء: الصورة التشغيلية

متوسط الدرجات مفيد؛ لكن أعداد الأخطاء أكثر فائدة لأي شخص يدير موقعاً حقيقياً. سجّل المراجعون لدينا كل مشكلة مميزة حددوها في كل صفحة — القواعد النحوية، والمعنى، والمصطلحات، وكل شيء.

متوسط المشكلات لكل صفحة

مخطط شريطي يوضح متوسط المشكلات لكل صفحة: DeepL ~1.27، PTC ~0.07، حيث يكون PTC أقل بكثير من DeepL.
متوسط المشكلات لكل صفحة — DeepL ~1.27، PTC ~0.07

يُنتج DeepL في المتوسط 1.27 مشكلة لكل صفحة. بينما يُنتج PTC 0.07 — وهو انخفاض يقارب 18× في الأخطاء لكل صفحة على نفس المحتوى المصدر.

بالنسبة لموقع مكون من 200 صفحة، يُترجم ذلك تقريباً إلى:

  • DeepL: ~254 مشكلة يجب العثور عليها، واتخاذ قرار بشأنها، وإصلاحها قبل النشر.
  • PTC: ~14 مشكلة في الموقع بأكمله.

هذا هو الفرق بين ترجمة AI كـ مسودة أولى وترجمة AI كـ سير عمل. بناءً على تقييمنا، يُعد DeepL مسودة أولى قوية — حيث وجدت قياساتنا مشكلات قابلة للمراجعة في معظم الصفحات قبل النشر. أما PTC، وفقاً لهذا القياس، فهو سير عمل: عدد الأخطاء منخفض بما يكفي لجعل خطوة المراجعة البشرية اختيارية لمعظم المحتوى بدلاً من كونها إلزامية للجميع.

ما يعنيه مصطلح «ترجمة جيدة» حقاً

تُعد أوصاف الدرجات في إطار عمل MQM موازنة مفيدة للغة التسويقية التي تحيط بترجمة AI. الصفحة الحاصلة على «9/10» ليست صفحة بنسبة 90%؛ بل هي صفحة لا يجد فيها المتحدث الأصلي، عند القراءة بعناية، أي شيء يرغب في تغييره. الصفحة الحاصلة على «7/10» مقبولة كما هي ولكنها غير مثالية بوضوح. أما الصفحة الحاصلة على «5/10» فهي صفحة يمكن لغير المتحدث الأصلي اكتشاف الأخطاء فيها.

يقع متوسط DeepL في أواخر الـ 7 — مقبول، ولكنه غير مثالي بوضوح لقارئ أصلي دقيق. بينما يقع متوسط PTC عند 90.0، تماماً عند حدود «جيد جداً — جاهز للنشر دون مراجعة». هذا هو فرق الجودة الذي قاسه المراجعون لدينا. وهو يُترجم إلى تمييز حقيقي: مخرجات DeepL هي نقطة انطلاق تتطلب مراجعة بشرية قبل النشر؛ أما مخرجات PTC فهي في معظم الحالات النشر بحد ذاته.

لماذا تستطيع WPML إنتاج هذه الجودة

نحن ندرك أن عبارة «لقد بنينا محرك AI الخاص بنا» هي ادعاء تقدمه الكثير من الشركات في الوقت الحالي. يُعد PTC استثنائياً لسببين محددين.

النطاق الواسع والمراجعة المستمرة. تخدم WPML أكثر من 1.5 مليون موقع وقد فعلت ذلك لأكثر من عقد من الزمان. يراجع فريق اللغويات في WPML باستمرار جودة ترجمة PTC — من خلال أخذ عينات من المخرجات، وتقييمها بنفس إطار عمل MQM المستخدم في هذه الدراسة، ومراقبة الأنماط التي يُنتج فيها المحرك باستمرار نتائج أقل جودة لمصطلح معين، أو زوج لغوي، أو نوع محتوى.

التركيز. ليس PTC مشروعاً جانبياً في WPML. بل لديه فريق مخصص — مهندسون، وخبراء عمليات تعلم الآلة (MLOps)، ولغويون بشريون. عندما يُشير اللغويون إلى نمط متكرر، يتعامل معه الفريق الهندسي كخلل برمجي (bug): توسيع المسرد، وتعديل نموذج الرسمية، وإضافة استثناء، وإصدار الإصلاح. تعمل هذه الحلقة بشكل مستمر، ولهذا السبب تحسنت جودة PTC على مدار الـ 12 شهراً الماضية من «جيدة مثل متوسط الترجمة البشرية» إلى الأرقام الواردة في هذه الدراسة.

هذا المزيج — المراجعة البشرية المستمرة على نطاق واسع، مقترنة بفريق يستجيب لكل نتيجة كتذكرة هندسية — هو ما يُنتج أرقام الجودة المذكورة أعلاه. إنها ليست بنية النموذج؛ بل هو نموذج التشغيل.

لم ننتهِ بعد

تضع درجة 90.0 محرك PTC تماماً عند حدود «جيد جداً — جاهز للنشر دون مراجعة». نحن سعداء بهذه النتيجة. لكننا لا نعتقد أنها السقف.

لا تزال حلقة ضمان الجودة (QA) ← الهندسة الموضحة أعلاه قيد التشغيل. يواصل فريق اللغويات في WPML تحليل التعديلات التي يجريها العملاء على مخرجات PTC في المواقع الحقيقية، ويحدد الأنماط التي تكشف عنها تلك التعديلات، ويُصدر الفريق الهندسي الإصلاحات — توسيعات المسرد، وتعديلات الرسمية، والتعديلات الخاصة بأزواج لغوية معينة. نتوقع أن يكون القياس التالي أعلى من هذا القياس.

ما يعنيه هذا لسير عملك

سير عمل المحتوى متعدد اللغات التقليدي هو الترجمة ← المراجعة ← النشر. خطوة المراجعة موجودة لأن كل محرك AI — ومعظم المترجمين البشريين — يُنتج عملاً يحتاج إلى زوج ثانٍ من العيون قبل إصداره. خطوة المراجعة تلك هي أيضاً حيث تكمن معظم التكلفة ومعظم التأخير في المحتوى متعدد اللغات.

بناءً على قياساتنا، يُنصح بخطوة مراجعة مع DeepL. وجد تقييمنا متوسط 1.27 مشكلة لكل صفحة؛ وإذا لم تتم مراجعتها، فمن المحتمل أن يواجهها القراء. أما مع PTC، فإن خطوة المراجعة اختيارية لمعظم المحتوى. لا تزال بعض الفرق تقوم بالمراجعة — للصفحات عالية الأهمية أو الصناعات الخاضعة للوائح التنظيمية — ولكن سير العمل الافتراضي يصبح الترجمة ← النشر، مع الاحتفاظ بالمراجعة للحالات التي تحتاجها بالفعل.

هذا هو الفرق التشغيلي الذي تصفه الأرقام. وهو ليس فرقاً صغيراً.

ما يعنيه هذا لتكاليفك

تكلفة الترجمة هي شيئان: تكلفة إنتاج الترجمة وتكلفة مراجعتها. يجب دفع كليهما قبل نشر المحتوى.

في معظم السياقات الاحترافية، تكلف المراجعة البشرية بضعة سنتات لكل كلمة — سواء كان المراجعون يتقاضون أجورهم لكل كلمة، أو لكل صفحة، أو لكل موقع، فهذا هو تقريباً ما تصل إليه الحسابات. تبلغ تكلفة الترجمة البشرية الكاملة (الترجمة، ثم المراجعة بواسطة إنسان ثانٍ) عادةً حوالي 0.10 €–0.20 € لكل كلمة للأزواج اللغوية الرئيسية، مع كون جزء المراجعة وحده في نطاق 0.04 €–0.08 €.

إليك ما يكلفه كل سير عمل فعلياً بهذه الشروط.

الترجمة البشرية وحدها — خط الأساس. حوالي 0.10 €–0.20 € لكل كلمة. كلتا الخطوتين بشريتان.

DeepL (أو أي محرك AI) بالإضافة إلى المراجعة البشرية. يتولى الذكاء الاصطناعي خطوة الترجمة؛ ولا يزال يتعين على إنسان مراجعة كل صفحة، لأنه بمعدل 1.27 مشكلة لكل صفحة، ستصل المشكلات إلى العملاء إذا لم يكتشفها أحد أولاً. خطوة الترجمة مجانية أساساً؛ لكن خطوة المراجعة لا تزال تكلف 0.04 €–0.08 € لكل كلمة. إجمالي التوفير مقابل الترجمة البشرية فقط: حوالي 60%. هذا هو العرض التسويقي القياسي «الذكاء الاصطناعي يوفر لك المال في الترجمة» — وهو صحيح — لكن سقف التكلفة يكمن في خطوة المراجعة التي لا تزال جودة DeepL تتطلبها.

PTC، لا حاجة للمراجعة. يكلف PTC 0.0012 €–0.003 € لكل كلمة — 4 أرصدة لكل كلمة مضروبة في 0.30 €–0.75 € لكل 1,000 رصيد حسب الحجم، مع كون أول 2,000 رصيد شهرياً مجانية. (انظر تسعير الترجمة التلقائية في WPML للحصول على جدول الفئات الكامل). ولأن جودة PTC المُقاسة (درجة TQ تبلغ 90.0، و 0.07 مشكلة لكل صفحة، وفجوة +12.3 نقطة على DeepL) عالية بما يكفي لتخطي خطوة المراجعة في معظم الحالات، فإن تكلفة المراجعة تصبح صفراً. إجمالي التوفير مقابل الترجمة البشرية فقط: حوالي 99%.

هذا ليس تحسيناً هامشياً على سير عمل الذكاء الاصطناعي بالإضافة إلى المراجعة. إنه نظام تكلفة مختلف تماماً.

لمحة سريعة — تكلفة نشر كلمة مترجمة

سير العمل الترجمة المراجعة الإجمالي التوفير مقابل الترجمة البشرية
ترجمة بشرية كاملة 0.10 €–0.20 € مضمّنة 0.10 €–0.20 €
DeepL + مراجعة بشرية ~0 € 0.04 €–0.08 € 0.04 €–0.08 € ~60%
PTC، لا مراجعة 0.0012 €–0.003 € 0 € 0.0012 €–0.003 € ~99%

أسعار الترجمة البشرية هي تقديرات نموذجية للصناعة بالنسبة للأزواج اللغوية الرئيسية. أسعار PTC مأخوذة من الأسعار المنشورة لـ WPML.


ملاحظة حول إجراء المراجعة بنفسك: عندما يقوم صاحب العمل بالمراجعة بنفسه بدلاً من الدفع لمراجع، فإن التكلفة ليست صفراً — بل هي ببساطة أقل وضوحاً. الساعات التي تُقضى في المراجعة هي ساعات لا تُقضى في بقية أعمال الشركة، وبأي معدل معقول في الساعة، تكون التكلفة الضمنية عادةً أعلى مما قد يتقاضاه مراجع خارجي، وليس أقل. ينطبق توفير PTC بغض النظر عمن يدفع مقابل خطوة المراجعة اليوم.

ما يفتحه هذا من آفاق. عندما تكلف الترجمة 0.10+ € لكل كلمة، فإنك تترجم بشكل انتقائي — الصفحة الرئيسية، وأهم فئات المنتجات، ومجموعة من مقالات المدونة ذات الزيارات العالية. ويبقى كل شيء آخر باللغة المصدر لأن الحسابات لا تُجدي نفعاً. أما عندما تكلف الترجمة 0.002 € لكل كلمة وتُنتج مخرجات أفضل من الترجمة البشرية النموذجية، فإن الحسابات تُجدي نفعاً للمحتوى الذي لم يكن قابلاً للتطبيق من قبل:

  • ترجمة الكتالوج بالكامل في التجارة الإلكترونية — كل وصف منتج طويل الذيل، وكل متغير.
  • بوابات وثائق كاملة بكل لغة قد يتحدث بها العميل، وليس فقط اللغات الثلاث الأولى.
  • قواعد المعرفة، والأسئلة الشائعة للدعم، وأرشيفات المدونات — الذيل الطويل الذي يحرك البحث ولكنه لم يبرر أبداً تكلفة ترجمته.
  • محتوى تحريري مؤقلم للناشرين الذين يعملون في أسواق حيث لا يمكن لإيرادات الجمهور لكل صفحة تغطية الترجمة البشرية.

كان المحتوى متعدد اللغات لعقود من الزمان عبارة عن سؤال «ما الذي يمكننا تحمل تكلفة ترجمته». مع PTC، يصبح السؤال «ما الذي يستحق الترجمة» — وهو سؤال مختلف وأكثر إثارة للاهتمام.

كيفية الحصول على هذه الجودة في موقعك الخاص

يُعد PTC المحرك الافتراضي في وضع ترجم كل شيء في WPML، وهو إعداد عام واحد يترجم كل صفحة في موقعك، تلقائياً، في الخلفية. لا يوجد تكوين لكل صفحة لإدارته.

للحصول على الجودة المُقاسة في هذه الدراسة، الإعداد الوحيد الذي تحتاجه بخلاف تشغيل ترجم كل شيء هو قضاء حوالي دقيقة في وصف جمهور موقعك ونبرته في إعدادات ترجم كل شيء — على سبيل المثال، «شركة برمجيات تخاطب المطورين، نبرة رسمية، مصطلحات تقنية محفوظة باللغة الإنجليزية». يستخدم PTC هذا الوصف لمواءمة الترجمات مع صوت علامتك التجارية.

هذا كل الإعداد. والنتيجة هي ما قاسته هذه الدراسة.

ملاحظة حول ما لم نقم به

لم نقم بمقارنة PTC مع ترجمة Google، أو Azure Translator، أو الخدمات القائمة على النماذج اللغوية الكبيرة (LLM) من خلال واجهات برمجة التطبيقات (APIs) العامة الخاصة بها. السبب: تتغير هذه المحركات بشكل متكرر وسيصبح قياس النقطة الواحدة قديماً في غضون أشهر. مقارنة DeepL هي التي أجريناها لأن DeepL هو المعيار الأكثر ذكراً لترجمة AI على مستوى الإنتاج، ولأن DeepL هو ما يستخدمه معظم منافسينا داخلياً.

كما أننا لم نقم بقياس السرعة، أو التكلفة، أو تجربة المطور في هذه الدراسة — بل الجودة فقط. توجد هذه المقارنات في صفحة الميزات لدينا وصفحات المقارنة، وهي تروي قصتها الخاصة.

جرّبه الآن

إذا كنت تدير موقع WordPress متعدد اللغات وتريد رؤية مخرجات PTC على محتواك الخاص، فثبّت إضافة WPML، ومكّن خيار ترجم كل شيء، وقارن النتيجة بأي شيء تستخدمه اليوم. فرق الجودة الموصوف هنا هو فرق الجودة الذي يجب أن تتوقع رؤيته.


لأسئلة المنهجية أو طلبات البيانات: اتصل بفريق WPML.

أُجريت الدراسة بواسطة فريق اللغويات في WPML، أبريل 2026. العينة: 227 صفحة ويب مترجمة بواسطة DeepL تمت مراجعتها بواسطة لغويين متحدثين أصليين، مقارنة بـ 73 مراجعة لمواقع مباشرة باستخدام PTC تم تقييمها بنفس المنهجية. اللغات: العربية، والإنجليزية، والفرنسية، والألمانية، والإيطالية، والإسبانية. التقييم: إطار عمل جودة الترجمة القائم على MQM، 9 أبعاد، 1–10 لكل بُعد، تم حساب متوسطها وتوسيع نطاقها إلى نتيجة 0–100.