تخطي إلى المحتوى الرئيسي

i18n-rosetta للمؤسسات

يقوم فريقك بترجمة المحتوى بانتظام. لديك مجموعة من ملفات الترجمة (locale files)، ومسار تكامل مستمر (CI pipeline)، وعملية تتضمن على الأرجح قيام شخص ما بتشغيل Google Translate يدويًا، ونسخ النتائج إلى JSON، وتمني الأفضل. أو أنك تدفع مقابل منصة TMS حيث تكون مقيدًا بمحرك ترجمة لمورد واحد.

هناك طريقة أفضل.

الفكرة الأساسية

  1. اختر أفضل طريقة لكل لغة — وليس ما يفرضه المورد الخاص بك افتراضيًا
  2. انشر بأمر واحدnpx i18n-rosetta sync يترجم كل لغة، وكل تنسيق، في كل مرة
  3. بدّل الطرق دون تغيير الكود — تغيير في الإعدادات، وليس عملية انتقال (migration)
  4. امتلك مسار عملك — لا يوجد تقييد بمورد معين (vendor lock-in)، ولا لوحات تحكم شهرية، ولا حسابات
i18n-rosetta.config.json
{
"version": 3,
"pairs": {
"en:fr": { "method": "deepl" },
"en:ja": { "method": "llm", "model": "google/gemini-2.5-pro" },
"en:de": { "method": "google-translate" },
"en:ko": { "method": "llm", "register": "polite-haeyo" },
"en:crk": { "methodPlugin": "crk-coached-v3" }
}
}

تحصل الفرنسية على DeepL (يفضل فريقك طلاقته الأوروبية). وتحصل اليابانية على نموذج لغوي كبير (LLM) متطور. وتحصل الألمانية على Google Translate (سريع، ورخيص، وجيد بما يكفي). وتحصل الكورية على LLM بصيغة رسمية. وتحصل لغة Plains Cree على إضافة (plugin) موجهة ومبنية بواسطة المجتمع والتي سجلت أعلى النقاط في لوحة الصدارة (leaderboard).

نفس الأمر. نفس مسار التكامل المستمر (CI pipeline). طرق مختلفة لكل زوج لغوي. ملف إعدادات واحد.

سير العمل: من لوحة الصدارة إلى النشر

:::tip قريبًا: rosetta leaderboard CLI سير العمل الموضح أدناه هو التكامل المخطط له بين لوحة صدارة MT Eval Arena و i18n-rosetta CLI. البنية التحتية موجودة على كلا الجانبين — والجسر قيد التطوير. :::

منصة MT Eval Arena هي المكان الذي يتم فيه قياس أداء طرق الترجمة بتقييمات قابلة للتكرار وموثقة. تحصل كل طريقة على درجة مركبة عبر مقاييس متعددة (chrF++، التطابق التام، قبول FST، التقييم الدلالي). تتتبع لوحة الصدارة كل إرسال.

سير العمل المخطط له:

# Browse the leaderboard from your terminal
npx i18n-rosetta leaderboard --pair en:crk

# Output:
# ┌──────┬───────────────────────┬────────────┬──────────┬───────────┐
# │ Rank │ Method │ Model │ chrF++ │ Composite │
# ├──────┼───────────────────────┼────────────┼──────────┼───────────┤
# │ 1 │ crk-coached-v3 │ gemini-2.5 │ 43.2 │ 0.67 │
# │ 2 │ fst-gated-pipeline │ gpt-4o │ 41.8 │ 0.63 │
# │ 3 │ prompt-baseline │ claude-4 │ 38.1 │ 0.55 │
# └──────┴───────────────────────┴────────────┴──────────┴───────────┘

# Install the top-scoring method as a plugin
npx i18n-rosetta plugin install crk-coached-v3

# Use it
npx i18n-rosetta sync

أنت لا تبني الطريقة. ولا تدرب النموذج. بل تختار الفائز وتنشره. إذا ظهرت طريقة أفضل على لوحة الصدارة في الشهر القادم، يمكنك تبديلها بأمر واحد.

ما هو متاح اليوم

الجسر الرابط بين لوحة الصدارة و CLI قيد التطوير. إليك ما يعمل حاليًا:

طرق مدمجة (لا حاجة لإضافات)

الطريقةالأفضل لـالتكلفة
llm (الافتراضي)التركيز على الجودة، أي لغةلكل رمز (Per-token) عبر OpenRouter
geminiالجودة + باقة مجانيةمجاني (محدود)، ثم لكل رمز
google-translateالسرعة + الحجم20 دولارًا / مليون حرف
deeplاللغات الأوروبية25 دولارًا / مليون حرف
llm-coachedاللغات التي تحتوي على بيانات توجيهية (coaching data)لكل رمز عبر OpenRouter
apiطرق مخصصة/مستضافة من المجتمعاستضافة ذاتية (Self-hosted)

طرق الإضافات (تُثبت بشكل منفصل)

يمكن للإضافات المخصصة (Custom plugins) تغليف أي منطق ترجمة — نموذج مُحسّن (fine-tuned model)، أو مسار عمل مقيد بـ FST، أو واجهة برمجة تطبيقات (API) مجتمعية، أو أي شيء آخر ينتج JSON. راجع بناء إضافة.

سير عمل المؤسسات

1. تقييم جودتك الحالية

# See what you're getting today
npx i18n-rosetta status

# Output shows: method per pair, cache hit rate, quality gate stats

2. تشغيل أداة التقييم على المرشحين

تتيح لك أداة التقييم (eval harness) قياس أداء طرق متعددة مقابل نفس مجموعة البيانات. قم بإجراء فحص شامل، وقارن الدرجات، واختر الفائزين:

# In the eval harness repo
python -m mt_eval_harness.run \
--methods coached-v3 baseline prompt-tuned \
--dataset data/your-corpus.json

3. إعداد الفائزين لكل زوج لغوي

قم بتحديث إعداداتك لاستخدام أفضل طريقة لكل زوج لغوي. اللغات المختلفة لها طرق مفضلة مختلفة — وهذا هو بيت القصيد.

4. التكامل مع CI/CD

# In your CI pipeline
npx i18n-rosetta lint # Catch hardcoded strings
npx i18n-rosetta sync # Translate what changed
npx i18n-rosetta audit # Fail if any locale is incomplete
npx i18n-rosetta integrity # Validate placeholder consistency

ثلاثة أوامر. صفر ترجمة يدوية. يلتقط مسار العمل (pipeline) النصوص الثابتة (hardcoded strings)، ويترجمها باستخدام الطرق التي اخترتها، ويوقف عملية البناء (fails the build) إذا كان هناك أي شيء مفقود أو تالف.

5. المراجعة الاحترافية (اختياري)

بالنسبة للمحتوى عالي الأهمية، قم بالتصدير إلى XLIFF للمراجعة البشرية:

npx i18n-rosetta xliff export --locale ja --output translations.xliff
# → Send to your translation agency
# → Import corrections back:
npx i18n-rosetta xliff import translations.xliff

ترجم الجزء الأكبر آليًا. وراجع المسارات الحرجة بشريًا. ادفع مقابل وقت البشر فقط حيثما كان ذلك ضروريًا.

نموذج التكلفة

أداة rosetta لا تتطلب رسوم ترخيص، ولا اشتراكًا شهريًا، ولا تسعيرًا لكل مستخدم. إنها أداة CLI مفتوحة المصدر. أنت تدفع فقط مقابل استدعاءات واجهة برمجة تطبيقات (API) الترجمة:

الحجمGoogle TranslateLLM (Gemini Flash)LLM (GPT-4o)
1,000 مفتاح × 5 لغات~$0.50~$0.30 (باقة مجانية)~$2.00
10,000 مفتاح × 15 لغة~$15~$8~$60
50,000 مفتاح × 30 لغة~$75~$40~$300

ذاكرة الترجمة (Translation Memory) تعني أنك تدفع فقط مقابل المفاتيح المتغيرة في عمليات المزامنة اللاحقة. إذا قمت بتحديث 10 نصوص من أصل 10,000، فإنك تدفع مقابل 10 ترجمات، وليس 10,000.

مقارنة مع منصات TMS

rosettaCrowdin / Phrase / Locize
التسعيرمجاني (مفتوح المصدر) + تكاليف API50–500 دولار/شهر + لكل مستخدم
التقييد بموردلا يوجد — بدّل المزودين في الإعداداتعالٍ — البيانات في سحابتهم
اختيار الطريقةأي مزود، أي نموذج، لكل زوج لغويما يقدمونه فقط
CI/CDدعم أساسي (lint → sync → audit)إضافة/Webhook
طرق مخصصةنظام إضافات، إضافات مجتمعيةغير مدعوم
بوابة الجودةمدمجة (نص خاطئ، تكرار، طول)متفاوت
استضافة ذاتيةنعم (LibreTranslate، واجهة API مخصصة)لا

راجع المقارنة الكاملة للحصول على التفاصيل.

قراءات إضافية