ข้ามไปยังเนื้อหาหลัก

i18n-rosetta สำหรับองค์กร

ทีมของคุณมีการแปลเนื้อหาอยู่เป็นประจำ คุณมีไฟล์ locale จำนวนมาก, ไปป์ไลน์ CI และกระบวนการที่อาจต้องมีคนมานั่งใช้ Google Translate ด้วยตัวเอง คัดลอกผลลัพธ์ลงใน JSON แล้วก็หวังว่ามันจะออกมาดี หรือไม่คุณก็กำลังจ่ายเงินให้กับแพลตฟอร์ม TMS ที่ทำให้คุณต้องผูกติดอยู่กับเอนจินการแปลของผู้ให้บริการเพียงรายเดียว

เรามีวิธีที่ดีกว่านั้น

จุดเด่นของเรา

  1. เลือกวิธีที่ดีที่สุดสำหรับแต่ละภาษา — ไม่ใช่แค่ใช้ค่าเริ่มต้นที่ผู้ให้บริการของคุณกำหนดมาให้
  2. ดีพลอยด้วยคำสั่งเดียวnpx i18n-rosetta sync จะแปลทุก locale ทุกรูปแบบ ทุกครั้ง
  3. สลับวิธีได้โดยไม่ต้องเปลี่ยนโค้ด — แค่เปลี่ยนคอนฟิก ไม่ต้องย้ายระบบ
  4. เป็นเจ้าของไปป์ไลน์ของคุณเอง — ไม่มีการผูกขาดกับผู้ให้บริการ ไม่มีแดชบอร์ดรายเดือน ไม่ต้องสร้างบัญชี
i18n-rosetta.config.json
{
"version": 3,
"pairs": {
"en:fr": { "method": "deepl" },
"en:ja": { "method": "llm", "model": "google/gemini-2.5-pro" },
"en:de": { "method": "google-translate" },
"en:ko": { "method": "llm", "register": "polite-haeyo" },
"en:crk": { "methodPlugin": "crk-coached-v3" }
}
}

ภาษาฝรั่งเศสใช้ DeepL (ทีมของคุณชอบความสละสลวยแบบยุโรป) ภาษาญี่ปุ่นใช้ frontier LLM ภาษาเยอรมันใช้ Google Translate (รวดเร็ว ราคาถูก และดีพอ) ภาษาเกาหลีใช้ LLM ที่มีระดับภาษาเป็นทางการ ภาษา Plains Cree ใช้ปลั๊กอินที่ชุมชนสร้างขึ้นซึ่งได้คะแนนสูงสุดบนลีดเดอร์บอร์ด

คำสั่งเดียวกัน ไปป์ไลน์ CI เดียวกัน ใช้วิธีที่แตกต่างกันในแต่ละคู่ภาษา ทั้งหมดนี้อยู่ในไฟล์คอนฟิกเดียว

เวิร์กโฟลว์จากลีดเดอร์บอร์ด → การดีพลอย

:::tip เร็วๆ นี้: rosetta leaderboard CLI เวิร์กโฟลว์ที่อธิบายไว้ด้านล่างนี้คือแผนการทำงานร่วมกันระหว่างลีดเดอร์บอร์ด MT Eval Arena และ i18n-rosetta CLI โครงสร้างพื้นฐานของทั้งสองฝั่งมีพร้อมแล้ว — ส่วนเชื่อมต่อกำลังอยู่ในระหว่างการพัฒนา :::

MT Eval Arena คือที่สำหรับวัดประสิทธิภาพ (benchmark) วิธีการแปลต่างๆ ด้วยการให้คะแนนที่สามารถทำซ้ำได้และมีการตรวจสอบยืนยัน (fingerprinted) ทุกวิธีจะได้รับคะแนนรวมจากหลายมาตรวัด (chrF++, exact match, FST acceptance, semantic scoring) ลีดเดอร์บอร์ดจะติดตามทุกผลงานที่ส่งเข้ามา

เวิร์กโฟลว์ที่วางแผนไว้:

# Browse the leaderboard from your terminal
npx i18n-rosetta leaderboard --pair en:crk

# Output:
# ┌──────┬───────────────────────┬────────────┬──────────┬───────────┐
# │ Rank │ Method │ Model │ chrF++ │ Composite │
# ├──────┼───────────────────────┼────────────┼──────────┼───────────┤
# │ 1 │ crk-coached-v3 │ gemini-2.5 │ 43.2 │ 0.67 │
# │ 2 │ fst-gated-pipeline │ gpt-4o │ 41.8 │ 0.63 │
# │ 3 │ prompt-baseline │ claude-4 │ 38.1 │ 0.55 │
# └──────┴───────────────────────┴────────────┴──────────┴───────────┘

# Install the top-scoring method as a plugin
npx i18n-rosetta plugin install crk-coached-v3

# Use it
npx i18n-rosetta sync

คุณไม่ต้องสร้างวิธีการแปลเอง คุณไม่ต้องเทรนโมเดล คุณแค่เลือกตัวที่ชนะแล้วนำไปดีพลอย หากเดือนหน้ามีวิธีที่ดีกว่าปรากฏขึ้นบนลีดเดอร์บอร์ด คุณก็สามารถสลับไปใช้ได้ด้วยคำสั่งเดียว

สิ่งที่มีให้ใช้งานในปัจจุบัน

ส่วนเชื่อมต่อระหว่างลีดเดอร์บอร์ดกับ CLI กำลังอยู่ในระหว่างการพัฒนา และนี่คือสิ่งที่สามารถใช้งานได้แล้วในตอนนี้:

วิธีการที่มีมาให้ในตัว (ไม่ต้องใช้ปลั๊กอิน)

วิธีการเหมาะที่สุดสำหรับค่าใช้จ่าย
llm (ค่าเริ่มต้น)เน้นคุณภาพ, ทุกภาษาจ่ายตามจำนวนโทเคนผ่าน OpenRouter
geminiคุณภาพ + มีระดับใช้งานฟรีฟรี (มีข้อจำกัด), จากนั้นจ่ายตามจำนวนโทเคน
google-translateความเร็ว + ปริมาณมาก$20/ล้านตัวอักษร
deeplภาษายุโรป$25/ล้านตัวอักษร
llm-coachedภาษาที่มีข้อมูล coachingจ่ายตามจำนวนโทเคนผ่าน OpenRouter
apiวิธีการที่กำหนดเอง/โฮสต์โดยชุมชนโฮสต์ด้วยตัวเอง (Self-hosted)

วิธีการแบบปลั๊กอิน (ติดตั้งแยกต่างหาก)

ปลั๊กอินแบบกำหนดเองสามารถครอบคลุมลอจิกการแปลใดๆ ก็ได้ — ไม่ว่าจะเป็นโมเดลที่ผ่านการ fine-tune, ไปป์ไลน์แบบ FST-gated, API ของชุมชน หรืออะไรก็ตามที่สร้างผลลัพธ์เป็น JSON ดูเพิ่มเติมที่ Build a Plugin

เวิร์กโฟลว์สำหรับองค์กร

1. ประเมินคุณภาพปัจจุบันของคุณ

# See what you're getting today
npx i18n-rosetta status

# Output shows: method per pair, cache hit rate, quality gate stats

2. รัน eval harness กับตัวเลือกต่างๆ

eval harness ช่วยให้คุณสามารถวัดประสิทธิภาพของหลายๆ วิธีการเทียบกับชุดข้อมูลเดียวกันได้ รันการทดสอบ เปรียบเทียบคะแนน และเลือกตัวที่ชนะ:

# In the eval harness repo
python -m mt_eval_harness.run \
--methods coached-v3 baseline prompt-tuned \
--dataset data/your-corpus.json

3. กำหนดค่าตัวที่ชนะในแต่ละคู่ภาษา

อัปเดตคอนฟิกของคุณเพื่อใช้วิธีที่ดีที่สุดสำหรับแต่ละคู่ภาษา ภาษาที่แตกต่างกันย่อมมีวิธีที่ดีที่สุดแตกต่างกัน — นั่นคือประเด็นสำคัญ

4. ผสานการทำงานเข้ากับ CI/CD

# In your CI pipeline
npx i18n-rosetta lint # Catch hardcoded strings
npx i18n-rosetta sync # Translate what changed
npx i18n-rosetta audit # Fail if any locale is incomplete
npx i18n-rosetta integrity # Validate placeholder consistency

ใช้เพียงสามคำสั่ง ไม่ต้องแปลเองด้วยมือ ไปป์ไลน์จะตรวจจับสตริงที่ถูกฮาร์ดโค้ดไว้ นำไปแปลด้วยวิธีที่คุณเลือก และจะสั่งให้การบิลด์ล้มเหลว (fail) หากมีสิ่งใดขาดหายหรือเสียหาย

5. การตรวจสอบโดยผู้เชี่ยวชาญ (ทางเลือก)

สำหรับเนื้อหาที่มีความสำคัญสูง คุณสามารถเอ็กซ์พอร์ตเป็น XLIFF เพื่อให้คนตรวจสอบได้:

npx i18n-rosetta xliff export --locale ja --output translations.xliff
# → Send to your translation agency
# → Import corrections back:
npx i18n-rosetta xliff import translations.xliff

ใช้เครื่องแปลสำหรับเนื้อหาส่วนใหญ่ ใช้คนตรวจสอบในส่วนที่สำคัญ จ่ายค่าเวลาของคนเฉพาะในจุดที่จำเป็นเท่านั้น

โมเดลค่าใช้จ่าย

rosetta ไม่มีค่าไลเซนส์ ไม่มีค่าสมัครสมาชิกรายเดือน ไม่คิดราคาตามจำนวนผู้ใช้ มันคือเครื่องมือ CLI แบบโอเพนซอร์ส คุณจ่ายเฉพาะค่าเรียกใช้งาน translation API เท่านั้น:

ปริมาณGoogle TranslateLLM (Gemini Flash)LLM (GPT-4o)
1,000 คีย์ × 5 locales~$0.50~$0.30 (ระดับใช้งานฟรี)~$2.00
10,000 คีย์ × 15 locales~$15~$8~$60
50,000 คีย์ × 30 locales~$75~$40~$300

Translation Memory หมายความว่าคุณจะจ่ายเฉพาะ คีย์ที่มีการเปลี่ยนแปลง ในการซิงค์ครั้งต่อๆ ไป หากคุณอัปเดต 10 สตริงจากทั้งหมด 10,000 สตริง คุณจะจ่ายค่าแปลแค่ 10 สตริง ไม่ใช่ 10,000 สตริง

เปรียบเทียบกับแพลตฟอร์ม TMS

rosettaCrowdin / Phrase / Locize
ราคาฟรี (โอเพนซอร์ส) + ค่า API$50–$500/เดือน + ตามจำนวนผู้ใช้
การผูกขาดกับผู้ให้บริการไม่มี — สลับผู้ให้บริการได้ในคอนฟิกสูง — ข้อมูลอยู่บนคลาวด์ของพวกเขา
ตัวเลือกวิธีการผู้ให้บริการใดก็ได้, โมเดลใดก็ได้, ตามคู่ภาษาตามที่พวกเขามีให้
CI/CDรองรับเต็มรูปแบบ (lint → sync → audit)ปลั๊กอิน/เว็บฮุค (webhook)
วิธีการที่กำหนดเองระบบปลั๊กอิน, ปลั๊กอินจากชุมชนไม่รองรับ
การควบคุมคุณภาพมีในตัว (wrong-script, echo, length)แตกต่างกันไป
โฮสต์ด้วยตัวเองได้ (LibreTranslate, custom API)ไม่ได้

ดูรายละเอียดเพิ่มเติมได้ที่ การเปรียบเทียบแบบเต็ม

อ่านเพิ่มเติม

  • Quick Start — รันการซิงค์ครั้งแรกของคุณใน 60 วินาที
  • Translation Methods — เมนูวิธีการแปลแบบเต็มพร้อมแผนผังการตัดสินใจ
  • CI/CD Integration — ทำงานอัตโนมัติในไปป์ไลน์ของคุณ
  • Working with Professional Translators — การเอ็กซ์พอร์ต/อิมพอร์ต XLIFF
  • MT Eval Arena — การวัดประสิทธิภาพและลีดเดอร์บอร์ด
  • Configuration Reference — ตัวเลือกคอนฟิกทั้งหมด