i18n-rosetta สำหรับองค์กร
ทีมของคุณมีการแปลเนื้อหาอยู่เป็นประจำ คุณมีไฟล์ locale จำนวนมาก, ไปป์ไลน์ CI และกระบวนการที่อาจต้องมีคนมานั่งใช้ Google Translate ด้วยตัวเอง คัดลอกผลลัพธ์ลงใน JSON แล้วก็หวังว่ามันจะออกมาดี หรือไม่คุณก็กำลังจ่ายเงินให้กับแพลตฟอร์ม TMS ที่ทำให้คุณต้องผูกติดอยู่กับเอนจินการแปลของผู้ให้บริการเพียงรายเดียว
เรามีวิธีที่ดีกว่านั้น
จุดเด่นของเรา
- เลือกวิธีที่ดีที่สุดสำหรับแต่ละภาษา — ไม่ใช่แค่ใช้ค่าเริ่มต้นที่ผู้ให้บริการของคุณกำหนดมาให้
- ดีพลอยด้วยคำสั่งเดียว —
npx i18n-rosetta syncจะแปลทุก locale ทุกรูปแบบ ทุกครั้ง - สลับวิธีได้โดยไม่ต้องเปลี่ยนโค้ด — แค่เปลี่ยนคอนฟิก ไม่ต้องย้ายระบบ
- เป็นเจ้าของไปป์ไลน์ของคุณเอง — ไม่มีการผูกขาดกับผู้ให้บริการ ไม่มีแดชบอร์ดรายเดือน ไม่ต้องสร้างบัญชี
{
"version": 3,
"pairs": {
"en:fr": { "method": "deepl" },
"en:ja": { "method": "llm", "model": "google/gemini-2.5-pro" },
"en:de": { "method": "google-translate" },
"en:ko": { "method": "llm", "register": "polite-haeyo" },
"en:crk": { "methodPlugin": "crk-coached-v3" }
}
}
ภาษาฝรั่งเศสใช้ DeepL (ทีมของคุณชอบความสละสลวยแบบยุโรป) ภาษาญี่ปุ่นใช้ frontier LLM ภาษาเยอรมันใช้ Google Translate (รวดเร็ว ราคาถูก และดีพอ) ภาษาเกาหลีใช้ LLM ที่มีระดับภาษาเป็นทางการ ภาษา Plains Cree ใช้ปลั๊กอินที่ชุมชนสร้างขึ้นซึ่งได้คะแนนสูงสุดบนลีดเดอร์บอร์ด
คำสั่งเดียวกัน ไปป์ไลน์ CI เดียวกัน ใช้วิธีที่แตกต่างกันในแต่ละคู่ภาษา ทั้งหมดนี้อยู่ในไฟล์คอนฟิกเดียว
เวิร์กโฟลว์จากลีดเดอร์บอร์ด → การดีพลอย
:::tip เร็วๆ นี้: rosetta leaderboard CLI
เวิร์กโฟลว์ที่อธิบายไว้ด้านล่างนี้คือแผนการทำงานร่วมกันระหว่างลีดเดอร์บอร์ด MT Eval Arena และ i18n-rosetta CLI โครงสร้างพื้นฐานของทั้งสองฝั่งมีพร้อมแล้ว — ส่วนเชื่อมต่อกำลังอยู่ในระหว่างการพัฒนา
:::
MT Eval Arena คือที่สำหรับวัดประสิทธิภาพ (benchmark) วิธีการแปลต่างๆ ด้วยการให้คะแนนที่สามารถทำซ้ำได้และมีการตรวจสอบยืนยัน (fingerprinted) ทุกวิธีจะได้รับคะแนนรวมจากหลายมาตรวัด (chrF++, exact match, FST acceptance, semantic scoring) ลีดเดอร์บอร์ดจะติดตามทุกผลงานที่ส่งเข้ามา
เวิร์กโฟลว์ที่วางแผนไว้:
# Browse the leaderboard from your terminal
npx i18n-rosetta leaderboard --pair en:crk
# Output:
# ┌──────┬───────────────────────┬────────────┬──────────┬───────────┐
# │ Rank │ Method │ Model │ chrF++ │ Composite │
# ├──────┼───────────────────────┼────────────┼──────────┼───────────┤
# │ 1 │ crk-coached-v3 │ gemini-2.5 │ 43.2 │ 0.67 │
# │ 2 │ fst-gated-pipeline │ gpt-4o │ 41.8 │ 0.63 │
# │ 3 │ prompt-baseline │ claude-4 │ 38.1 │ 0.55 │
# └──────┴───────────────────────┴────────────┴──────────┴───────────┘
# Install the top-scoring method as a plugin
npx i18n-rosetta plugin install crk-coached-v3
# Use it
npx i18n-rosetta sync
คุณไม่ต้องสร้างวิธีการแปลเอง คุณไม่ต้องเทรนโมเดล คุณแค่เลือกตัวที่ชนะแล้วนำไปดีพลอย หากเดือนหน้ามีวิธีที่ดีกว่าปรากฏขึ้นบนลีดเดอร์บอร์ด คุณก็สามารถสลับไปใช้ได้ด้วยคำสั่งเดียว
สิ่งที่มีให้ใช้งานในปัจจุบัน
ส่วนเชื่อมต่อระหว่างลีดเดอร์บอร์ดกับ CLI กำลังอยู่ในระหว่างการพัฒนา และนี่คือสิ่งที่สามารถใช้งานได้แล้วในตอนนี้:
วิธีการที่มีมาให้ในตัว (ไม่ต้องใช้ปลั๊กอิน)
| วิธีการ | เหมาะที่สุดสำหรับ | ค่าใช้จ่าย |
|---|---|---|
llm (ค่าเริ่มต้น) | เน้นคุณภาพ, ทุกภาษา | จ่ายตามจำนวนโทเคนผ่าน OpenRouter |
gemini | คุณภาพ + มีระดับใช้งานฟรี | ฟรี (มีข้อจำกัด), จากนั้นจ่ายตามจำนวนโทเคน |
google-translate | ความเร็ว + ปริมาณมาก | $20/ล้านตัวอักษร |
deepl | ภาษายุโรป | $25/ล้านตัวอักษร |
llm-coached | ภาษาที่มีข้อมูล coaching | จ่ายตามจำนวนโทเคนผ่าน OpenRouter |
api | วิธีการที่กำหนดเอง/โฮสต์โดยชุมชน | โฮสต์ด้วยตัวเอง (Self-hosted) |
วิธีการแบบปลั๊กอิน (ติดตั้งแยกต่างหาก)
ปลั๊กอินแบบกำหนดเองสามารถครอบคลุมลอจิกการแปลใดๆ ก็ได้ — ไม่ว่าจะเป็นโมเดลที่ผ่านการ fine-tune, ไปป์ไลน์แบบ FST-gated, API ของชุมชน หรืออะไรก็ตามที่สร้างผลลัพธ์เป็น JSON ดูเพิ่มเติมที่ Build a Plugin
เวิร์กโฟลว์สำหรับองค์กร
1. ประเมินคุณภาพปัจจุบันของคุณ
# See what you're getting today
npx i18n-rosetta status
# Output shows: method per pair, cache hit rate, quality gate stats
2. รัน eval harness กับตัวเลือกต่างๆ
eval harness ช่วยให้คุณสามารถวัดประสิทธิภาพของหลายๆ วิธีการเทียบกับชุดข้อมูลเดียวกันได้ รันการทดสอบ เปรียบเทียบคะแนน และเลือกตัวที่ชนะ:
# In the eval harness repo
python -m mt_eval_harness.run \
--methods coached-v3 baseline prompt-tuned \
--dataset data/your-corpus.json
3. กำหนดค่าตัวที่ชนะในแต่ละคู่ภาษา
อัปเดตคอนฟิกของคุณเพื่อใช้วิธีที่ดีที่สุดสำหรับแต่ละคู่ภาษา ภาษาที่แตกต่างกันย่อมมีวิธีที่ดีที่สุดแตกต่างกัน — นั่นคือประเด็นสำคัญ
4. ผสานการทำงานเข้ากับ CI/CD
# In your CI pipeline
npx i18n-rosetta lint # Catch hardcoded strings
npx i18n-rosetta sync # Translate what changed
npx i18n-rosetta audit # Fail if any locale is incomplete
npx i18n-rosetta integrity # Validate placeholder consistency
ใช้เพียงสามคำสั่ง ไม่ต้องแปลเองด้วยมือ ไปป์ไลน์จะตรวจจับสตริงที่ถูกฮาร์ดโค้ดไว้ นำไปแปลด้วยวิธีที่คุณเลือก และจะสั่งให้การบิลด์ล้มเหลว (fail) หากมีสิ่งใดขาดหายหรือเสียหาย
5. การตรวจสอบโดยผู้เชี่ยวชาญ (ทางเลือก)
สำหรับเนื้อหาที่มีความสำคัญสูง คุณสามารถเอ็กซ์พอร์ตเป็น XLIFF เพื่อให้คนตรวจสอบได้:
npx i18n-rosetta xliff export --locale ja --output translations.xliff
# → Send to your translation agency
# → Import corrections back:
npx i18n-rosetta xliff import translations.xliff
ใช้เครื่องแปลสำหรับเนื้อหาส่วนใหญ่ ใช้คนตรวจสอบในส่วนที่สำคัญ จ่ายค่าเวลาของคนเฉพาะในจุดที่จำเป็นเท่านั้น
โมเดลค่าใช้จ่าย
rosetta ไม่มีค่าไลเซนส์ ไม่มีค่าสมัครสมาชิกรายเดือน ไม่คิดราคาตามจำนวนผู้ใช้ มันคือเครื่องมือ CLI แบบโอเพนซอร์ส คุณจ่ายเฉพาะค่าเรียกใช้งาน translation API เท่านั้น:
| ปริมาณ | Google Translate | LLM (Gemini Flash) | LLM (GPT-4o) |
|---|---|---|---|
| 1,000 คีย์ × 5 locales | ~$0.50 | ~$0.30 (ระดับใช้งานฟรี) | ~$2.00 |
| 10,000 คีย์ × 15 locales | ~$15 | ~$8 | ~$60 |
| 50,000 คีย์ × 30 locales | ~$75 | ~$40 | ~$300 |
Translation Memory หมายความว่าคุณจะจ่ายเฉพาะ คีย์ที่มีการเปลี่ยนแปลง ในการซิงค์ครั้งต่อๆ ไป หากคุณอัปเดต 10 สตริงจากทั้งหมด 10,000 สตริง คุณจะจ่ายค่าแปลแค่ 10 สตริง ไม่ใช่ 10,000 สตริง
เปรียบเทียบกับแพลตฟอร์ม TMS
| rosetta | Crowdin / Phrase / Locize | |
|---|---|---|
| ราคา | ฟรี (โอเพนซอร์ส) + ค่า API | $50–$500/เดือน + ตามจำนวนผู้ใช้ |
| การผูกขาดกับผู้ให้บริการ | ไม่มี — สลับผู้ให้บริการได้ในคอนฟิก | สูง — ข้อมูลอยู่บนคลาวด์ของพวกเขา |
| ตัวเลือกวิธีการ | ผู้ให้บริการใดก็ได้, โมเดลใดก็ได้, ตามคู่ภาษา | ตามที่พวกเขามีให้ |
| CI/CD | รองรับเต็มรูปแบบ (lint → sync → audit) | ปลั๊กอิน/เว็บฮุค (webhook) |
| วิธีการที่กำหนดเอง | ระบบปลั๊กอิน, ปลั๊กอินจากชุมชน | ไม่รองรับ |
| การควบคุมคุณภาพ | มีในตัว (wrong-script, echo, length) | แตกต่างกันไป |
| โฮสต์ด้วยตัวเอง | ได้ (LibreTranslate, custom API) | ไม่ได้ |
ดูรายละเอียดเพิ่มเติมได้ที่ การเปรียบเทียบแบบเต็ม
อ่านเพิ่มเติม
- Quick Start — รันการซิงค์ครั้งแรกของคุณใน 60 วินาที
- Translation Methods — เมนูวิธีการแปลแบบเต็มพร้อมแผนผังการตัดสินใจ
- CI/CD Integration — ทำงานอัตโนมัติในไปป์ไลน์ของคุณ
- Working with Professional Translators — การเอ็กซ์พอร์ต/อิมพอร์ต XLIFF
- MT Eval Arena — การวัดประสิทธิภาพและลีดเดอร์บอร์ด
- Configuration Reference — ตัวเลือกคอนฟิกทั้งหมด