---
title: "FLORES-200 (ID)"
source: "https://systems-analysis.info/int/FLORES-200_(ID)"
wiki: "systems-analysis.info/int"
article: "FLORES-200_(ID)"
language: "id"
categories:
  - "Category:Indonesian"
  - "Category:Large language models"
  - "Category:LLM benchmarks"
  - "Category:Machine learning"
revision_id: 2091
wiki_created_at: 2026-09-06T22:58:28Z
wiki_modified_at: 2026-09-06T22:58:28Z
downloaded_at: 2026-09-07T22:49:17Z
---

# FLORES-200 (ID)

**FLORES-200** — adalah dataset evaluasi untuk penerjemahan mesin multibahasa yang mencakup sekitar 200 bahasa di dunia. Dataset ini dibuat oleh para peneliti perusahaan Meta dalam kerangka proyek **No Language Left Behind (NLLB)** dan diperkenalkan pada tahun 2022. FLORES-200 merupakan perluasan dari dataset sebelumnya, **FLORES-101**, dan dirancang untuk mengevaluasi kualitas terjemahan secara objektif, khususnya pada bahasa-bahasa dengan sumber daya rendah<sup>[\[1\]](https://systems-analysis.info/int/FLORES-200_(ID)#cite_note-pwc_flores-1)</sup>.

Ciri khas utama dataset ini adalah bahwa seluruh teksnya diterjemahkan oleh penerjemah profesional, sehingga memastikan kualitas terjemahan referensi yang tinggi dan menjadikannya standar yang andal untuk membandingkan sistem penerjemahan mesin<sup>[\[2\]](https://systems-analysis.info/int/FLORES-200_(ID)#cite_note-flores_plus-2)</sup>.

## Latar Belakang dan Pembuatan Dataset

Versi pertama, **FLORES-101**, diperkenalkan pada tahun 2022 dan berisi 3001 kalimat dari Wikipedia berbahasa Inggris yang diterjemahkan ke dalam 101 bahasa<sup>[\[3\]](https://systems-analysis.info/int/FLORES-200_(ID)#cite_note-flores101_paper-3)</sup>. Dataset ini mengisi kesenjangan penting dalam evaluasi sistem penerjemahan untuk bahasa-bahasa dengan data yang minim.

Pada tahun 2022, dalam kerangka proyek **No Language Left Behind**, perusahaan Meta memperluas korpus hingga mencakup 200 bahasa, sehingga terciptalah **FLORES-200**<sup>[\[4\]](https://systems-analysis.info/int/FLORES-200_(ID)#cite_note-meta_news-4)</sup>. Pengembangannya menghadapi sejumlah tantangan:

- Banyak bahasa yang ditambahkan memiliki tingkat standardisasi yang rendah dan kekurangan tenaga ahli dwibahasa.
- Sebagian bahasa tidak diterjemahkan langsung dari bahasa Inggris, melainkan melalui bahasa perantara (Spanyol, Prancis, Rusia).
- Untuk beberapa bahasa, berbagai sistem penulisan disertakan (misalnya, aksara Latin dan Kiril) guna mengakomodasi penggunaannya di komunitas yang berbeda<sup>[\[5\]](https://systems-analysis.info/int/FLORES-200_(ID)#cite_note-huggingface_flores-5)</sup>.

## Komposisi dan Struktur

Korpus FLORES-200 mencakup **3001 kalimat** yang dipilih dari 842 artikel web dan dokumen proyek Wikimedia yang berbeda. Tidak seperti versi pertama, sumber-sumbernya tidak hanya mencakup Wikipedia, tetapi juga proyek-proyek lain seperti Wikinews, Wikijunior, dan Wikivoyage. Hal ini memastikan keragaman tematik yang luas (berita, sains, budaya, perjalanan), sehingga memungkinkan pengujian kualitas terjemahan secara menyeluruh.

Setiap kalimat bahasa Inggris diterjemahkan secara profesional ke dalam ~200 bahasa target, membentuk korpus paralel yang sepenuhnya sejajar. Dataset ini dibagi menjadi tiga bagian:

- **dev** (pengembangan) — untuk penyetelan model.
- **devtest** (pengujian menengah) — untuk evaluasi awal.
- **test** (pengujian final) — bagian tersembunyi untuk perbandingan model yang adil dalam kompetisi.

Untuk menandai bahasa, digunakan standar ISO 639-3 disertai keterangan skrip, misalnya \`eng_Latn\` untuk bahasa Inggris dalam aksara Latin atau \`rus_Cyrl\` untuk bahasa Rusia dalam aksara Kiril<sup>[\[5\]](https://systems-analysis.info/int/FLORES-200_(ID)#cite_note-huggingface_flores-5)</sup>.

## Penerapan dan Signifikansi

FLORES-200 telah menjadi standar utama untuk mengevaluasi sistem penerjemahan mesin multibahasa. Dataset ini digunakan untuk mengevaluasi model unggulan dari Meta — **NLLB-200**. Pengujian pada FLORES-200 menunjukkan bahwa NLLB-200 meningkatkan kualitas terjemahan rata-rata sebesar **44%** berdasarkan metrik BLEU dibandingkan sistem-sistem terbaik sebelumnya<sup>[\[6\]](https://systems-analysis.info/int/FLORES-200_(ID)#cite_note-nllb_paper-6)</sup>. Untuk beberapa bahasa di Afrika dan India, peningkatan akurasi melebihi **70%**<sup>[\[4\]](https://systems-analysis.info/int/FLORES-200_(ID)#cite_note-meta_news-4)</sup>.

Meta membuka akses bebas ke dataset dan alat penggunaannya di bawah lisensi **Creative Commons BY-SA 4.0**. Berkat hal ini, FLORES-200 dengan cepat mendapat penyebaran luas dan menjadi standar de facto dalam karya ilmiah, kompetisi penerjemahan mesin (misalnya, WMT), serta inisiatif pelestarian bahasa. Pada tahun 2023, komunitas OLDI (Open Language Data Initiative) mulai memperluas korpus ini dengan nama **FLORES+**<sup>[\[2\]](https://systems-analysis.info/int/FLORES-200_(ID)#cite_note-flores_plus-2)</sup>.

## Pranala

- Dataset resmi di Hugging Face
- Repositori resmi di GitHub

## Daftar Pustaka

- Liang, P. et al. (2022). *Holistic Evaluation of Language Models (HELM)*. arXiv:2211.09110.
- Chang, Y. et al. (2023). *A Survey on Evaluation of Large Language Models*. arXiv:2307.03109.
- Ni, S. et al. (2025). *A Survey on Large Language Model Benchmarks*. arXiv:2508.15361.
- Biderman, S. et al. (2024). *The Language Model Evaluation Harness (lm-eval): Guidance and Lessons Learned*. arXiv:2405.14782.
- Kiela, D. et al. (2021). *Dynabench: Rethinking Benchmarking in NLP*. arXiv:2104.14337.
- Ma, Z. et al. (2021). *Dynaboard: An Evaluation‑As‑A‑Service Platform for Holistic Next‑Generation Benchmarking*. arXiv:2106.06052.
- Goel, K. et al. (2021). *Robustness Gym: Unifying the NLP Evaluation Landscape*. arXiv:2101.04840.
- Xu, C. et al. (2024). *Benchmark Data Contamination of Large Language Models: A Survey*. arXiv:2406.04244.
- Liu, S. et al. (2025). *A Comprehensive Survey on Safety Evaluation of LLMs*. arXiv:2506.11094.
- Chiang, W.-L. et al. (2024). *Chatbot Arena: An Open Platform for Evaluating LLMs by Human Preference*. arXiv:2403.04132.
- Boubdir, M. et al. (2023). *Elo Uncovered: Robustness and Best Practices in Language Model Evaluation*. arXiv:2311.17295.
- Huang, L. et al. (2023). *A Survey on Hallucination in Large Language Models*. arXiv:2311.05232.

## Catatan

1.  <span id="cite_note-pwc_flores-1">[↑](https://systems-analysis.info/int/FLORES-200_(ID)#cite_ref-pwc_flores_1-0) «FLoRes-200 Dataset». *Papers With Code*. <a href="https://paperswithcode.com/dataset/flores-200" class="external autonumber" rel="nofollow">[1]</a></span>
2.  <span id="cite_note-flores_plus-2">↑ <sup>[2.0](https://systems-analysis.info/int/FLORES-200_(ID)#cite_ref-flores_plus_2-0)</sup> <sup>[2.1](https://systems-analysis.info/int/FLORES-200_(ID)#cite_ref-flores_plus_2-1)</sup> «FLORES+ Translation and Machine Translation Evaluation for the Erzya Language». *Proceedings of the Ninth Conference on Machine Translation (WMT24)*. <a href="https://www2.statmt.org/wmt24/pdf/2024.wmt-1.49.pdf" class="external autonumber" rel="nofollow">[2]</a></span>
3.  <span id="cite_note-flores101_paper-3">[↑](https://systems-analysis.info/int/FLORES-200_(ID)#cite_ref-flores101_paper_3-0) Goyal, N., et al. «The Flores-101 Evaluation Benchmark for Low-Resource and Multilingual Machine Translation». *Transactions of the Association for Computational Linguistics*. <a href="https://aclanthology.org/2022.tacl-1.30/" class="external autonumber" rel="nofollow">[3]</a></span>
4.  <span id="cite_note-meta_news-4">↑ <sup>[4.0](https://systems-analysis.info/int/FLORES-200_(ID)#cite_ref-meta_news_4-0)</sup> <sup>[4.1](https://systems-analysis.info/int/FLORES-200_(ID)#cite_ref-meta_news_4-1)</sup> «New AI Model Translates 200 Languages, Making Technology Accessible to More People». *Meta Newsroom*. <a href="https://about.fb.com/news/2022/07/new-meta-ai-model-translates-200-languages-making-technology-more-accessible/" class="external autonumber" rel="nofollow">[4]</a></span>
5.  <span id="cite_note-huggingface_flores-5">↑ <sup>[5.0](https://systems-analysis.info/int/FLORES-200_(ID)#cite_ref-huggingface_flores_5-0)</sup> <sup>[5.1](https://systems-analysis.info/int/FLORES-200_(ID)#cite_ref-huggingface_flores_5-1)</sup> «Muennighoff/flores200». *Hugging Face*. <a href="https://huggingface.co/datasets/Muennighoff/flores200" class="external autonumber" rel="nofollow">[5]</a></span>
6.  <span id="cite_note-nllb_paper-6">[↑](https://systems-analysis.info/int/FLORES-200_(ID)#cite_ref-nllb_paper_6-0) Costa-jussà, M.R., et al. «No Language Left Behind: Scaling Human-Centered Machine Translation». *arXiv:2207.04672*. <a href="https://arxiv.org/abs/2207.04672" class="external autonumber" rel="nofollow">[6]</a></span>
