---
title: "BLOOM (language model) — بلوم"
source: "https://systems-analysis.info/int/BLOOM_(language_model)_%E2%80%94_%D8%A8%D9%84%D9%88%D9%85"
wiki: "systems-analysis.info/int"
article: "BLOOM_(language_model)_—_بلوم"
language: "ar"
categories:
  - "Category:Arabic"
  - "Category:Large language models"
  - "Category:LLM families"
  - "Category:Machine learning"
revision_id: 669
wiki_created_at: 2026-09-06T22:37:11Z
wiki_modified_at: 2026-09-06T22:37:11Z
downloaded_at: 2026-09-07T22:41:36Z
---

# BLOOM (language model) — بلوم

**BLOOM** (**B**igScience **L**arge **O**pen-science **O**pen-access **M**ultilingual Language Model) — هو نموذج لغوي كبير (LLM) مفتوح الوصول، يحتوي على **176 مليار** مُعلَمة (parameter). تم تطويره في عام 2022 ضمن مشروع **BigScience** — وهو تعاون دولي يضم أكثر من 1000 باحث من 70 دولة تحت رعاية شركة Hugging Face<sup>[\[1\]](https://systems-analysis.info/int/BLOOM_(language_model)_%E2%80%94_%D8%A8%D9%84%D9%88%D9%85#cite_note-bloom_blog-1)</sup>.

يُعد BLOOM نموذج محولات (transformer) ذاتي الانحدار (autoregressive)، قادر على توليد نصوص متماسكة بـ **46 لغة طبيعية** و**13 لغة برمجة**. تم تدريب النموذج على الحاسوب الفائق "جان زاي" (Jean Zay) في فرنسا، وأصبح أحد أوائل البدائل المفتوحة الحقيقية للنماذج المغلقة مثل GPT-3 من شركة OpenAI<sup>[\[2\]](https://systems-analysis.info/int/BLOOM_(language_model)_%E2%80%94_%D8%A8%D9%84%D9%88%D9%85#cite_note-lescao2022-2)</sup>.

## الخلفية والتطوير

أُطلقت مبادرة **BigScience** في مايو 2021 بهدف إضفاء الطابع الديمقراطي على أبحاث الذكاء الاصطناعي من خلال الإنشاء التعاوني لنموذج لغوي كبير ومفتوح<sup>[\[1\]](https://systems-analysis.info/int/BLOOM_(language_model)_%E2%80%94_%D8%A8%D9%84%D9%88%D9%85#cite_note-bloom_blog-1)</sup>. في ذلك الوقت، كانت النماذج اللغوية الكبيرة المتقدمة مثل GPT-3 تُطوَّر بشكل مغلق في الشركات الكبرى التي لم تكشف عن بنيتها المعمارية أو بيانات تدريبها أو شفرتها المصدرية. جمع مشروع BigScience أكثر من ألف باحث متطوع من جميع أنحاء العالم لإنشاء نموذج تنافسي ومفتوح بالكامل.

حصل المشروع على منحة للموارد الحاسوبية على الحاسوب الفائق الفرنسي **Jean Zay** (IDRIS/CNRS). جرى تدريب النموذج في الفترة من 11 مارس إلى 6 يوليو 2022<sup>[\[3\]](https://systems-analysis.info/int/BLOOM_(language_model)_%E2%80%94_%D8%A8%D9%84%D9%88%D9%85#cite_note-siliconangle_2022-3)</sup>. تم التطوير بأقصى قدر من الشفافية، حيث نشر الفريق معلومات حول اختيار البيانات وإعدادات التدريب وأجرى مناقشات عامة، ملتزماً بالميثاق الأخلاقي المعتمد للمشروع.

## البنية المعمارية والتدريب

### البنية المعمارية للنموذج

يعتمد BLOOM على بنية محولات (transformer) من النوع ذاتي الانحدار (*decoder-only*)، وهي مشابهة لبنية نموذج GPT-3<sup>[\[2\]](https://systems-analysis.info/int/BLOOM_(language_model)_%E2%80%94_%D8%A8%D9%84%D9%88%D9%85#cite_note-lescao2022-2)</sup>.

| المعلَمة                | الخاصية                                              |
|------------------------|------------------------------------------------------|
| **النوع**              | محول يعتمد على المفكك فقط (Decoder-only transformer) |
| **المعلَمات**           | 176,247,271,424                                      |
| **الطبقات (layers)**   | 70                                                   |
| **رؤوس الانتباه**      | 112                                                  |
| **حجم الحالة المخفية** | 14,336                                               |
| **طول التسلسل**        | 2048 رمزًا                                            |
| **دالة التنشيط**       | GeLU؛ ترميزات موضعية ALiBi                           |

الخصائص المعمارية لنموذج BLOOM<sup>[\[4\]](https://systems-analysis.info/int/BLOOM_(language_model)_%E2%80%94_%D8%A8%D9%84%D9%88%D9%85#cite_note-huggingface_model_card-4)</sup>

تم تنفيذ النموذج باستخدام أطري العمل **Megatron-LM** و**DeepSpeed**، اللذين طورتهما Nvidia وMicrosoft على التوالي، مع عدد من التعديلات لتحقيق تدريب موزع فعال<sup>[\[5\]](https://systems-analysis.info/int/BLOOM_(language_model)_%E2%80%94_%D8%A8%D9%84%D9%88%D9%85#cite_note-tech_behind_bloom-5)</sup>.

### بيانات التدريب

تم تدريب BLOOM على مجموعة بيانات نصية أُنشئت خصيصًا تُدعى **ROOTS** (The **R**esponsible **O**pen-science **O**pen-collaboration **T**ext **S**ources). بلغ الحجم الإجمالي للبيانات **1.6 تيرابايت** من النصوص المنقحة والمزالة التكرار (حوالي 366 مليار رمز)<sup>[\[6\]](https://systems-analysis.info/int/BLOOM_(language_model)_%E2%80%94_%D8%A8%D9%84%D9%88%D9%85#cite_note-roots_paper-6)</sup>.

تتضمن مجموعة البيانات نصوصًا بـ **59 لغة**:

- **46 لغة طبيعية**، بما في ذلك الإنجليزية (30% من الرموز)، والصينية، والفرنسية، والإسبانية، والعربية، بالإضافة إلى العديد من اللغات ذات الموارد المحدودة (مثل لغة تشي تومبوكا Chi Tumbuka - 0.00002% من الرموز).
- **13 لغة برمجة**، بما في ذلك Python وJava وJavaScript وC++.

جُمعت مجموعة البيانات متعددة اللغات والمجالات هذه بشكل مقصود لجعل النموذج صالحًا للاستخدام من قبل مجموعة واسعة من المجتمعات اللغوية.

## الأداء والتطبيقات

يُظهر BLOOM نتائج تنافسية في مختلف اختبارات الأداء (benchmarks)، مقارنةً بالنماذج ذات الحجم المماثل مثل OPT-175B من شركة Meta، على الرغم من طبيعته متعددة اللغات<sup>[\[2\]](https://systems-analysis.info/int/BLOOM_(language_model)_%E2%80%94_%D8%A8%D9%84%D9%88%D9%85#cite_note-lescao2022-2)</sup>.

النموذج قادر على أداء مجموعة واسعة من المهام في وضع *zero-shot* (بدون تدريب إضافي)، بما في ذلك:

- توليد النصوص بأسلوب محدد.
- تلخيص المستندات.
- الإجابة على الأسئلة بناءً على السياق.
- الترجمة بين اللغات.
- توليد أكواد برمجية بسيطة.

لتحسين فائدته العملية، أجرى فريق BigScience لاحقًا عملية ضبط دقيق (*fine-tuning*) متعددة المهام للنموذج، مما أدى إلى إنشاء إصدار **BLOOMZ**، الذي يتبع تعليمات المستخدم بدقة أكبر.

## الترخيص والوصول المفتوح

تم نشر نموذج BLOOM الكامل الذي يحتوي على 176 مليار معلمة، بالإضافة إلى شفرته المصدرية وبياناته، في يوليو 2022. يُوزَّع النموذج بموجب ترخيص مُصمَّم خصيصًا وهو **RAIL (Responsible AI License) v1.0**<sup>[\[7\]](https://systems-analysis.info/int/BLOOM_(language_model)_%E2%80%94_%D8%A8%D9%84%D9%88%D9%85#cite_note-rail_license-7)</sup>.

يسمح هذا الترخيص بالاستخدام والتعديل المجاني للنموذج، ولكنه يفرض بعض القيود على تطبيقه في مجالات معينة. على وجه الخصوص، يُحظر استخدام BLOOM لأغراض تتعارض مع المعايير الأخلاقية لمشروع BigScience، مثل:

- المراقبة الجماعية.
- التمييز الخوارزمي.
- نشر المعلومات المضللة.
- التحكم في الأسلحة الفتاكة.

أصبح BLOOM أول نموذج ذكاء اصطناعي كبير يُصدر بموجب ترخيص يتضمن شروطًا صريحة حول الاستخدام المسؤول<sup>[\[8\]](https://systems-analysis.info/int/BLOOM_(language_model)_%E2%80%94_%D8%A8%D9%84%D9%88%D9%85#cite_note-heikkila_2022-8)</sup>.

## المراجع

- Hendrycks, D.; Gimpel, K. (206). *Gaussian Error Linear Units (GELUs)*. <a href="https://arxiv.org/abs/1606.08415" class="external text" rel="nofollow">arXiv:1606.08415</a>.
- Shoeybi, M.; et al. (2019). *Megatron‑LM: Training Multi‑Billion Parameter Language Models Using Model Parallelism*. <a href="https://arxiv.org/abs/1909.08053" class="external text" rel="nofollow">arXiv:1909.08053</a>.
- Rajbhandari, S.; et al. (2020). *ZeRO: Memory Optimizations Toward Training Trillion Parameter Models*. <a href="https://arxiv.org/abs/1910.02054" class="external text" rel="nofollow">arXiv:1910.02054</a>.
- Press, O.; et al. (2021). *Train Short, Test Long: Attention with Linear Biases Enables Input Length Extrapolation*. <a href="https://arxiv.org/abs/2108.12409" class="external text" rel="nofollow">arXiv:2108.12409</a>.
- Le Scao, T.; et al. (2022). *BLOOM: A 176B‑Parameter Open‑Access Multilingual Language Model*. <a href="https://arxiv.org/abs/2211.05100" class="external text" rel="nofollow">arXiv:2211.05100</a>.
- Muennighoff, N.; et al. (2022). *BLOOMZ & mT0: A Cross‑Lingual Baseline for Instruction Finetuning*. <a href="https://arxiv.org/abs/2211.01786" class="external text" rel="nofollow">arXiv:2211.01786</a>.
- BigScience Workshop (2022). *BigScience OpenRAIL‑M License v1.0*. <a href="https://bigscience.huggingface.co/blog/bigscience-openrail-m" class="external text" rel="nofollow">Online specification</a>.
- Akiki, C.; et al. (2022). *BigScience: A Case Study in the Social Construction of a Multilingual Large Language Model*. <a href="https://arxiv.org/abs/2212.04960" class="external text" rel="nofollow">arXiv:2212.04960</a>.
- Yong, Z.‑X.; et al. (2022). *BLOOM+1: Adding Language Support to BLOOM for Zero‑Shot Prompting*. <a href="https://arxiv.org/abs/2212.09535" class="external text" rel="nofollow">arXiv:2212.09535</a>.
- Biderman, S.; et al. (2023). *The BigScience ROOTS Corpus: A 1.6 TB Composite Multilingual Dataset*. <a href="https://arxiv.org/abs/2303.03915" class="external text" rel="nofollow">arXiv:2303.03915</a>.

## ملاحظات

1.  <span id="cite_note-bloom_blog-1">↑ <sup>[1.0](https://systems-analysis.info/int/BLOOM_(language_model)_%E2%80%94_%D8%A8%D9%84%D9%88%D9%85#cite_ref-bloom_blog_1-0)</sup> <sup>[1.1](https://systems-analysis.info/int/BLOOM_(language_model)_%E2%80%94_%D8%A8%D9%84%D9%88%D9%85#cite_ref-bloom_blog_1-1)</sup> «BLOOM». *BigScience Blog*. <a href="https://bigscience.huggingface.co/blog/bloom" class="external autonumber" rel="nofollow">[١]</a></span>
2.  <span id="cite_note-lescao2022-2">↑ <sup>[2.0](https://systems-analysis.info/int/BLOOM_(language_model)_%E2%80%94_%D8%A8%D9%84%D9%88%D9%85#cite_ref-lescao2022_2-0)</sup> <sup>[2.1](https://systems-analysis.info/int/BLOOM_(language_model)_%E2%80%94_%D8%A8%D9%84%D9%88%D9%85#cite_ref-lescao2022_2-1)</sup> <sup>[2.2](https://systems-analysis.info/int/BLOOM_(language_model)_%E2%80%94_%D8%A8%D9%84%D9%88%D9%85#cite_ref-lescao2022_2-2)</sup> Le Scao, T., et al. (2022). «BLOOM: A 176B-Parameter Open-Access Multilingual Language Model». *arXiv:2211.05100*. <a href="https://arxiv.org/abs/2211.05100" class="external autonumber" rel="nofollow">[٢]</a></span>
3.  <span id="cite_note-siliconangle_2022-3">[↑](https://systems-analysis.info/int/BLOOM_(language_model)_%E2%80%94_%D8%A8%D9%84%D9%88%D9%85#cite_ref-siliconangle_2022_3-0) «Researchers open-source neural network with 176B parameters». *SiliconANGLE*. <a href="https://siliconangle.com/2022/07/12/researchers-open-source-neural-network-176b-parameters/" class="external autonumber" rel="nofollow">[٣]</a></span>
4.  <span id="cite_note-huggingface_model_card-4">[↑](https://systems-analysis.info/int/BLOOM_(language_model)_%E2%80%94_%D8%A8%D9%84%D9%88%D9%85#cite_ref-huggingface_model_card_4-0) «bigscience/bloom». *Hugging Face*. <a href="https://huggingface.co/bigscience/bloom" class="external autonumber" rel="nofollow">[٤]</a></span>
5.  <span id="cite_note-tech_behind_bloom-5">[↑](https://systems-analysis.info/int/BLOOM_(language_model)_%E2%80%94_%D8%A8%D9%84%D9%88%D9%85#cite_ref-tech_behind_bloom_5-0) «The Technology Behind BLOOM Training». *Hugging Face Blog*. <a href="https://huggingface.co/blog/bloom-megatron-deepspeed" class="external autonumber" rel="nofollow">[٥]</a></span>
6.  <span id="cite_note-roots_paper-6">[↑](https://systems-analysis.info/int/BLOOM_(language_model)_%E2%80%94_%D8%A8%D9%84%D9%88%D9%85#cite_ref-roots_paper_6-0) Biderman, S. et al. (2023). «The BigScience ROOTS Corpus: A 1.6 TB Composite Multilingual Dataset». *arXiv:2303.03915*. <a href="https://arxiv.org/abs/2303.03915" class="external autonumber" rel="nofollow">[٦]</a></span>
7.  <span id="cite_note-rail_license-7">[↑](https://systems-analysis.info/int/BLOOM_(language_model)_%E2%80%94_%D8%A8%D9%84%D9%88%D9%85#cite_ref-rail_license_7-0) «BigScience OpenRAIL-M». *BigScience Blog*. <a href="https://bigscience.huggingface.co/blog/bigscience-openrail-m" class="external autonumber" rel="nofollow">[٧]</a></span>
8.  <span id="cite_note-heikkila_2022-8">[↑](https://systems-analysis.info/int/BLOOM_(language_model)_%E2%80%94_%D8%A8%D9%84%D9%88%D9%85#cite_ref-heikkila_2022_8-0) Heikkilä, M. «BLOOM is the first AI model to be under a...». *X*. <a href="https://mobile.twitter.com/Melissahei/status/1546870957402427393" class="external autonumber" rel="nofollow">[٨]</a></span>
