Méthodologie

Le premier et le deuxième modèle sont deux ensembles de données strictement indépendants : ils restent séparés partout sur le site et ne sont jamais fusionnés par défaut.

Pour faciliter la recherche, le programme peut ignorer certains signes lors de la comparaison. Le texte coranique affiché reste toutefois fidèle à la source fournie par l’auteur du projet, avec ses lettres et ses signes d’origine.

Répétition et ressemblance des mots : quelle différence ?

Al-Zarkashi, dans son ouvrage al-Burhân, définit la « ressemblance des mots » (al-mutashâbih al-lafẕî) comme le fait de rapporter une même histoire sous des formes et des enchaînements différents, un procédé fréquent dans les récits et les annonces coraniques.

Il désigne ainsi un même énoncé coranique revenant sous des formes proches, où la ressemblance tient à des différences par ajout, retrait, substitution ou inversion de l'ordre des mots — ce qui exige du lecteur mémorisateur une vérification et une attention accrues ; les spécialistes de la lecture nomment ce type « al-mushkil » (l'ambigu).

  • Le « répété » (al-mukarrar) : un même mot revenant sans aucune variation en plusieurs emplacements du Coran, comme le verset ⁧﴿فَبِأَيِّ آلاءِ رَبِّكُمَا تُكَذِّبَانِ﴾⁩ [Ar-Rahman, 13] — la répétition littérale à l'identique.
  • Le cas où le sens se répète avec de légères variations de formulation très proches — c'est précisément la ressemblance lexicale (al-mutashâbih al-lafẕî).
  • Le cas où seul le sens se répète sans que les mots ne se ressemblent — comme la répétition des récits des prophètes sous des styles et des formulations très différents — qui sort du champ de la ressemblance lexicale.

Remarque méthodologique sur les mots de forme semblable mais de sens différent

Ce travail repose sur le recensement des mots du Coran selon leur forme écrite et leurs emplacements, en conservant tous les emplacements où un mot se ressemble par son tracé ou sa prononciation, même si son sens varie selon le contexte, la dérivation, la structure morphologique ou sa position dans le verset.

Le lecteur pourra ainsi trouver dans ce projet des mots de forme semblable qui ne portent pas le même sens dans tous leurs emplacements. Il ne s'agit ni d'une erreur de recensement, ni d'une répétition involontaire, ni d'une confusion entre les mots : c'est un choix intentionnel et méthodique, car le mot coranique ne se comprend jamais isolément de son contexte, de sa construction, ni du verset où il apparaît.

La ressemblance graphique n'implique donc pas toujours la ressemblance de sens, de même que la différence de voyellation, de dérivation ou de contexte peut faire passer un mot d'un sens à un autre. Tous ces emplacements ont été conservés afin que la matière de recherche reste complète, et que le lecteur comme le chercheur puissent réfléchir, comparer et revenir aux versets dans leur contexte d'origine.

Ainsi, « ⁧أَلَّفَ⁩ » (allafa, « unir ») et « ⁧أَلْفَ⁩ » (alfa, « mille ») sont proches par leur forme écrite, mais leur sens diffère : ⁧﴿وَأَلَّفَ بَيۡنَ قُلُوبِهِمۡۚ لَوۡ أَنفَقۡتَ مَا فِي ٱلۡأَرۡضِ جَمِيعٗا مَّآ أَلَّفۡتَ بَيۡنَ قُلُوبِهِمۡ وَلَٰكِنَّ ٱللَّهَ أَلَّفَ بَيۡنَهُمۡۚ إِنَّهُۥ عَزِيزٌ حَكِيمٞ63﴾⁩ [Al-Anfal, 63] — ici, « allafa » signifie unir les cœurs, créer l'harmonie et l'affection entre eux ; le sens d'union des cœurs est explicite dans le verset.

Dans un autre verset en revanche : ⁧﴿وَلَتَجِدَنَّهُمۡ أَحۡرَصَ ٱلنَّاسِ عَلَىٰ حَيَوٰةٖ وَمِنَ ٱلَّذِينَ أَشۡرَكُواْۚ يَوَدُّ أَحَدُهُمۡ لَوۡ يُعَمَّرُ أَلۡفَ سَنَةٖ وَمَا هُوَ بِمُزَحۡزِحِهِۦ مِنَ ٱلۡعَذَابِ أَن يُعَمَّرَۗ وَٱللَّهُ بَصِيرُۢ بِمَا يَعۡمَلُونَ96﴾⁩ [Al-Baqara, 96] — ici, « alfa » est un nombre (mille années), sans lien avec le sens d'union.

De même, « ⁧سُنَّة⁩ » (sunna, « voie, loi immuable ») et « ⁧سِنَة⁩ » (sina, « somnolence ») se ressemblent graphiquement, mais leurs sens sont nettement différents : ⁧﴿سُنَّةَ ٱللَّهِ فِي ٱلَّذِينَ خَلَوۡاْ مِن قَبۡلُۖ وَلَن تَجِدَ لِسُنَّةِ ٱللَّهِ تَبۡدِيلٗا 62﴾⁩ [Al-Ahzab, 62] — ici, « sunnat Allah » désigne la voie immuable d'Allah, la loi divine constante dans Sa création.

Tandis que : ⁧﴿ٱللَّهُ لَآ إِلَٰهَ إِلَّا هُوَ ٱلۡحَيُّ ٱلۡقَيُّومُۚ لَا تَأۡخُذُهُۥ سِنَةٞ وَلَا نَوۡمٞۚ⁩...⁧255﴾⁩ [Al-Baqara, 255] — ici, « sina » désigne l'assoupissement, dans un verset qui nie tout sommeil pour Allah.

De la même façon, « ⁧أُمَّة⁩ » (umma) change de sens selon le contexte : ⁧﴿إِنَّ إِبۡرَٰهِيمَ كَانَ أُمَّةٗ قَانِتٗا لِّلَّهِ حَنِيفٗا وَلَمۡ يَكُ مِنَ ٱلۡمُشۡرِكِينَ 120﴾⁩ [An-Nahl, 120] — ici, « umma » désigne un homme réunissant à lui seul les qualités du bien, à la place d'une communauté entière dans la piété et l'obéissance.

Ailleurs, il désigne un groupe de personnes : ⁧﴿وَلَمَّا وَرَدَ مَآءَ مَدۡيَنَ وَجَدَ عَلَيۡهِ أُمَّةٗ مِّنَ ٱلنَّاسِ يَسۡقُونَ⁩...⁧23﴾⁩ [Al-Qasas, 23] — ici, « umma » désigne un groupe de personnes.

Le même mot peut aussi signifier une durée de temps : ⁧﴿وَقَالَ ٱلَّذِي نَجَا مِنۡهُمَا وَٱدَّكَرَ بَعۡدَ أُمَّةٍ أَنَا۠ أُنَبِّئُكُم بِتَأۡوِيلِهِۦ فَأَرۡسِلُونِ45﴾⁩ [Yusuf, 45] — ici, « umma » désigne une période de temps. De la même manière, « ⁧آية⁩ » (aya) peut signifier un signe, une preuve manifeste, ou un verset du Coran ; là aussi, seul le contexte permet de trancher.

Il en va de même pour « ⁧الرُّوح⁩ » (ar-rûh) : selon le contexte, ce mot peut renvoyer à la révélation, à l'ange Gabriel, ou à l'esprit vital de l'être humain — aucun de ces emplacements ne doit être ramené à un sens unique sans examiner le contexte du verset.

C'est pourquoi ces mots de forme semblable ont été conservés, malgré leurs sens différents, pour les raisons suivantes :

  • Supprimer certains emplacements réduirait la matière coranique recensée.
  • Le lecteur a besoin de voir tous les emplacements semblables pour comparer et méditer.
  • Le sens précis n'apparaît jamais dans le mot isolé mais dans le verset, son contexte et sa construction.
  • La différence de sens malgré la ressemblance graphique ouvre une porte à la réflexion linguistique, rhétorique et méditative.
  • Ce qui ne révèle pas aujourd'hui sa sagesse au chercheur pourra s'éclaircir demain, à mesure que s'élargit la recherche linguistique et coranique, sans jamais prétendre trancher ce qui n'est pas établi par une preuve.

La présence de mots semblables en apparence mais différents en sens fait donc partie intégrante de la méthode de ce projet, et non d'un défaut de classement. Le lecteur doit toujours revenir au verset complet, au nom de la sourate et au numéro du verset, avant de fonder tout jugement linguistique ou sémantique sur un mot du tableau.

À noter : la recherche porte uniquement sur les mots ou le texte correspondant de façon exacte et isolée (« isolé » signifiant non rattaché à un autre mot ou même à une seule lettre supplémentaire). Par exemple, une recherche sur le mot « ⁧يعلمون⁩ » (ils savent) n’inclut pas le mot « ⁧فيعلمون⁩ » (et ils savent). Deuxième précision : certaines formes, comme « ⁧فيعلمون⁩ » (et ils savent), ne sont pas répétées dans le Coran. Mais l’absence d’un mot comme entrée autonome dans la liste ne signifie pas nécessairement qu’il n’est pas répété : ce programme retient le segment répété le plus long. Ainsi, « ⁧فسيعلمون⁩ » (alors ils sauront) apparaît deux fois, suivi de « ⁧من⁩ » (qui) dans les deux cas. Le programme présente donc « ⁧فسيعلمون من⁩ » (alors ils sauront qui), plutôt que « ⁧فسيعلمون⁩ » seul.

Pourquoi séparer le waw de conjonction dans l'indexation et l'analyse

Séparer le waw de conjonction (« ⁧و⁩ ») du mot qui le suit, dans ce travail, ne constitue en rien une modification du tracé coranique (rasm), ni un appel à écrire le Coran autrement que selon le tracé établi du Moshaf ou les règles de l'orthographe arabe. En arabe, le waw de conjonction s'écrit normalement attaché au mot suivant — comme « ⁧والله⁩ », « ⁧ويهدي⁩ », « ⁧ومن⁩ » — car c'est une lettre qui se lie graphiquement au mot suivant.

Mais ce projet a une nature analytique et indexicale, non une nature de transcription du Moshaf. C'est pourquoi la séparation du waw de conjonction n'a été appliquée que dans la base de données et les tableaux de recherche, afin qu'il apparaisse comme un élément linguistique autonome, que l'on peut compter, dont on peut suivre les emplacements et étudier la relation avec ce qui le suit. Le texte coranique affiché reste préservé dans sa forme d'origine ; cette séparation demeure un outil technique de recherche et d'analyse.

Masquer le waw de conjonction à l'intérieur du mot auquel il est attaché empêcherait de distinguer deux emplacements différents par leur structure et leur portée : un mot apparu seul, et ce même mot précédé du waw de conjonction. Ainsi, rechercher l'expression « ⁧يهدي من يشاء⁩ » peut donner dix résultats, alors que restreindre la recherche à la forme « ⁧و يهدي من يشاء⁩ » révèle que seuls cinq de ces emplacements sont effectivement précédés du waw de conjonction. Ce résultat n'est pas une répétition sans intérêt, mais une information analytique distincte, utile pour étudier le contexte, relier les versets et comprendre la structure de transition entre les sens.

De la même manière, le nom « ⁧الله⁩ » apparaît dans 2 393 résultats, tandis que la forme « ⁧و الله⁩ » n'apparaît que dans 240 résultats. Le premier chiffre indique la présence globale du mot dans l'ensemble du texte ; le second indique sa présence dans les emplacements précis où il est lié par une fonction de conjonction. Aucune de ces deux informations ne doit être écartée au motif de la multiplicité des résultats de l'autre : chacune répond à une question de recherche différente et porte une signification propre.

La fréquence du waw de conjonction, qui atteint 9 546 emplacements dans ces tableaux, n'est pas une raison de le négliger, mais au contraire la preuve de son importance dans la structure du texte. Le waw de conjonction est en effet l'un des outils les plus liés à la construction de la phrase et du verset ; il relie mots, structures et significations, et participe à marquer la coordination, l'ordre contextuel ou la transition entre les éléments du discours selon le contexte. Le comptabiliser et le séparer analytiquement ouvre donc la voie à une étude précise, inaccessible s'il restait fondu dans le mot suivant.

Cette méthode a permis aussi de révéler des particularités que la recherche habituelle ne fait pas apparaître : fait notable, la sourate At-Takathur (102) est la seule sourate où le waw de conjonction n'apparaît pas selon les critères de cet index analytique. Cette observation n'est pas en elle-même un jugement rhétorique définitif, mais elle offre un point de départ clair pour le chercheur désireux de revenir à la sourate et d'en étudier la structure, le contexte et les outils de liaison.

Ce principe ne se limite pas au seul waw de conjonction : les mots et particules très fréquents ne perdent pas leur valeur du fait de leur fréquence. Le nom « ⁧الله⁩ », les pronoms comme « ⁧هم⁩ » et « ⁧إلى⁩ », ou des mots comme « ⁧الذين⁩ », « ⁧في⁩ » et « ⁧أن⁩ » reviennent très souvent ; pourtant, les recenser et les relier à leurs contextes révèle des nuances précises entre leurs usages. La multiplicité des résultats ne rend donc pas la recherche vaine : elle rend au contraire la classification et l'analyse plus nécessaires et plus rigoureuses.

C'est pourquoi ce projet a adopté la séparation analytique du waw de conjonction : pour permettre au lecteur de rechercher le mot seul, le mot précédé du waw de conjonction, ou le waw de conjonction lui-même, et de comparer les résultats de façon claire et vérifiable. L'objectif n'est pas de gonfler artificiellement les chiffres, mais de permettre une lecture méthodique du texte, distinguant le tracé orthographique continu des éléments grammaticaux et sémantiques utiles à la recherche scientifique.

Règles pratiques de correspondance tome/page

La correspondance tome/page pour le premier modèle suit la règle suivante : dans le tome 1, le numéro de page du PDF correspond au numéro de page du tableau plus 24 (introduction non numérotée de 24 pages) ; dans les tomes 2 à 13, les deux numéros de page coïncident. Les règles du deuxième modèle seront documentées séparément dès réception des exports.

La Basmala dans ce projet

Tous les savants reconnaissent « بِسْمِ اللَّهِ الرَّحْمَنِ الرَّحِيمِ » comme un verset du Coran à l’intérieur de la sourate An-Naml (sourate 27, verset 30). Son statut au début des sourates fait en revanche l’objet d’une divergence classique.

Pour l’école de l’imam Al-Chafi‘i et un groupe de savants, la Basmala est le premier verset de la sourate Al-Fatiha ; c’est pourquoi elle porte le numéro 1 dans les exemplaires du Coran fondés sur la lecture de Médine ou de Koufa, comme la lecture de Hafs, très répandue. Pour les écoles de l’imam Malik et de l’imam Abou Hanifa, elle ne fait pas partie de la Fatiha : le premier verset est alors « الْحَمْدُ لِلَّهِ رَبِّ الْعَالَمِينَ », et le dernier verset est divisé en deux pour garder sept versets.

Au début des autres sourates (elle en ouvre 113 sur 114, toutes sauf la sourate At-Tawba), les écoles chafi‘ite et hanbalite la considèrent comme un verset, tandis que les écoles malikite et hanafite y voient une formule bénie qui sépare les sourates sans en faire partie.

Dans ce projet, « بِسْمِ اللَّهِ الرَّحْمَنِ الرَّحِيمِ » est comptée comme le verset 1 de la sourate Al-Fatiha, conformément à la numérotation de la lecture de Hafs. Ce choix de numérotation ne prend pas parti dans la divergence entre les écoles.

Premier modèle — tableau organisé selon l'ordre du Coran

Dans ce modèle, les sourates et les versets sont classés selon l'ordre connu du Coran, à partir de la sourate Al-Fatiha, puis Al-Baqara, puis les autres sourates jusqu'à la fin du Moshaf. Sous chaque verset sont regroupés les résultats ou les groupes de doublons qui s'y rattachent, puis le tableau passe au verset suivant selon l'ordre du Moshaf.

Il est donc facile, dans ce modèle, de suivre les résultats selon leur emplacement coranique réel : les sourates apparaissent par numéros croissants, et les versets suivent leur ordre à l'intérieur de chaque sourate. L'ordre des lignes est ici un ordre coranique séquentiel, dont le but est de relier les résultats de recherche à leurs emplacements d'origine dans le Moshaf.

Aller au premier modèle →

Deuxième modèle — tableau organisé selon les résultats de recherche et les correspondances

Dans ce modèle, les sourates et les versets ne sont pas classés de façon séquentielle, du début à la fin du Coran. Chaque groupe de résultats commence par un verset contenant le mot ou le segment recherché, puis les autres versets appartenant au même groupe de doublons ou de correspondances sont regroupés en dessous, quel que soit leur emplacement réel dans le Coran.

Le lecteur peut ainsi passer d'une sourate à une autre, puis revenir à une sourate précédente, selon les emplacements des mots semblables et les résultats de correspondance, et non selon l'ordre des sourates dans le Coran. L'ordre des lignes est ici un ordre de recherche analytique, dont le but est de réunir dans un même ensemble tous les emplacements liés à un même mot ou segment, même si ces emplacements sont dispersés entre des sourates et des versets éloignés.

Il est donc normal et intentionnel, dans ce modèle, qu'un numéro de sourate passe d'un rang avancé à un rang inférieur, ou que la même sourate apparaisse à plusieurs endroits dispersés dans le tableau : cela ne signale aucune anomalie de classement.

Aller au deuxième modèle →