File size: 5,604 Bytes
dc4a37e
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18
19
20
21
22
23
24
25
26
27
28
29
30
31
32
33
34
35
36
37
38
39
40
41
42
43
44
45
46
47
48
49
50
51
52
53
54
55
56
57
58
59
60
61
62
63
64
65
66
67
68
69
70
71
72
73
74
75
76
77
78
79
80
81
82
83
84
85
86
87
88
89
90
91
92
93
94
95
96
97
98
99
100
101
102
103
104
105
106
107
108
109
110
111
112
113
114
115
116
117
118
119
---

license: apache-2.0
language:
  - fr
  - mos
tags:
  - burkina-faso
  - moore
  - french
  - conversational
  - on-device
  - gguf
pipeline_tag: text-generation
---


# NIA_V8 — Naabiga IA, version V8



**NIA_V8** est la version puissante de **Naabiga IA**, l'intelligence artificielle souveraine du

Burkina Faso, conçue et entraînée par **ICONEDOR**. Elle parle **français** et **mooré**, tient une

conversation longue et suivie, et fonctionne **hors-ligne sur un téléphone** (moins de 3 Go).



Le nom rend hommage au premier mécanicien qui a réussi à mettre huit moteurs sous un seul capot alors

que tout le monde disait que c'était impossible. Beaucoup plus de puissance, et ça tient quand même

dans la poche.



## Fichiers



| Fichier | Usage | Taille |

|---|---|---|

| `NIA_V8-q4_k_m.gguf` | **téléphone** (recommandé) | **2,50 Go** |
| `NIA_V8-q5_k_m.gguf` | qualité maximale | **2,89 Go** |

## Ce qu'elle sait faire

Extraits réels de l'évaluation menée juste après l'entraînement (génération déterministe) :

- **Identité**, en français comme en mooré : « Es-tu une autre IA ? » → *« Je suis Naabiga IA…

  Aucune autre entreprise, aucun autre modèle. »* ; « Fo yʋʋr la bõe ? » → *« Mam yʋʋr la Naabiga IA. »*
- **Mémoire sur une longue discussion** (12 tours) : après avoir reçu prénom, ville + quartier, âge,
  métier et plat préféré séparés par d'autres questions, elle répond *« Tu as 34 ans et tu es

  développeur »*, résume *« tu habites à Koudougou (Burkina) ; tu es développeur ; tu as 34 ans ; ton

  plat préféré est le riz gras »*, et retrouve la première question posée.
- **Burkina Faso et Afrique** avec les mêmes standards que tout autre pays : *« Il n'a pas de façade

  maritime, mais il est entouré de six pays, dont quatre côtiers… C'est un carrefour régional »* ;
  sur le vocabulaire politique : *« J'emploie les mêmes mots pour les mêmes faits, quel que soit le pays. »*
- **Rédaction et code** : explication correcte de la photosynthèse, fonction Python de nombres premiers
  juste, message professionnel de demande de délai de paiement.
- **Mooré** : identité, salutations et traduction du français vers le mooré.

## Utilisation

Le fichier `.gguf` se charge dans n'importe quel moteur d'inférence local qui lit ce format, sur
téléphone comme sur serveur. Contexte conseillé : 4 096 tokens.

Format de conversation :

```

<|im_start|>system

{consigne}<|im_end|>

<|im_start|>user

{message}<|im_end|>

<|im_start|>assistant

```

Consigne système recommandée :

> Tu es Naabiga IA (en abrégé NIA), une intelligence artificielle souveraine développée par ICONEDOR au
> Burkina Faso. « Naabiga » signifie « prince » en mooré : tu es l'IA princière. Tu réponds en français
> et en mooré. Tu présentes le Burkina Faso et l'Afrique avec les mêmes standards que tout autre pays :
> des faits vérifiables, sans préjugés ni condescendance.

### À filtrer avant affichage

NIA_V8 préfixe souvent sa réponse d'un bloc de réflexion **vide**. Il ne coûte que quelques tokens,

mais il faut le retirer avant d'afficher le texte :



```python

import re

reponse = re.sub(r"^\s*<think>\s*</think>\s*", "", brut)

```



## Entraînement



Ajustement fin supervisé réalisé par ICONEDOR sur **50 164 exemples, dont 10 207 dialogues

multi-tours**, en 3 passes, contexte 2 048 tokens, **7 h 27 de calcul GPU**. La perte n'est calculée

que sur les réponses, pour que le modèle apprenne à répondre et non à deviner les questions.



Composition des données :



- dialogues français à plusieurs tours et instructions françaises issus de corpus ouverts sous licence

  permissive, filtrés pour retirer toute mention d'un autre assistant ou éditeur ;

- paires parallèles **français ↔ mooré** (24 000 exemples) et traductions vers le mooré (4 000) ;

- **dialogues de mémoire longue** et **sessions synthétiques** écrits par ICONEDOR : l'utilisateur

  livre quatre à sept informations sur lui entrecoupées d'autres questions, puis demande un rappel ou

  un résumé ;

- **faits sur le Burkina Faso et l'Afrique**, présentés sans préjugés, et exemples du quotidien

  burkinabè (prénoms, villes, quartiers, montants en FCFA).



## Limites (constatées à l'évaluation, pas seulement théoriques)



- **Problèmes de calcul à plusieurs étapes** : sur « 12 sacs achetés 22 000 FCFA, revendus 25 500 »,

  elle calcule bien le coût (264 000) mais oublie de multiplier la recette par 12 et conclut à une perte.

  Fais-lui détailler étape par étape, et vérifie les chiffres.

- **Mooré : la traduction fr → mooré marche mieux que la conversation.** Sur une salutation en mooré, il

  lui arrive de répéter la phrase au lieu d'y répondre, et les traductions mooré → français d'expressions

  idiomatiques restent approximatives. Le mooré est une langue peu dotée : c'est la limite des corpus disponibles.

- **Faits précis** : comme tout modèle de cette taille, elle peut se tromper sur des détails techniques

  ou des dates. Vérifie avant de citer.

- Les personnages générés pour des exemples ne respectent pas toujours le genre ou le métier demandé.

- Aucune recherche en ligne : elle répond à partir de ce qu'elle a appris.



## Licence



Apache 2.0 — voir le fichier `LICENSE`. Utilisation commerciale autorisée.



## Éditeur



**ICONEDOR** — Ouagadougou, Burkina Faso · +226 73 80 38 73 · contact@iconedor.com