Add files using upload-large-folder tool
Browse files- .python_history +18 -0
- lm-evaluation-harness/lm_eval/models/__pycache__/vllm_causallms.cpython-310.pyc +0 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_1/afrimgsm_ewe.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_1/afrimgsm_hau.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_1/afrimgsm_ibo.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_1/afrimgsm_kin.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_1/afrimgsm_lin.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_1/afrimgsm_lug.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_1/afrimgsm_orm.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_1/afrimgsm_sna.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_1/afrimgsm_sot.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_1/afrimgsm_twi.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_1/afrimgsm_wol.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_1/afrimgsm_xho.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_1/afrimgsm_yaml +35 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_1/afrimgsm_yor.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_1/afrimgsm_zul.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_2/afrimgsm_amh.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_2/afrimgsm_eng.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_2/afrimgsm_fra.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_2/afrimgsm_hau.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_2/afrimgsm_ibo.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_2/afrimgsm_lin.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_2/afrimgsm_lug.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_2/afrimgsm_orm.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_2/afrimgsm_sna.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_2/afrimgsm_swa.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_2/afrimgsm_twi.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_2/afrimgsm_wol.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_2/afrimgsm_xho.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_2/afrimgsm_yaml +34 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_2/afrimgsm_zul.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_3/afrimgsm_amh.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_3/afrimgsm_eng.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_3/afrimgsm_ewe.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_3/afrimgsm_fra.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_3/afrimgsm_hau.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_3/afrimgsm_lin.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_3/afrimgsm_lug.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_3/afrimgsm_orm.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_3/afrimgsm_swa.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_3/afrimgsm_twi.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_3/afrimgsm_vai.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_3/afrimgsm_wol.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_4/afrimgsm_amh.yaml +7 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_4/afrimgsm_eng.yaml +7 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_4/afrimgsm_ewe.yaml +7 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_4/afrimgsm_fra.yaml +7 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_4/afrimgsm_hau.yaml +7 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_4/afrimgsm_kin.yaml +7 -0
.python_history
ADDED
|
@@ -0,0 +1,18 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
a=[4, 4, 4, 4, 4, 4, 4, 4, 4, 4, 4, 4, 4, 4, 4, 4, 4, 4, 4, 4, 4, 4, 4, 4, 4, 4, 4, 4, 4, 4, 4, 2]
|
| 2 |
+
len(a)
|
| 3 |
+
a= " 1 "
|
| 4 |
+
int(a)
|
| 5 |
+
b=int(a)
|
| 6 |
+
b
|
| 7 |
+
type(b)
|
| 8 |
+
type(b)
|
| 9 |
+
type(b)
|
| 10 |
+
b
|
| 11 |
+
3584*3584*2+3584+51282
|
| 12 |
+
3584*18944*3
|
| 13 |
+
203685888/25744978
|
| 14 |
+
4096*4096*2+ 4096*1024*2
|
| 15 |
+
4096*14336*3
|
| 16 |
+
176160768/41943040
|
| 17 |
+
a=[29, 23, 24, 30, 18, 28, 26, 20, 16, 27, 25, 17, 19, 21]
|
| 18 |
+
len(a)
|
lm-evaluation-harness/lm_eval/models/__pycache__/vllm_causallms.cpython-310.pyc
ADDED
|
Binary file (19.3 kB). View file
|
|
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_1/afrimgsm_ewe.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: ewe
|
| 3 |
+
include: afrimgsm_yaml
|
| 4 |
+
task: afrimgsm_ewe_prompt_1
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_1/afrimgsm_hau.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: hau
|
| 3 |
+
include: afrimgsm_yaml
|
| 4 |
+
task: afrimgsm_hau_prompt_1
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_1/afrimgsm_ibo.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: ibo
|
| 3 |
+
include: afrimgsm_yaml
|
| 4 |
+
task: afrimgsm_ibo_prompt_1
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_1/afrimgsm_kin.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: kin
|
| 3 |
+
include: afrimgsm_yaml
|
| 4 |
+
task: afrimgsm_kin_prompt_1
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_1/afrimgsm_lin.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: lin
|
| 3 |
+
include: afrimgsm_yaml
|
| 4 |
+
task: afrimgsm_lin_prompt_1
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_1/afrimgsm_lug.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: lug
|
| 3 |
+
include: afrimgsm_yaml
|
| 4 |
+
task: afrimgsm_lug_prompt_1
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_1/afrimgsm_orm.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: orm
|
| 3 |
+
include: afrimgsm_yaml
|
| 4 |
+
task: afrimgsm_orm_prompt_1
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_1/afrimgsm_sna.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: sna
|
| 3 |
+
include: afrimgsm_yaml
|
| 4 |
+
task: afrimgsm_sna_prompt_1
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_1/afrimgsm_sot.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: sot
|
| 3 |
+
include: afrimgsm_yaml
|
| 4 |
+
task: afrimgsm_sot_prompt_1
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_1/afrimgsm_twi.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: twi
|
| 3 |
+
include: afrimgsm_yaml
|
| 4 |
+
task: afrimgsm_twi_prompt_1
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_1/afrimgsm_wol.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: wol
|
| 3 |
+
include: afrimgsm_yaml
|
| 4 |
+
task: afrimgsm_wol_prompt_1
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_1/afrimgsm_xho.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: xho
|
| 3 |
+
include: afrimgsm_yaml
|
| 4 |
+
task: afrimgsm_xho_prompt_1
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_1/afrimgsm_yaml
ADDED
|
@@ -0,0 +1,35 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
tag:
|
| 2 |
+
- afrimgsm_tasks
|
| 3 |
+
- afrimgsm_tasks_prompt_1
|
| 4 |
+
dataset_path: masakhane/afrimgsm
|
| 5 |
+
dataset_name: null # Overridden by language-specific config.
|
| 6 |
+
output_type: generate_until
|
| 7 |
+
test_split: test
|
| 8 |
+
doc_to_target: '{% if answer is not none %}{{answer[21:]}}{% else %}{{answer_number|string}}{% endif %}'
|
| 9 |
+
doc_to_text: '{% if answer is not none %}{{question+"\nAnswer:"}}{% else %}{{"Question: "+question+"\nAnswer:"}}{% endif %}'
|
| 10 |
+
target_delimiter: ""
|
| 11 |
+
generation_kwargs:
|
| 12 |
+
do_sample: false
|
| 13 |
+
until:
|
| 14 |
+
- 'Question:'
|
| 15 |
+
- </s>
|
| 16 |
+
- <|im_end|>
|
| 17 |
+
filter_list:
|
| 18 |
+
- name: remove_whitespace
|
| 19 |
+
filter:
|
| 20 |
+
- function: remove_whitespace
|
| 21 |
+
- function: take_first
|
| 22 |
+
- filter:
|
| 23 |
+
- function: regex
|
| 24 |
+
group_select: -1
|
| 25 |
+
regex_pattern: (-?[$0-9.,]{2,})|(-?[0-9]+)
|
| 26 |
+
- function: take_first
|
| 27 |
+
name: flexible-extract
|
| 28 |
+
metric_list:
|
| 29 |
+
- metric: exact_match
|
| 30 |
+
aggregation: mean
|
| 31 |
+
higher_is_better: true
|
| 32 |
+
ignore_case: true
|
| 33 |
+
ignore_punctuation: true
|
| 34 |
+
metadata:
|
| 35 |
+
version: 2.0
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_1/afrimgsm_yor.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: yor
|
| 3 |
+
include: afrimgsm_yaml
|
| 4 |
+
task: afrimgsm_yor_prompt_1
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_1/afrimgsm_zul.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: zul
|
| 3 |
+
include: afrimgsm_yaml
|
| 4 |
+
task: afrimgsm_zul_prompt_1
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_2/afrimgsm_amh.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: amh
|
| 3 |
+
include: afrimgsm_yaml
|
| 4 |
+
task: afrimgsm_amh_prompt_2
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_2/afrimgsm_eng.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: eng
|
| 3 |
+
include: afrimgsm_yaml
|
| 4 |
+
task: afrimgsm_eng_prompt_2
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_2/afrimgsm_fra.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: fra
|
| 3 |
+
include: afrimgsm_yaml
|
| 4 |
+
task: afrimgsm_fra_prompt_2
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_2/afrimgsm_hau.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: hau
|
| 3 |
+
include: afrimgsm_yaml
|
| 4 |
+
task: afrimgsm_hau_prompt_2
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_2/afrimgsm_ibo.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: ibo
|
| 3 |
+
include: afrimgsm_yaml
|
| 4 |
+
task: afrimgsm_ibo_prompt_2
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_2/afrimgsm_lin.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: lin
|
| 3 |
+
include: afrimgsm_yaml
|
| 4 |
+
task: afrimgsm_lin_prompt_2
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_2/afrimgsm_lug.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: lug
|
| 3 |
+
include: afrimgsm_yaml
|
| 4 |
+
task: afrimgsm_lug_prompt_2
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_2/afrimgsm_orm.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: orm
|
| 3 |
+
include: afrimgsm_yaml
|
| 4 |
+
task: afrimgsm_orm_prompt_2
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_2/afrimgsm_sna.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: sna
|
| 3 |
+
include: afrimgsm_yaml
|
| 4 |
+
task: afrimgsm_sna_prompt_2
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_2/afrimgsm_swa.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: swa
|
| 3 |
+
include: afrimgsm_yaml
|
| 4 |
+
task: afrimgsm_swa_prompt_2
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_2/afrimgsm_twi.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: twi
|
| 3 |
+
include: afrimgsm_yaml
|
| 4 |
+
task: afrimgsm_twi_prompt_2
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_2/afrimgsm_wol.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: wol
|
| 3 |
+
include: afrimgsm_yaml
|
| 4 |
+
task: afrimgsm_wol_prompt_2
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_2/afrimgsm_xho.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: xho
|
| 3 |
+
include: afrimgsm_yaml
|
| 4 |
+
task: afrimgsm_xho_prompt_2
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_2/afrimgsm_yaml
ADDED
|
@@ -0,0 +1,34 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
tag:
|
| 2 |
+
- afrimgsm_tasks
|
| 3 |
+
- afrimgsm_tasks_prompt_1
|
| 4 |
+
dataset_path: masakhane/afrimgsm
|
| 5 |
+
output_type: generate_until
|
| 6 |
+
test_split: test
|
| 7 |
+
doc_to_target: '{% if answer is not none %}{{answer[21:]}}{% else %}{{answer_number|string}}{% endif %}'
|
| 8 |
+
doc_to_text: "Give direct numerical answers for the question provided. \n\nQuestion: {{question}} \nAnswer: "
|
| 9 |
+
target_delimiter: ""
|
| 10 |
+
generation_kwargs:
|
| 11 |
+
do_sample: false
|
| 12 |
+
until:
|
| 13 |
+
- 'Question:'
|
| 14 |
+
- </s>
|
| 15 |
+
- <|im_end|>
|
| 16 |
+
filter_list:
|
| 17 |
+
- name: remove_whitespace
|
| 18 |
+
filter:
|
| 19 |
+
- function: remove_whitespace
|
| 20 |
+
- function: take_first
|
| 21 |
+
- filter:
|
| 22 |
+
- function: regex
|
| 23 |
+
group_select: -1
|
| 24 |
+
regex_pattern: (-?[$0-9.,]{2,})|(-?[0-9]+)
|
| 25 |
+
- function: take_first
|
| 26 |
+
name: flexible-extract
|
| 27 |
+
metric_list:
|
| 28 |
+
- metric: exact_match
|
| 29 |
+
aggregation: mean
|
| 30 |
+
higher_is_better: true
|
| 31 |
+
ignore_case: true
|
| 32 |
+
ignore_punctuation: true
|
| 33 |
+
metadata:
|
| 34 |
+
version: 2.0
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_2/afrimgsm_zul.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: zul
|
| 3 |
+
include: afrimgsm_yaml
|
| 4 |
+
task: afrimgsm_zul_prompt_2
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_3/afrimgsm_amh.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: amh
|
| 3 |
+
include: afrimgsm_yaml
|
| 4 |
+
task: afrimgsm_amh_prompt_3
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_3/afrimgsm_eng.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: eng
|
| 3 |
+
include: afrimgsm_yaml
|
| 4 |
+
task: afrimgsm_eng_prompt_3
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_3/afrimgsm_ewe.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: ewe
|
| 3 |
+
include: afrimgsm_yaml
|
| 4 |
+
task: afrimgsm_ewe_prompt_3
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_3/afrimgsm_fra.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: fra
|
| 3 |
+
include: afrimgsm_yaml
|
| 4 |
+
task: afrimgsm_fra_prompt_3
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_3/afrimgsm_hau.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: hau
|
| 3 |
+
include: afrimgsm_yaml
|
| 4 |
+
task: afrimgsm_hau_prompt_3
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_3/afrimgsm_lin.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: lin
|
| 3 |
+
include: afrimgsm_yaml
|
| 4 |
+
task: afrimgsm_lin_prompt_3
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_3/afrimgsm_lug.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: lug
|
| 3 |
+
include: afrimgsm_yaml
|
| 4 |
+
task: afrimgsm_lug_prompt_3
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_3/afrimgsm_orm.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: orm
|
| 3 |
+
include: afrimgsm_yaml
|
| 4 |
+
task: afrimgsm_orm_prompt_3
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_3/afrimgsm_swa.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: swa
|
| 3 |
+
include: afrimgsm_yaml
|
| 4 |
+
task: afrimgsm_swa_prompt_3
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_3/afrimgsm_twi.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: twi
|
| 3 |
+
include: afrimgsm_yaml
|
| 4 |
+
task: afrimgsm_twi_prompt_3
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_3/afrimgsm_vai.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: vai
|
| 3 |
+
include: afrimgsm_yaml
|
| 4 |
+
task: afrimgsm_vai_prompt_3
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_3/afrimgsm_wol.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: wol
|
| 3 |
+
include: afrimgsm_yaml
|
| 4 |
+
task: afrimgsm_wol_prompt_3
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_4/afrimgsm_amh.yaml
ADDED
|
@@ -0,0 +1,7 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: amh
|
| 3 |
+
doc_to_text: "Answer the given question with the appropriate numerical value, ensuring\
|
| 4 |
+
\ that the response is clear and without any supplementary information. \n\nQuestion:\
|
| 5 |
+
\ {{question}} \nAnswer: "
|
| 6 |
+
include: afrimgsm_yaml
|
| 7 |
+
task: afrimgsm_amh_prompt_4
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_4/afrimgsm_eng.yaml
ADDED
|
@@ -0,0 +1,7 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: eng
|
| 3 |
+
doc_to_text: "Answer the given question with the appropriate numerical value, ensuring\
|
| 4 |
+
\ that the response is clear and without any supplementary information. \n\nQuestion:\
|
| 5 |
+
\ {{question}} \nAnswer: "
|
| 6 |
+
include: afrimgsm_yaml
|
| 7 |
+
task: afrimgsm_eng_prompt_4
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_4/afrimgsm_ewe.yaml
ADDED
|
@@ -0,0 +1,7 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: ewe
|
| 3 |
+
doc_to_text: "Answer the given question with the appropriate numerical value, ensuring\
|
| 4 |
+
\ that the response is clear and without any supplementary information. \n\nQuestion:\
|
| 5 |
+
\ {{question}} \nAnswer: "
|
| 6 |
+
include: afrimgsm_yaml
|
| 7 |
+
task: afrimgsm_ewe_prompt_4
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_4/afrimgsm_fra.yaml
ADDED
|
@@ -0,0 +1,7 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: fra
|
| 3 |
+
doc_to_text: "Answer the given question with the appropriate numerical value, ensuring\
|
| 4 |
+
\ that the response is clear and without any supplementary information. \n\nQuestion:\
|
| 5 |
+
\ {{question}} \nAnswer: "
|
| 6 |
+
include: afrimgsm_yaml
|
| 7 |
+
task: afrimgsm_fra_prompt_4
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_4/afrimgsm_hau.yaml
ADDED
|
@@ -0,0 +1,7 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: hau
|
| 3 |
+
doc_to_text: "Answer the given question with the appropriate numerical value, ensuring\
|
| 4 |
+
\ that the response is clear and without any supplementary information. \n\nQuestion:\
|
| 5 |
+
\ {{question}} \nAnswer: "
|
| 6 |
+
include: afrimgsm_yaml
|
| 7 |
+
task: afrimgsm_hau_prompt_4
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct/prompt_4/afrimgsm_kin.yaml
ADDED
|
@@ -0,0 +1,7 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: kin
|
| 3 |
+
doc_to_text: "Answer the given question with the appropriate numerical value, ensuring\
|
| 4 |
+
\ that the response is clear and without any supplementary information. \n\nQuestion:\
|
| 5 |
+
\ {{question}} \nAnswer: "
|
| 6 |
+
include: afrimgsm_yaml
|
| 7 |
+
task: afrimgsm_kin_prompt_4
|