Spaces:
Running on Zero
Running on Zero
Pass Qwen prompt through async job
Browse files
app.py
CHANGED
|
@@ -517,10 +517,11 @@ def _run_benchmark_job(job_id, kind, model_filter=None, force=False, request=Non
|
|
| 517 |
payload = {"status": "complete", "result": result}
|
| 518 |
elif kind == "qwen38":
|
| 519 |
request = request or _BENCH_JOBS.get(job_id, {}).get("request", {})
|
|
|
|
| 520 |
with _BENCH_LOCK:
|
| 521 |
result = _generate_qwen38(
|
| 522 |
-
|
| 523 |
-
request.get("max_new_tokens",
|
| 524 |
request.get("temperature", 0.7),
|
| 525 |
request.get("thinking", False),
|
| 526 |
)
|
|
@@ -601,7 +602,7 @@ def _generate_qwen38(prompt, max_new_tokens=256, temperature=0.7, thinking=True)
|
|
| 601 |
processor, model = _load_qwen38()
|
| 602 |
max_new_tokens = max(1, min(256, int(max_new_tokens)))
|
| 603 |
temperature = max(0.0, min(2.0, float(temperature)))
|
| 604 |
-
content = prompt
|
| 605 |
messages = [{"role": "user", "content": [{"type": "text", "text": content}]}]
|
| 606 |
try:
|
| 607 |
text = processor.apply_chat_template(
|
|
@@ -786,6 +787,7 @@ def _patched_create_app(blocks, **kwargs):
|
|
| 786 |
"qwen38",
|
| 787 |
None,
|
| 788 |
request={
|
|
|
|
| 789 |
"max_new_tokens": payload.get("max_new_tokens", 256),
|
| 790 |
"temperature": payload.get("temperature", 0.7),
|
| 791 |
"thinking": payload.get("thinking", True),
|
|
|
|
| 517 |
payload = {"status": "complete", "result": result}
|
| 518 |
elif kind == "qwen38":
|
| 519 |
request = request or _BENCH_JOBS.get(job_id, {}).get("request", {})
|
| 520 |
+
qwen_prompt = request.get("prompt") or model_filter or ""
|
| 521 |
with _BENCH_LOCK:
|
| 522 |
result = _generate_qwen38(
|
| 523 |
+
qwen_prompt,
|
| 524 |
+
request.get("max_new_tokens", 256),
|
| 525 |
request.get("temperature", 0.7),
|
| 526 |
request.get("thinking", False),
|
| 527 |
)
|
|
|
|
| 602 |
processor, model = _load_qwen38()
|
| 603 |
max_new_tokens = max(1, min(256, int(max_new_tokens)))
|
| 604 |
temperature = max(0.0, min(2.0, float(temperature)))
|
| 605 |
+
content = str(prompt).strip()
|
| 606 |
messages = [{"role": "user", "content": [{"type": "text", "text": content}]}]
|
| 607 |
try:
|
| 608 |
text = processor.apply_chat_template(
|
|
|
|
| 787 |
"qwen38",
|
| 788 |
None,
|
| 789 |
request={
|
| 790 |
+
"prompt": prompt,
|
| 791 |
"max_new_tokens": payload.get("max_new_tokens", 256),
|
| 792 |
"temperature": payload.get("temperature", 0.7),
|
| 793 |
"thinking": payload.get("thinking", True),
|