cazyundee commited on
Commit
d3842e2
·
verified ·
1 Parent(s): 024ac84

Pass Qwen prompt through async job

Browse files
Files changed (1) hide show
  1. app.py +5 -3
app.py CHANGED
@@ -517,10 +517,11 @@ def _run_benchmark_job(job_id, kind, model_filter=None, force=False, request=Non
517
  payload = {"status": "complete", "result": result}
518
  elif kind == "qwen38":
519
  request = request or _BENCH_JOBS.get(job_id, {}).get("request", {})
 
520
  with _BENCH_LOCK:
521
  result = _generate_qwen38(
522
- model_filter,
523
- request.get("max_new_tokens", 64),
524
  request.get("temperature", 0.7),
525
  request.get("thinking", False),
526
  )
@@ -601,7 +602,7 @@ def _generate_qwen38(prompt, max_new_tokens=256, temperature=0.7, thinking=True)
601
  processor, model = _load_qwen38()
602
  max_new_tokens = max(1, min(256, int(max_new_tokens)))
603
  temperature = max(0.0, min(2.0, float(temperature)))
604
- content = prompt
605
  messages = [{"role": "user", "content": [{"type": "text", "text": content}]}]
606
  try:
607
  text = processor.apply_chat_template(
@@ -786,6 +787,7 @@ def _patched_create_app(blocks, **kwargs):
786
  "qwen38",
787
  None,
788
  request={
 
789
  "max_new_tokens": payload.get("max_new_tokens", 256),
790
  "temperature": payload.get("temperature", 0.7),
791
  "thinking": payload.get("thinking", True),
 
517
  payload = {"status": "complete", "result": result}
518
  elif kind == "qwen38":
519
  request = request or _BENCH_JOBS.get(job_id, {}).get("request", {})
520
+ qwen_prompt = request.get("prompt") or model_filter or ""
521
  with _BENCH_LOCK:
522
  result = _generate_qwen38(
523
+ qwen_prompt,
524
+ request.get("max_new_tokens", 256),
525
  request.get("temperature", 0.7),
526
  request.get("thinking", False),
527
  )
 
602
  processor, model = _load_qwen38()
603
  max_new_tokens = max(1, min(256, int(max_new_tokens)))
604
  temperature = max(0.0, min(2.0, float(temperature)))
605
+ content = str(prompt).strip()
606
  messages = [{"role": "user", "content": [{"type": "text", "text": content}]}]
607
  try:
608
  text = processor.apply_chat_template(
 
787
  "qwen38",
788
  None,
789
  request={
790
+ "prompt": prompt,
791
  "max_new_tokens": payload.get("max_new_tokens", 256),
792
  "temperature": payload.get("temperature", 0.7),
793
  "thinking": payload.get("thinking", True),